Adaptive Mode: roteamento inteligente de modelos

O modelo de IA certo para cada tarefa,
escolhido automaticamente, antes de você enviar

O Adaptive Mode lê o prompt que você está prestes a enviar e sugere o modelo mais econômico para a tarefa. Uma correção de digitação ou uma tradução vão para um modelo leve e barato. Uma grande refatoração ou um projeto de arquitetura vão para um flagship. Você escolhe só a potência de que realmente precisa.

Modelos menores custam uma fração do flagship. Ajustar o modelo a cada tarefa significa queimar muito menos do orçamento do seu plano por tarefa, então você faz mais tarefas por dia sem esbarrar em um limite de uso. Um clique aplica a sugestão e você segue trabalhando.

Adaptive Mode
Analisando a tarefa
Traduzir uma string da interface
Melhor escolha
Haiku
Sonnet
Opus
Custo por tarefaMais tarefas por dia

O Adaptive Mode combina cada tarefa com o modelo mais barato capaz de fazê-la bem: Haiku para trabalho leve, Sonnet para trabalho equilibrado, Opus para trabalho pesado. Menos custo por tarefa, mais tarefas por dia.

Eis o problema de dinheiro ao rodar agentes de código de IA. Todo modelo tem um preço, e a diferença entre o barato e o flagship é grande. O Claude Opus é o modelo mais capaz e o mais caro. O Claude Haiku é o mais barato. O Claude Sonnet fica no meio. A maioria das pessoas escolhe um modelo e deixa por isso mesmo, então ou subdimensiona as tarefas difíceis ou, bem mais frequentemente, paga a mais nas fáceis.

Pense no que você realmente pede a um agente ao longo de um dia. Corrigir uma digitação. Renomear uma variável. Traduzir uma string da interface. Escrever um teste unitário curto. Resumir um documento. Nada disso precisa de um flagship. Rodar tudo no Opus queima o orçamento de uso do seu plano muitas vezes mais rápido do que o necessário, para um resultado idêntico. Esse desperdício é invisível, e é exatamente por isso que ele se acumula.

O Adaptive Mode fecha essa lacuna. Antes de você enviar a primeira mensagem, ele lê o seu rascunho, avalia o quão difícil a tarefa realmente é e sugere o modelo mais barato da linha do seu provider que ainda faça o trabalho bem. Os modelos pesados ficam reservados para o trabalho que os merece: arquitetura, auditorias de segurança, grandes refatorações. Todo o resto vai para um modelo que custa uma fração disso.

Por que combinar o modelo com a tarefa

Pare de pagar a mais em tarefas fáceis. Um flagship numa correção de digitação é dinheiro jogado fora. O Adaptive Mode direciona o trabalho leve para um modelo leve, então cada tarefa trivial custa uma fração do que custaria no nível mais alto.

Reserve o modelo potente para os problemas difíceis. Ajustar não é sempre ir no mais barato. Quando a tarefa é um projeto de sistema ou uma auditoria de segurança, o Adaptive Mode avisa para subir de nível, para que o trabalho que precisa de profundidade realmente a tenha.

Mais tarefas por dia no mesmo plano. Menos orçamento gasto por tarefa significa atingir o limite de uso mais tarde. Ao longo de um dia inteiro e de uma frota de agentes em paralelo, as economias se somam em throughput extra de verdade.

Zero atrito no fluxo de trabalho. A sugestão aparece como um pequeno chip acima do campo de mensagem antes de você enviar. Um clique a aplica. Sem menus para vasculhar, sem adivinhação manual de qual modelo serve, sem lentidão.

A economia: consumir menos, fazer mais

Mesmos agentes, mesmo plano. A diferença é quanto do seu orçamento cada tarefa consome.

Um modelo para tudo

  • : Toda tarefa roda no modelo que você deixou selecionado.
  • : Um flagship numa digitação ou tradução custa várias vezes mais do que deveria.
  • : O orçamento de uso do seu plano se esvazia rápido em trabalho que nunca precisou dessa potência.
  • : Você atinge o limite de uso mais cedo no dia e os agentes travam.
  • : Trocar de modelo na mão é chato, então ninguém faz.

Adaptive Mode ligado

  • : Cada tarefa é combinada com o modelo mais barato capaz de fazê-la bem.
  • : O trabalho leve vai para um modelo leve e custa uma fração disso.
  • : O flagship fica guardado para refatorações, auditorias e arquitetura.
  • : Menos orçamento por tarefa significa mais tarefas antes de qualquer limite de uso.
  • : Um clique aplica o modelo certo, então o ajuste realmente acontece.

O roteamento em si é quase de graça: um modelo pequeno e rápido faz a análise por bem menos de um centavo e depois sai do caminho.

Como o Adaptive Mode funciona, passo a passo

Ele roda uma vez, antes da sua primeira mensagem, e nunca atrapalha.

01

Você começa a digitar o prompt

Abra uma conversa nova com qualquer agente e escreva o que você quer feito. O Adaptive Mode só olha conversas totalmente novas, então nunca interrompe uma sessão que já está em andamento.

02

Ele lê a tarefa e a analisa

Quando o seu rascunho está consistente o suficiente e você faz uma pausa, o Adaptive Mode envia o início do rascunho para um modelo de roteamento pequeno e rápido, que avalia o quão exigente é a tarefa.

03

Surge uma sugestão de modelo

Um chip aparece acima do campo de mensagem: 'Mudar para Haiku', 'Mudar para Sonnet' ou 'Mudar para Opus', conforme a opção mais econômica. Se o seu modelo atual já for a melhor escolha, ele avisa isso em vez disso.

04

Você aplica com um clique

Clique no chip e o modelo é aplicado. Se uma sessão já estiver rodando, o Adaptive Mode a troca ao vivo. A escolha também é salva no agente, então o próximo início começa no modelo certo.

05

Ou recalcule, ou dispense

Reescreveu o prompt? Toque em atualizar para recalcular a recomendação para o novo rascunho. Satisfeito com o modelo atual? Dispense o chip e envie. Você fica no controle de cada decisão.

06

Depois disso, ele fica quieto

O Adaptive Mode sugere uma vez por conversa, então nunca fica te enchendo nem gasta às escondidas a sua cota mensal enquanto você continua editando. Faz o trabalho dele e some.

Roteamento de modelos agnóstico de provider

O Adaptive Mode lê a linha de modelos do provider que você usa e recomenda a partir desse catálogo. Ele não está preso a um único fornecedor.

Claude

Roteia entre Haiku, Sonnet e Opus. Haiku para correções rápidas, renomeações, traduções, testes curtos e resumos. Sonnet para revisões de pull request, novos endpoints, depuração complexa e refatorações. Opus para arquitetura de sistema, auditorias de segurança, grandes refatorações de código legado e trabalho de performance em profundidade.

Codex

Roteia dentro da linha Codex, do modelo mini rápido e barato para pequenos bugs e perguntas rápidas, ao modelo equilibrado padrão para funcionalidades de ponta a ponta e testes, até o modelo de raciocínio flagship para projeto de sistema complexo e revisão de código aprofundada.

Antigravity

Roteia entre o modelo Antigravity rápido para pequenas correções, traduções e resumos e o modelo Antigravity capaz para implementar funcionalidades, depurar e fazer análises mais profundas.

Outros providers

Para qualquer provider, o Adaptive Mode recorre a uma regra simples: o modelo mais barato para trabalho leve, um modelo equilibrado para trabalho normal, o modelo mais capaz para trabalho difícil. Adicione um provider e ele roteia dentro dos próprios modelos desse provider.

Funciona com o seu provider
Claude, Codex, Antigravity e mais. As sugestões são validadas contra os modelos que aquele provider realmente oferece, então você nunca recebe uma recomendação que não pode aplicar.
Só o seu rascunho, só quando necessário
Para calcular uma sugestão, o início do seu rascunho é enviado aos servidores do AgentsRoom. Isso roda uma vez por conversa, em uma conversa nova, e só quando você tem o Adaptive Mode ativado.
Ligado por padrão, desligado com um toque
O Adaptive Mode já vem ativado porque ajustar o modelo economiza dinheiro logo de cara. Desligue-o quando quiser nas configurações se preferir escolher os modelos por conta própria.

FAQ

O que é o Adaptive Mode no AgentsRoom?

O Adaptive Mode é o roteamento inteligente de modelos para os seus agentes de código de IA. Antes de você enviar a primeira mensagem, ele lê o seu prompt e sugere o modelo mais econômico da linha do seu provider que ainda faça a tarefa bem. Uma tarefa leve recebe um modelo leve e barato; uma tarefa pesada recebe um flagship. O objetivo é simples: parar de pagar a mais com um modelo potente em trabalho que não precisa disso.

Como o Adaptive Mode escolhe um modelo?

Ele envia o início do seu rascunho para um modelo de roteamento pequeno e rápido, orientado com exemplos de quais tipos de tarefa combinam com qual nível de modelo. Então ele retorna o modelo mais barato que serve para a tarefa, validado contra os modelos que o seu provider atual realmente oferece. Se o seu modelo atual já for a melhor escolha, ele diz que o modelo é ótimo em vez de empurrar uma mudança.

Como isso de fato me economiza dinheiro?

Modelos mais baratos custam uma fração do flagship para a mesma tarefa simples. Se você roda correções de digitação, renomeações, traduções e testes curtos no modelo top, queima o orçamento de uso do seu plano muitas vezes mais rápido do que o necessário. O Adaptive Mode direciona esse trabalho leve para um modelo leve, então cada tarefa custa menos e você consegue rodar mais tarefas antes de atingir um limite de uso. Ao longo de um dia e de muitos agentes em paralelo, essas economias se somam.

Quais modelos ele pode sugerir?

O que o seu provider oferecer. No Claude são Haiku, Sonnet e Opus. No Codex abrange o modelo mini rápido, o equilibrado padrão e o modelo de raciocínio flagship. No Antigravity abrange o modelo rápido e o capaz. Para outros providers, ele recorre ao mais barato, ao equilibrado e ao mais capaz. O Adaptive Mode lê a lista de modelos ao vivo, então sempre recomenda um modelo que você de fato pode rodar.

Ele troca o modelo automaticamente?

Não. O Adaptive Mode apenas sugere. Você aplica a mudança com um único clique no chip. Se uma sessão já estiver rodando, ele troca o modelo ao vivo; em todo caso, a escolha é salva no agente para que o próximo início comece no modelo certo. Você também pode dispensar a sugestão e manter o seu modelo atual.

Quando a sugestão aparece?

Em uma conversa totalmente nova, depois que você digitou um prompt consistente e fez uma pausa. Ela roda uma vez por conversa, então nunca interrompe uma sessão em andamento nem gasta às escondidas a sua cota mensal enquanto você continua editando.

Posso recalcular a sugestão?

Sim. Se você reescrever o prompt, toque no botão de atualizar no chip para recalcular a recomendação para o novo rascunho. Um recálculo manual usa uma das suas sugestões mensais, então ele está ali quando você quiser, sem rodar a cada tecla.

Meu prompt é privado?

Para calcular uma sugestão, só o início do seu rascunho é enviado aos servidores do AgentsRoom, uma vez por conversa e só quando o Adaptive Mode está ativado. Você pode desativar totalmente o recurso nas configurações se preferir escolher os modelos por conta própria.

O Adaptive Mode funciona com Codex e Antigravity, não só com Claude?

Sim. O Adaptive Mode é agnóstico de provider. Ele lê o catálogo de modelos do provider que o agente está usando e recomenda a partir desse catálogo, seja Claude, Codex, Antigravity ou outro provider suportado. O comando de troca de modelo é feito para o provider em que você está.

Como ligo ou desligo o Adaptive Mode?

Ele vem ligado por padrão, porque ajustar o modelo economiza dinheiro logo de cara. Você pode desativá-lo ou reativá-lo quando quiser nas configurações do AgentsRoom, em Adaptive Model.

Combina bem com

Pare de pagar a mais por potência de modelo de IA que você não precisa

Baixe o AgentsRoom e deixe o Adaptive Mode escolher o modelo mais econômico para cada tarefa. Modelos leves para trabalho leve, flagships para os problemas difíceis, menos orçamento queimado por tarefa, mais tarefas entregues por dia.

GratisBaixar AgentsRoom

App complementar: acompanhe seus agentes em qualquer lugar

Use Claude, Codex, Antigravity CLI ou outro provedor de IA.

Instalar a extensão
Chrome Web Store

Envie bugs e pedidos direto para o seu backlog público.

Uma visão do AgentsRoom em ação.

Multi-projetos
Multi-provedor
Multi-agentes
Status ao vivo
Diff e commit
App mobile
Preview ao vivo
Equipes de agentes
Testes no navegador
Dev guiada por backlog
Biblioteca de prompts
Biblioteca de skills
Ver todas as funcionalidades