Nível Fable
Equivalentes de nível Fable (fronteira)
Os modelos de fronteira, um degrau acima do Opus: GPT-6 Astra no Codex, Daybreak Blue no Codex e GPT-5.6 Sol Max no Codex.
Para os problemas mais difíceis, pelo preço mais alto.
Equivalências de modelos de IA
Você sabe a linha Claude de cor, aí abre o Codex, o Gemini ou o Grok e nenhum nome diz qual modelo faz o papel do Opus. Esta página coloca numa única escala cada modelo de cada CLI de agente de código que o AgentsRoom executa, para que cada um seja lido nos termos que você já conhece.
Dados lidos ao vivo do catálogo de modelos do AgentsRoom. Popularidade atualizada em 6 de out. de 2026, 16:16.
CLI comparados
12
Modelos classificados
94
Inicializações contadas, últimos 30 dias
51.051
O Claude serve de régua porque é a linha que a maioria dos desenvolvedores conhece. Cada frase cita os modelos de outros fabricantes que fazem hoje o mesmo papel.
Nível Fable
Os modelos de fronteira, um degrau acima do Opus: GPT-6 Astra no Codex, Daybreak Blue no Codex e GPT-5.6 Sol Max no Codex.
Para os problemas mais difíceis, pelo preço mais alto.
Nível Opus
Os modelos que fazem o papel do Claude Opus: GPT-6.1 Sol no Codex, Gemini 3.1 Pro (High) no Antigravity e Grok 4.7 no Grok.
O flagship em que roda a maior parte do trabalho sério de programação.
Nível Sonnet
Os modelos que fazem o papel do Claude Sonnet: GPT-6 Luna no Codex, GPT-5.6 Terra no Codex, Gemini 3.8 Flash (High) no Antigravity, GLM 5.3 no OpenCode, Qwen3.8 Max no OpenCode, DeepSeek no Aider, Medium 3.5 no Mistral Vibe e Kimi K3 no Kimi.
Equilibrado: forte o bastante para a maioria das funcionalidades, mais barato que o flagship.
Nível Haiku
Os modelos que fazem o papel do Claude Haiku: Codex Spark no Codex, Qwen3 Coder no Ollama, GLM 4.6 no Ollama e DeepSeek V4 Flash no oh-my-pi.
Leve e rápido: renomeações, pequenas correções, resumos.
Uma linha por CLI que o AgentsRoom executa, uma coluna por nível. Os modelos atuais vêm primeiro; as versões anteriores que uma lista ainda oferece são contadas abaixo deles.
| CLI | FronteiraNível Fable | Nível Opus | Nível Sonnet | Nível Haiku |
|---|---|---|---|---|
Fable | OpusOpus 5.5 +2 versões anterioresOpus 5, Opus 4.8 | SonnetSonnet 5.5 +1 versão anteriorSonnet 5 | Haiku | |
GPT-6 AstraDaybreak BlueDaybreak RedGPT-5.6 Sol Max | GPT-6.1 Sol +3 versões anterioresGPT-6 Sol, GPT-5.6 Sol, GPT-5.5 | GPT-6 LunaGPT-5.6 Terra +4 versões anterioresGPT-5.6 Luna, GPT-5, GPT-5.4, GPT-5.2 | Codex Spark +1 versão anteriorGPT-5.4 Mini | |
| Nenhum | Gemini 3.1 Pro (High)Claude Opus 5.5 (High)Claude Opus 5.5 (Medium) | Gemini 3.8 Flash (High)Gemini 3.8 Flash (Medium)Claude Sonnet 5.5 (High)Claude Sonnet 5.5 (Medium) +5 versões anterioresGemini 3.7 Flash (High), Gemini 3.7 Flash (Medium), Gemini 3.6 Flash (High), Gemini 3.6 Flash (Medium), Gemini 3.5 Flash (Medium) | Nenhum | |
| Nenhum | Claude Opus | Claude SonnetGPT-5Kimi K3GLM 5.3Qwen3.8 Max | Nenhum | |
| Nenhum | Claude Opus | Claude SonnetDeepSeek | GPT-4o | |
| Nenhum | Grok 4.7 | Nenhum | Nenhum | |
| Nenhum | Nenhum | Medium 3.5 | Nenhum | |
| Nenhum | Nenhum | Qwen3 Coder 480B | Gemma 3Qwen3 CoderGLM 4.6 | |
GPT-6 Astra | GPT-6.1 SolClaude Opus 5.5GPT-5.5 +5 versões anterioresGPT-6 Sol, Claude Opus 5, GPT-5.6 Sol, Claude Opus 4.8, Claude Opus 4.7 | Claude Sonnet 5.5GPT-6 LunaGPT-5.6 TerraGemini 3.7 FlashKimi K3 +4 versões anterioresClaude Sonnet 5, GPT-5.6 Luna, Claude Sonnet 4.6, Gemini 3.6 Flash | Claude Haiku 4.5MAI-Code-1.1-Flash | |
| Nenhum | Nenhum | Kimi K3Kimi K3-256KKimi K2.8 PreviewK2.7 Code HighSpeed | Nenhum | |
| Nenhum | Claude Opus 5.5GPT-6 Sol | Claude Sonnet 5Gemini FlashGLM 5.3 +1 versão anteriorGLM 5.2 | DeepSeek V4 Flash | |
| Nenhum | Claude OpusGPTCodexGemini | SWEClaude SonnetGLMKimiDeepSeek | Claude Haiku | |
| Escolhe o modelo por você a cada requisição: sem nível fixo. | ||||
| Escolhe o modelo por você a cada requisição: sem nível fixo. | ||||
| Escolhe o modelo por você a cada requisição: sem nível fixo. | ||||
Uma família de modelos não fica presa à ferramenta do seu fabricante. Aqui estão todas as famílias que mais de um CLI oferece hoje, com o nome que cada CLI dá a elas.
7 CLI
7 CLI
4 CLI
4 CLI
3 CLI
3 CLI
3 CLI
3 CLI
2 CLI
2 CLI
2 CLI
2 CLI
Os modelos mais iniciados dos últimos 30 dias entre os usuários do AgentsRoom, lidos em termos de nível. As equivalências dizem quais modelos fazem o mesmo papel; as inicializações dizem quais as pessoas escolhem.
OpusNível Opus
22,9% das inicializações
SonnetNível Sonnet
12,8% das inicializações
Opus 5.5Nível Opus
9,4% das inicializações
GPT-5.6 SolNível Opus
5% das inicializações
GPT-6 LunaNível Sonnet
4,9% das inicializações
Uma única escala de quatro níveis, ancorada no Claude: nível Fable (fronteira), nível Opus (flagship), nível Sonnet (equilibrado) e nível Haiku (leve). Cada família de modelos recebe o nível do papel que o seu fabricante lhe dá na própria linha, e a mesma família mantém o mesmo nível em todos os CLI que a oferecem.
Na OpenAI, Astra é um modelo de fronteira, Sol é o flagship, Luna e Terra são os modelos equilibrados, e Spark e os modelos mini são os leves. O Gemini Pro fica no nível Opus e o Gemini Flash no nível Sonnet. O Grok Heavy é de fronteira e o Grok em si fica no nível Opus.
As famílias de pesos abertos (Kimi, GLM, DeepSeek, Qwen e outras) ficam no máximo no nível Sonnet, e as suas versões leves no nível Haiku. Entre dois níveis, a tabela sempre escolhe o mais baixo: prefere subestimar um modelo a dizer que ele pode substituir o Opus sem ter demonstrado isso.
Os roteadores não têm nível, porque escolhem um modelo a cada requisição: GitHub Copilot (Auto), Amp (Amp default), Freebuff (Freebuff default), Devin (Adaptive) e Cursor (Default). Uma família que a tabela ainda não conhece também não tem: nenhuma equivalência é melhor do que uma errada.
Um nível não é uma pontuação de benchmark. Dois modelos do mesmo nível ainda diferem em preço, velocidade, janela de contexto, limites de uso e nas tarefas em que se saem melhor. Use a tabela para saber onde procurar e depois teste os dois na sua própria tarefa.
Dados: o catálogo de modelos que o AgentsRoom fornece ao app desktop e ao app móvel, lido a cada visita, e as regras de nível que o app aplica sob cada lista de modelos. Popularidade: inicializações reais de agentes pelos usuários do AgentsRoom que compartilham dados de uso, nos últimos 30 dias, atualizadas a cada dez minutos.
GPT-6.1 Sol. Na tabela acima, o Claude Opus e o GPT-6.1 Sol estão ambos no nível Opus: o flagship em que roda a maior parte do trabalho sério de programação, um degrau abaixo do nível de fronteira. O modelo de fronteira do Codex, o equivalente do Fable, é o GPT-6 Astra. Para o trabalho de nível Sonnet, o modelo do Codex é o GPT-6 Luna. E o modelo de nível Haiku da lista é o Codex Spark.
Gemini 3.1 Pro (High), no Antigravity. O Gemini Pro é a linha flagship do Google, por isso fica no nível Opus. O Gemini Flash faz o papel do Sonnet: hoje, o Gemini 3.8 Flash (High).
GPT-6 Luna, no Codex. A linha equilibrada da OpenAI fica no nível Sonnet: forte o bastante para a maioria das funcionalidades, mais barata que o flagship.
Codex Spark, no Codex: o modelo leve e rápido da linha, para renomeações, pequenas correções e perguntas rápidas.
Mesmo nível não quer dizer mesmos resultados. O GPT-6.1 Sol e o Opus 5.5 fazem o mesmo papel na linha do respectivo fabricante, mas ainda diferem em preço, velocidade, janela de contexto, limites de uso e nas tarefas que resolvem melhor, e os rankings de benchmark entre os dois mudam a cada lançamento. A resposta confiável é rodar os dois em uma mesma tarefa sua: o AgentsRoom inicia um agente em cada um, lado a lado, no mesmo projeto.
Hoje, o Opus também está nas listas de modelos de Antigravity, OpenCode, Aider, GitHub Copilot, oh-my-pi e Devin, com o nome que cada CLI lhe dá. Mesma família, mesmo nível: a equivalência não muda com o CLI que o oferece.
Porque a escala segue o papel que um modelo cumpre, e nunca exagera. As famílias de pesos abertos costumam ter um ótimo custo-benefício e vários CLI as oferecem, mas colocar uma delas no nível Opus seria dizer que ela pode substituir o Opus em qualquer tarefa, o que nenhuma demonstrou em todas as frentes. As suas versões leves ficam no nível Haiku.
Porque não são um modelo: GitHub Copilot (Auto), Amp (Amp default), Freebuff (Freebuff default), Devin (Adaptive) e Cursor (Default) deixam o serviço escolher um modelo a cada requisição, então não há uma capacidade fixa para comparar. A tabela os deixa de fora em vez de adivinhar.
Ela é calculada sempre que a página é aberta, a partir do mesmo catálogo de modelos que o app AgentsRoom fornece a cada computador e a cada celular. Quando o AgentsRoom adiciona um modelo que um CLI acabou de lançar, ele aparece aqui na hora, no seu nível, e a versão que ele substitui é marcada como anterior. As chamas de popularidade são atualizadas a cada dez minutos com base nos últimos 30 dias de inicializações.
Sim, de duas formas, e as duas apenas sugerem. O AI Suggestion dimensiona a tarefa antes de a sessão abrir (Rápida, Padrão, Complexa ou Extrema) e abre o agente no modelo mais barato do seu CLI que ainda consegue fazê-la. O Adaptive Mode lê o seu rascunho depois que o CLI já está rodando e sugere um modelo mais leve quando a tarefa não precisa do flagship, ou confirma que o atual é o certo.
No AgentsRoom
O AgentsRoom é um centro de comando desktop para agentes de código IA. Claude, Codex, GitHub Copilot CLI, Cursor e outros 10 CLI de agentes rodam lado a lado, cada agente no modelo que você escolher. As equivalências desta página são as que o app mostra enquanto você escolhe, e alguns recursos inteligentes ajudam a ajustar o modelo à tarefa.
Cada lista de modelos (novo agente, agente rápido, ticket do backlog, app móvel) marca cada modelo com o seu equivalente no CLI que você conhece melhor, e ordena por potência, preço ou popularidade.
Equivalências de modelos no appO AI Suggestion transforma uma descrição de uma linha em um nível de complexidade (Rápida, Padrão, Complexa, Extrema) e abre o agente no modelo mais barato que dá conta. O Adaptive Mode revisa o seu rascunho e sugere um modelo mais leve quando o flagship é exagero.
AI Suggestion e Adaptive ModeQuando uma conta se aproxima do limite, uma regra de cota pode iniciar os novos agentes em outro CLI, modelo por modelo: Fable, Opus e Sonnet vão cada um para o seu equivalente do mesmo nível, já preenchido a partir destes níveis.
Regras de cota e alertas de usoFixe um provedor, um modelo e um esforço de raciocínio em um ticket do backlog, para que o agente que o executa use exatamente isso, e guarde o flagship para os tickets que precisam dele.
Quadro de tarefas do backlogUm agente desenvolvedor em um modelo flagship passa a execução dos testes para um agente de QA em um modelo mais leve, via MCP, assim o modelo caro fica no código.
Delegação de agenteEm uma equipe de agentes, cada etapa tem o seu próprio papel, CLI e modelo: o arquiteto em um modelo de fronteira, o implementador em um modelo de nível Opus, o revisor onde compensar.
Equipes de agentesUma comparação honesta entre Claude Code e Codex CLI: preço, velocidade, MCP, controle. E por que, depois de algumas semanas, parei de escolher entre eles.
O Ollama agora é um provedor no AgentsRoom. Rode modelos open source locais como Llama, Qwen, Gemma e DeepSeek ao lado dos agentes na nuvem, com um controle local ou nuvem por agente, alternável no meio da conversa.