Equivalências de modelos de IA

Equivalências de modelos de IA: o Opus, o Sonnet e o Haiku de cada CLI de código

Você sabe a linha Claude de cor, aí abre o Codex, o Gemini ou o Grok e nenhum nome diz qual modelo faz o papel do Opus. Esta página coloca numa única escala cada modelo de cada CLI de agente de código que o AgentsRoom executa, para que cada um seja lido nos termos que você já conhece.

Dados lidos ao vivo do catálogo de modelos do AgentsRoom. Popularidade atualizada em 6 de out. de 2026, 16:16.

CLI comparados

12

Modelos classificados

94

Inicializações contadas, últimos 30 dias

51.051

A resposta curta

O Claude serve de régua porque é a linha que a maioria dos desenvolvedores conhece. Cada frase cita os modelos de outros fabricantes que fazem hoje o mesmo papel.

Nível Fable

Equivalentes de nível Fable (fronteira)

Os modelos de fronteira, um degrau acima do Opus: GPT-6 Astra no Codex, Daybreak Blue no Codex e GPT-5.6 Sol Max no Codex.

Para os problemas mais difíceis, pelo preço mais alto.

Nível Opus

Equivalentes do Opus

Os modelos que fazem o papel do Claude Opus: GPT-6.1 Sol no Codex, Gemini 3.1 Pro (High) no Antigravity e Grok 4.7 no Grok.

O flagship em que roda a maior parte do trabalho sério de programação.

Nível Sonnet

Equivalentes do Sonnet

Os modelos que fazem o papel do Claude Sonnet: GPT-6 Luna no Codex, GPT-5.6 Terra no Codex, Gemini 3.8 Flash (High) no Antigravity, GLM 5.3 no OpenCode, Qwen3.8 Max no OpenCode, DeepSeek no Aider, Medium 3.5 no Mistral Vibe e Kimi K3 no Kimi.

Equilibrado: forte o bastante para a maioria das funcionalidades, mais barato que o flagship.

Nível Haiku

Equivalentes do Haiku

Os modelos que fazem o papel do Claude Haiku: Codex Spark no Codex, Qwen3 Coder no Ollama, GLM 4.6 no Ollama e DeepSeek V4 Flash no oh-my-pi.

Leve e rápido: renomeações, pequenas correções, resumos.

Todos os CLI de código, nível por nível

Uma linha por CLI que o AgentsRoom executa, uma coluna por nível. Os modelos atuais vêm primeiro; as versões anteriores que uma lista ainda oferece são contadas abaixo deles.

Equivalências de modelos de IA por CLI de agente de código e por nível de capacidade
CLIFronteiraNível FableNível OpusNível SonnetNível Haiku
Claude
Fable
OpusOpus 5.5
+2 versões anteriores

Opus 5, Opus 4.8

SonnetSonnet 5.5
+1 versão anterior

Sonnet 5

Haiku
Codex
GPT-6 AstraDaybreak BlueDaybreak RedGPT-5.6 Sol Max
GPT-6.1 Sol
+3 versões anteriores

GPT-6 Sol, GPT-5.6 Sol, GPT-5.5

GPT-6 LunaGPT-5.6 Terra
+4 versões anteriores

GPT-5.6 Luna, GPT-5, GPT-5.4, GPT-5.2

Codex Spark
+1 versão anterior

GPT-5.4 Mini

AntigravityNenhum
Gemini 3.1 Pro (High)Claude Opus 5.5 (High)Claude Opus 5.5 (Medium)
Gemini 3.8 Flash (High)Gemini 3.8 Flash (Medium)Claude Sonnet 5.5 (High)Claude Sonnet 5.5 (Medium)
+5 versões anteriores

Gemini 3.7 Flash (High), Gemini 3.7 Flash (Medium), Gemini 3.6 Flash (High), Gemini 3.6 Flash (Medium), Gemini 3.5 Flash (Medium)

Nenhum
OpenCodeNenhum
Claude Opus
Claude SonnetGPT-5Kimi K3GLM 5.3Qwen3.8 Max
Nenhum
AiderNenhum
Claude Opus
Claude SonnetDeepSeek
GPT-4o
GrokNenhum
Grok 4.7
NenhumNenhum
Mistral VibeNenhumNenhum
Medium 3.5
Nenhum
OllamaNenhumNenhum
Qwen3 Coder 480B
Gemma 3Qwen3 CoderGLM 4.6
GitHub Copilot
GPT-6 Astra
GPT-6.1 SolClaude Opus 5.5GPT-5.5
+5 versões anteriores

GPT-6 Sol, Claude Opus 5, GPT-5.6 Sol, Claude Opus 4.8, Claude Opus 4.7

Claude Sonnet 5.5GPT-6 LunaGPT-5.6 TerraGemini 3.7 FlashKimi K3
+4 versões anteriores

Claude Sonnet 5, GPT-5.6 Luna, Claude Sonnet 4.6, Gemini 3.6 Flash

Claude Haiku 4.5MAI-Code-1.1-Flash
KimiNenhumNenhum
Kimi K3Kimi K3-256KKimi K2.8 PreviewK2.7 Code HighSpeed
Nenhum
oh-my-piNenhum
Claude Opus 5.5GPT-6 Sol
Claude Sonnet 5Gemini FlashGLM 5.3
+1 versão anterior

GLM 5.2

DeepSeek V4 Flash
DevinNenhum
Claude OpusGPTCodexGemini
SWEClaude SonnetGLMKimiDeepSeek
Claude Haiku
AmpEscolhe o modelo por você a cada requisição: sem nível fixo.
FreebuffEscolhe o modelo por você a cada requisição: sem nível fixo.
CursorEscolhe o modelo por você a cada requisição: sem nível fixo.
  • Entre os três modelos do seu CLI que a comunidade mais inicia
  • Versão anterior: uma geração mais nova do mesmo modelo está na mesma lista

Mesmo modelo, vários CLI

Uma família de modelos não fica presa à ferramenta do seu fabricante. Aqui estão todas as famílias que mais de um CLI oferece hoje, com o nome que cada CLI dá a elas.

Claude Opus

Nível Opus

7 CLI

  • ClaudeOpus 5.5
  • AntigravityClaude Opus 5.5 (High)
  • OpenCodeClaude Opus
  • AiderClaude Opus
  • GitHub CopilotClaude Opus 5.5
  • oh-my-piClaude Opus 5.5
  • DevinClaude Opus

Claude Sonnet

Nível Sonnet

7 CLI

  • ClaudeSonnet 5.5
  • AntigravityClaude Sonnet 5.5 (High)
  • OpenCodeClaude Sonnet
  • AiderClaude Sonnet
  • GitHub CopilotClaude Sonnet 5.5
  • oh-my-piClaude Sonnet 5
  • DevinClaude Sonnet

Kimi

Nível Sonnet

4 CLI

  • KimiKimi K3
  • OpenCodeKimi K3
  • GitHub CopilotKimi K3
  • DevinKimi

GLM

Nível Sonnet

4 CLI

  • OpenCodeGLM 5.3
  • OllamaGLM 4.6
  • oh-my-piGLM 5.3
  • DevinGLM

Claude Haiku

Nível Haiku

3 CLI

  • ClaudeHaiku
  • GitHub CopilotClaude Haiku 4.5
  • DevinClaude Haiku

GPT Sol

Nível Opus

3 CLI

  • CodexGPT-6.1 Sol
  • GitHub CopilotGPT-6.1 Sol
  • oh-my-piGPT-6 Sol

Gemini Flash

Nível Sonnet

3 CLI

  • AntigravityGemini 3.8 Flash (High)
  • GitHub CopilotGemini 3.7 Flash
  • oh-my-piGemini Flash

DeepSeek

Nível Sonnet

3 CLI

  • AiderDeepSeek
  • oh-my-piDeepSeek V4 Flash
  • DevinDeepSeek

GPT Astra

Nível Fable

2 CLI

  • CodexGPT-6 Astra
  • GitHub CopilotGPT-6 Astra

GPT Luna

Nível Sonnet

2 CLI

  • CodexGPT-6 Luna
  • GitHub CopilotGPT-6 Luna

GPT Terra

Nível Sonnet

2 CLI

  • CodexGPT-5.6 Terra
  • GitHub CopilotGPT-5.6 Terra

Qwen

Nível Sonnet

2 CLI

  • OpenCodeQwen3.8 Max
  • OllamaQwen3 Coder

O que os desenvolvedores realmente iniciam

Os modelos mais iniciados dos últimos 30 dias entre os usuários do AgentsRoom, lidos em termos de nível. As equivalências dizem quais modelos fazem o mesmo papel; as inicializações dizem quais as pessoas escolhem.

  1. 1

    OpusNível Opus

    Claude439 membros

    22,9% das inicializações

  2. 2

    SonnetNível Sonnet

    Claude173 membros

    12,8% das inicializações

  3. 3

    Opus 5.5Nível Opus

    Claude103 membros

    9,4% das inicializações

  4. 4

    GPT-5.6 SolNível Opus

    Codex119 membros

    5% das inicializações

  5. 5

    GPT-6 LunaNível Sonnet

    Codex47 membros

    4,9% das inicializações

Todas as estatísticas de uso, por CLI e por modelo

Como os níveis são atribuídos

Uma única escala de quatro níveis, ancorada no Claude: nível Fable (fronteira), nível Opus (flagship), nível Sonnet (equilibrado) e nível Haiku (leve). Cada família de modelos recebe o nível do papel que o seu fabricante lhe dá na própria linha, e a mesma família mantém o mesmo nível em todos os CLI que a oferecem.

Na OpenAI, Astra é um modelo de fronteira, Sol é o flagship, Luna e Terra são os modelos equilibrados, e Spark e os modelos mini são os leves. O Gemini Pro fica no nível Opus e o Gemini Flash no nível Sonnet. O Grok Heavy é de fronteira e o Grok em si fica no nível Opus.

As famílias de pesos abertos (Kimi, GLM, DeepSeek, Qwen e outras) ficam no máximo no nível Sonnet, e as suas versões leves no nível Haiku. Entre dois níveis, a tabela sempre escolhe o mais baixo: prefere subestimar um modelo a dizer que ele pode substituir o Opus sem ter demonstrado isso.

Os roteadores não têm nível, porque escolhem um modelo a cada requisição: GitHub Copilot (Auto), Amp (Amp default), Freebuff (Freebuff default), Devin (Adaptive) e Cursor (Default). Uma família que a tabela ainda não conhece também não tem: nenhuma equivalência é melhor do que uma errada.

Um nível não é uma pontuação de benchmark. Dois modelos do mesmo nível ainda diferem em preço, velocidade, janela de contexto, limites de uso e nas tarefas em que se saem melhor. Use a tabela para saber onde procurar e depois teste os dois na sua própria tarefa.

Dados: o catálogo de modelos que o AgentsRoom fornece ao app desktop e ao app móvel, lido a cada visita, e as regras de nível que o app aplica sob cada lista de modelos. Popularidade: inicializações reais de agentes pelos usuários do AgentsRoom que compartilham dados de uso, nos últimos 30 dias, atualizadas a cada dez minutos.

Perguntas frequentes

Qual modelo do Codex é o equivalente do Claude Opus?

GPT-6.1 Sol. Na tabela acima, o Claude Opus e o GPT-6.1 Sol estão ambos no nível Opus: o flagship em que roda a maior parte do trabalho sério de programação, um degrau abaixo do nível de fronteira. O modelo de fronteira do Codex, o equivalente do Fable, é o GPT-6 Astra. Para o trabalho de nível Sonnet, o modelo do Codex é o GPT-6 Luna. E o modelo de nível Haiku da lista é o Codex Spark.

Qual é o equivalente do Claude Opus no Gemini?

Gemini 3.1 Pro (High), no Antigravity. O Gemini Pro é a linha flagship do Google, por isso fica no nível Opus. O Gemini Flash faz o papel do Sonnet: hoje, o Gemini 3.8 Flash (High).

Qual modelo GPT é o equivalente do Claude Sonnet?

GPT-6 Luna, no Codex. A linha equilibrada da OpenAI fica no nível Sonnet: forte o bastante para a maioria das funcionalidades, mais barata que o flagship.

Qual é o equivalente do Claude Haiku na OpenAI?

Codex Spark, no Codex: o modelo leve e rápido da linha, para renomeações, pequenas correções e perguntas rápidas.

O GPT-6.1 Sol é tão bom quanto o Opus 5.5?

Mesmo nível não quer dizer mesmos resultados. O GPT-6.1 Sol e o Opus 5.5 fazem o mesmo papel na linha do respectivo fabricante, mas ainda diferem em preço, velocidade, janela de contexto, limites de uso e nas tarefas que resolvem melhor, e os rankings de benchmark entre os dois mudam a cada lançamento. A resposta confiável é rodar os dois em uma mesma tarefa sua: o AgentsRoom inicia um agente em cada um, lado a lado, no mesmo projeto.

Onde posso usar o Claude Opus fora do Claude Code?

Hoje, o Opus também está nas listas de modelos de Antigravity, OpenCode, Aider, GitHub Copilot, oh-my-pi e Devin, com o nome que cada CLI lhe dá. Mesma família, mesmo nível: a equivalência não muda com o CLI que o oferece.

Por que a tabela limita Kimi, GLM ou Qwen ao nível Sonnet?

Porque a escala segue o papel que um modelo cumpre, e nunca exagera. As famílias de pesos abertos costumam ter um ótimo custo-benefício e vários CLI as oferecem, mas colocar uma delas no nível Opus seria dizer que ela pode substituir o Opus em qualquer tarefa, o que nenhuma demonstrou em todas as frentes. As suas versões leves ficam no nível Haiku.

Por que Auto e Default não têm equivalente?

Porque não são um modelo: GitHub Copilot (Auto), Amp (Amp default), Freebuff (Freebuff default), Devin (Adaptive) e Cursor (Default) deixam o serviço escolher um modelo a cada requisição, então não há uma capacidade fixa para comparar. A tabela os deixa de fora em vez de adivinhar.

Esta tabela está atualizada?

Ela é calculada sempre que a página é aberta, a partir do mesmo catálogo de modelos que o app AgentsRoom fornece a cada computador e a cada celular. Quando o AgentsRoom adiciona um modelo que um CLI acabou de lançar, ele aparece aqui na hora, no seu nível, e a versão que ele substitui é marcada como anterior. As chamas de popularidade são atualizadas a cada dez minutos com base nos últimos 30 dias de inicializações.

O AgentsRoom pode escolher o modelo certo para a minha tarefa?

Sim, de duas formas, e as duas apenas sugerem. O AI Suggestion dimensiona a tarefa antes de a sessão abrir (Rápida, Padrão, Complexa ou Extrema) e abre o agente no modelo mais barato do seu CLI que ainda consegue fazê-la. O Adaptive Mode lê o seu rascunho depois que o CLI já está rodando e sugere um modelo mais leve quando a tarefa não precisa do flagship, ou confirma que o atual é o certo.

No AgentsRoom

O AgentsRoom responde a essa pergunta dentro do seu seletor de modelos

O AgentsRoom é um centro de comando desktop para agentes de código IA. Claude, Codex, GitHub Copilot CLI, Cursor e outros 10 CLI de agentes rodam lado a lado, cada agente no modelo que você escolher. As equivalências desta página são as que o app mostra enquanto você escolhe, e alguns recursos inteligentes ajudam a ajustar o modelo à tarefa.

≈ Opus abaixo de cada modelo

Cada lista de modelos (novo agente, agente rápido, ticket do backlog, app móvel) marca cada modelo com o seu equivalente no CLI que você conhece melhor, e ordena por potência, preço ou popularidade.

Equivalências de modelos no app

Deixe a tarefa escolher o modelo

O AI Suggestion transforma uma descrição de uma linha em um nível de complexidade (Rápida, Padrão, Complexa, Extrema) e abre o agente no modelo mais barato que dá conta. O Adaptive Mode revisa o seu rascunho e sugere um modelo mais leve quando o flagship é exagero.

AI Suggestion e Adaptive Mode

Mude para o modelo equivalente

Quando uma conta se aproxima do limite, uma regra de cota pode iniciar os novos agentes em outro CLI, modelo por modelo: Fable, Opus e Sonnet vão cada um para o seu equivalente do mesmo nível, já preenchido a partir destes níveis.

Regras de cota e alertas de uso

O modelo certo para cada ticket

Fixe um provedor, um modelo e um esforço de raciocínio em um ticket do backlog, para que o agente que o executa use exatamente isso, e guarde o flagship para os tickets que precisam dele.

Quadro de tarefas do backlog

Passe os testes para um modelo mais barato

Um agente desenvolvedor em um modelo flagship passa a execução dos testes para um agente de QA em um modelo mais leve, via MCP, assim o modelo caro fica no código.

Delegação de agente

Um modelo por etapa

Em uma equipe de agentes, cada etapa tem o seu próprio papel, CLI e modelo: o arquiteto em um modelo de fronteira, o implementador em um modelo de nível Opus, o revisor onde compensar.

Equipes de agentes
Baixar o AgentsRoom

Para se aprofundar