Equivalencias de modelos de IA

Equivalencias de modelos de IA: el Opus, el Sonnet y el Haiku de cada CLI de código

Te sabes la gama de Claude de memoria, abres Codex, Gemini o Grok y ningún nombre te dice qué modelo hace el papel de Opus. Esta página sitúa en una sola escala cada modelo de cada CLI de agentes de código que AgentsRoom ejecuta, para que cada uno se lea en términos que ya conoces.

Datos leídos en directo del catálogo de modelos de AgentsRoom. Popularidad actualizada el 6 oct 2026, 16:16.

CLI comparados

12

Modelos clasificados

94

Lanzamientos contados, últimos 30 días

51.051

La respuesta corta

Claude sirve de vara de medir porque es la gama que conoce la mayoría de los desarrolladores. Cada línea nombra los modelos de otros fabricantes que hoy hacen el mismo papel.

Nivel Fable

Equivalentes de nivel Fable (frontera)

Los modelos de frontera, un escalón por encima de Opus: GPT-6 Astra en Codex, Daybreak Blue en Codex y GPT-5.6 Sol Max en Codex.

Para los problemas más difíciles, al precio más alto.

Nivel Opus

Equivalentes de Opus

Los modelos que hacen el papel de Claude Opus: GPT-6.1 Sol en Codex, Gemini 3.1 Pro (High) en Antigravity y Grok 4.7 en Grok.

El flagship sobre el que corre la mayor parte del trabajo serio de programación.

Nivel Sonnet

Equivalentes de Sonnet

Los modelos que hacen el papel de Claude Sonnet: GPT-6 Luna en Codex, GPT-5.6 Terra en Codex, Gemini 3.8 Flash (High) en Antigravity, GLM 5.3 en OpenCode, Qwen3.8 Max en OpenCode, DeepSeek en Aider, Medium 3.5 en Mistral Vibe y Kimi K3 en Kimi.

Equilibrado: lo bastante potente para la mayoría de las funcionalidades, más barato que el flagship.

Nivel Haiku

Equivalentes de Haiku

Los modelos que hacen el papel de Claude Haiku: Codex Spark en Codex, Qwen3 Coder en Ollama, GLM 4.6 en Ollama y DeepSeek V4 Flash en oh-my-pi.

Ligero y rápido: renombrados, pequeñas correcciones, resúmenes.

Todos los CLI de código, nivel por nivel

Una fila por cada CLI que AgentsRoom ejecuta, una columna por nivel. Primero van los modelos actuales; las versiones anteriores que una lista todavía ofrece se cuentan debajo de ellos.

Equivalencias de modelos de IA por CLI de agentes de código y por nivel de capacidad
CLIFronteraNivel FableNivel OpusNivel SonnetNivel Haiku
Claude
Fable
OpusOpus 5.5
+2 versiones anteriores

Opus 5, Opus 4.8

SonnetSonnet 5.5
+1 versión anterior

Sonnet 5

Haiku
Codex
GPT-6 AstraDaybreak BlueDaybreak RedGPT-5.6 Sol Max
GPT-6.1 Sol
+3 versiones anteriores

GPT-6 Sol, GPT-5.6 Sol, GPT-5.5

GPT-6 LunaGPT-5.6 Terra
+4 versiones anteriores

GPT-5.6 Luna, GPT-5, GPT-5.4, GPT-5.2

Codex Spark
+1 versión anterior

GPT-5.4 Mini

AntigravityNinguno
Gemini 3.1 Pro (High)Claude Opus 5.5 (High)Claude Opus 5.5 (Medium)
Gemini 3.8 Flash (High)Gemini 3.8 Flash (Medium)Claude Sonnet 5.5 (High)Claude Sonnet 5.5 (Medium)
+5 versiones anteriores

Gemini 3.7 Flash (High), Gemini 3.7 Flash (Medium), Gemini 3.6 Flash (High), Gemini 3.6 Flash (Medium), Gemini 3.5 Flash (Medium)

Ninguno
OpenCodeNinguno
Claude Opus
Claude SonnetGPT-5Kimi K3GLM 5.3Qwen3.8 Max
Ninguno
AiderNinguno
Claude Opus
Claude SonnetDeepSeek
GPT-4o
GrokNinguno
Grok 4.7
NingunoNinguno
Mistral VibeNingunoNinguno
Medium 3.5
Ninguno
OllamaNingunoNinguno
Qwen3 Coder 480B
Gemma 3Qwen3 CoderGLM 4.6
GitHub Copilot
GPT-6 Astra
GPT-6.1 SolClaude Opus 5.5GPT-5.5
+5 versiones anteriores

GPT-6 Sol, Claude Opus 5, GPT-5.6 Sol, Claude Opus 4.8, Claude Opus 4.7

Claude Sonnet 5.5GPT-6 LunaGPT-5.6 TerraGemini 3.7 FlashKimi K3
+4 versiones anteriores

Claude Sonnet 5, GPT-5.6 Luna, Claude Sonnet 4.6, Gemini 3.6 Flash

Claude Haiku 4.5MAI-Code-1.1-Flash
KimiNingunoNinguno
Kimi K3Kimi K3-256KKimi K2.8 PreviewK2.7 Code HighSpeed
Ninguno
oh-my-piNinguno
Claude Opus 5.5GPT-6 Sol
Claude Sonnet 5Gemini FlashGLM 5.3
+1 versión anterior

GLM 5.2

DeepSeek V4 Flash
DevinNinguno
Claude OpusGPTCodexGemini
SWEClaude SonnetGLMKimiDeepSeek
Claude Haiku
AmpElige el modelo por ti en cada petición: sin nivel fijo.
FreebuffElige el modelo por ti en cada petición: sin nivel fijo.
CursorElige el modelo por ti en cada petición: sin nivel fijo.
  • Entre los tres modelos de su CLI que más lanza la comunidad
  • Versión anterior: una generación más reciente del mismo modelo está en la misma lista

Mismo modelo, varios CLI

Una familia de modelos no está atada a la herramienta de su fabricante. Estas son todas las familias que hoy ofrece más de un CLI, con el nombre que les da cada CLI.

Claude Opus

Nivel Opus

7 CLI

  • ClaudeOpus 5.5
  • AntigravityClaude Opus 5.5 (High)
  • OpenCodeClaude Opus
  • AiderClaude Opus
  • GitHub CopilotClaude Opus 5.5
  • oh-my-piClaude Opus 5.5
  • DevinClaude Opus

Claude Sonnet

Nivel Sonnet

7 CLI

  • ClaudeSonnet 5.5
  • AntigravityClaude Sonnet 5.5 (High)
  • OpenCodeClaude Sonnet
  • AiderClaude Sonnet
  • GitHub CopilotClaude Sonnet 5.5
  • oh-my-piClaude Sonnet 5
  • DevinClaude Sonnet

Kimi

Nivel Sonnet

4 CLI

  • KimiKimi K3
  • OpenCodeKimi K3
  • GitHub CopilotKimi K3
  • DevinKimi

GLM

Nivel Sonnet

4 CLI

  • OpenCodeGLM 5.3
  • OllamaGLM 4.6
  • oh-my-piGLM 5.3
  • DevinGLM

Claude Haiku

Nivel Haiku

3 CLI

  • ClaudeHaiku
  • GitHub CopilotClaude Haiku 4.5
  • DevinClaude Haiku

GPT Sol

Nivel Opus

3 CLI

  • CodexGPT-6.1 Sol
  • GitHub CopilotGPT-6.1 Sol
  • oh-my-piGPT-6 Sol

Gemini Flash

Nivel Sonnet

3 CLI

  • AntigravityGemini 3.8 Flash (High)
  • GitHub CopilotGemini 3.7 Flash
  • oh-my-piGemini Flash

DeepSeek

Nivel Sonnet

3 CLI

  • AiderDeepSeek
  • oh-my-piDeepSeek V4 Flash
  • DevinDeepSeek

GPT Astra

Nivel Fable

2 CLI

  • CodexGPT-6 Astra
  • GitHub CopilotGPT-6 Astra

GPT Luna

Nivel Sonnet

2 CLI

  • CodexGPT-6 Luna
  • GitHub CopilotGPT-6 Luna

GPT Terra

Nivel Sonnet

2 CLI

  • CodexGPT-5.6 Terra
  • GitHub CopilotGPT-5.6 Terra

Qwen

Nivel Sonnet

2 CLI

  • OpenCodeQwen3.8 Max
  • OllamaQwen3 Coder

Lo que los desarrolladores lanzan de verdad

Los modelos más lanzados de los últimos 30 días entre los usuarios de AgentsRoom, leídos en términos de nivel. Las equivalencias te dicen qué modelos hacen el mismo papel; los lanzamientos, cuáles elige la gente.

  1. 1

    OpusNivel Opus

    Claude439 miembros

    22,9 % de los lanzamientos

  2. 2

    SonnetNivel Sonnet

    Claude173 miembros

    12,8 % de los lanzamientos

  3. 3

    Opus 5.5Nivel Opus

    Claude103 miembros

    9,4 % de los lanzamientos

  4. 4

    GPT-5.6 SolNivel Opus

    Codex119 miembros

    5 % de los lanzamientos

  5. 5

    GPT-6 LunaNivel Sonnet

    Codex47 miembros

    4,9 % de los lanzamientos

Todas las estadísticas de uso, por CLI y por modelo

Cómo se asignan los niveles

Una sola escala de cuatro niveles, anclada en Claude: nivel Fable (frontera), nivel Opus (flagship), nivel Sonnet (equilibrado) y nivel Haiku (ligero). Cada familia de modelos recibe el nivel del papel que su fabricante le da en su propia gama, y una misma familia conserva el mismo nivel en todos los CLI que la ofrecen.

Astra, de OpenAI, es un modelo de frontera; Sol es su flagship; Luna y Terra, sus modelos equilibrados; Spark y los modelos mini, los ligeros. Gemini Pro está en el nivel Opus y Gemini Flash en el nivel Sonnet. Grok Heavy es de frontera y Grok a secas está en el nivel Opus.

Las familias de pesos abiertos (Kimi, GLM, DeepSeek, Qwen y otras) se sitúan como mucho en el nivel Sonnet, y sus versiones ligeras en el nivel Haiku. Entre dos niveles, la tabla elige siempre el más bajo: prefiere quedarse corta con un modelo antes que decirte que puede sustituir a Opus cuando no lo ha demostrado.

Los routers no tienen nivel, porque eligen un modelo en cada petición: GitHub Copilot (Auto), Amp (Amp default), Freebuff (Freebuff default), Devin (Adaptive) y Cursor (Default). Tampoco lo tiene una familia que la tabla todavía no conoce: mejor ninguna equivalencia que una equivocada.

Un nivel no es una puntuación de benchmark. Dos modelos del mismo nivel siguen diferenciándose en precio, velocidad, ventana de contexto, límites de uso y las tareas en las que rinden mejor. Usa la tabla para saber dónde buscar y luego prueba los dos en tu propia tarea.

Datos: el catálogo de modelos que AgentsRoom sirve a sus apps de escritorio y móvil, leído en cada visita, y las reglas de nivel que la app aplica bajo cada lista de modelos. Popularidad: lanzamientos reales de agentes de los usuarios de AgentsRoom que comparten sus datos de uso, en los últimos 30 días, actualizados cada diez minutos.

Preguntas frecuentes

¿Qué modelo de Codex es el equivalente de Claude Opus?

GPT-6.1 Sol. En la tabla de arriba, Claude Opus y GPT-6.1 Sol están los dos en el nivel Opus: el flagship sobre el que corre la mayor parte del trabajo serio de programación, un escalón por debajo del nivel de frontera. El modelo de frontera de Codex, el equivalente de Fable, es GPT-6 Astra. Para el trabajo de nivel Sonnet, el modelo de Codex es GPT-6 Luna. Y el modelo de nivel Haiku de la lista es Codex Spark.

¿Cuál es el equivalente de Claude Opus en Gemini?

Gemini 3.1 Pro (High), en Antigravity. Gemini Pro es la línea flagship de Google, así que está en el nivel Opus. Gemini Flash hace el papel de Sonnet: hoy, Gemini 3.8 Flash (High).

¿Qué modelo GPT es el equivalente de Claude Sonnet?

GPT-6 Luna, en Codex. La línea equilibrada de OpenAI está en el nivel Sonnet: lo bastante potente para la mayoría de las funcionalidades, más barata que el flagship.

¿Cuál es el equivalente de Claude Haiku en OpenAI?

Codex Spark, en Codex: el modelo ligero y rápido de la gama, para renombrados, pequeñas correcciones y preguntas rápidas.

¿Es GPT-6.1 Sol tan bueno como Opus 5.5?

Mismo nivel no significa mismos resultados. GPT-6.1 Sol y Opus 5.5 hacen el mismo papel en la gama de su respectivo fabricante, pero siguen diferenciándose en precio, velocidad, ventana de contexto, límites de uso y las tareas que mejor resuelven, y los rankings de benchmarks entre los dos cambian con cada versión. La respuesta fiable es ejecutar los dos sobre una misma tarea tuya: AgentsRoom lanza un agente en cada uno, lado a lado, en el mismo proyecto.

¿Dónde puedo usar Claude Opus fuera de Claude Code?

Hoy, Opus también está en las listas de modelos de Antigravity, OpenCode, Aider, GitHub Copilot, oh-my-pi y Devin, con el nombre que le da cada CLI. Misma familia, mismo nivel: la equivalencia no cambia con el CLI que lo sirve.

¿Por qué la tabla limita Kimi, GLM o Qwen al nivel Sonnet?

Porque la escala sigue el papel que desempeña un modelo, y nunca exagera. Las familias de pesos abiertos suelen tener una relación calidad-precio excelente y varios CLI las incluyen, pero situar una en el nivel Opus sería decirte que puede sustituir a Opus en cualquier tarea, algo que ninguna ha demostrado en todos los frentes. Sus versiones ligeras están en el nivel Haiku.

¿Por qué Auto y Default no tienen equivalente?

Porque no son un modelo: GitHub Copilot (Auto), Amp (Amp default), Freebuff (Freebuff default), Devin (Adaptive) y Cursor (Default) dejan que el servicio elija un modelo en cada petición, así que no hay una capacidad fija que comparar. La tabla los deja fuera antes que adivinar.

¿Está al día esta tabla?

Se calcula cada vez que se abre la página, a partir del mismo catálogo de modelos que la app AgentsRoom sirve a cada ordenador y a cada teléfono. Cuando AgentsRoom añade un modelo que un CLI acaba de publicar, aparece aquí al instante, en su nivel, y la versión que sustituye se marca como anterior. Las llamas de popularidad se actualizan cada diez minutos a partir de los últimos 30 días de lanzamientos.

¿Puede AgentsRoom elegir el modelo adecuado para mi tarea?

Sí, de dos formas, y las dos solo sugieren. AI Suggestion dimensiona la tarea antes de que se abra la sesión (Rápida, Estándar, Compleja o Extrema) y abre el agente en el modelo más barato de su CLI que todavía puede hacerla. Adaptive Mode lee tu borrador una vez que el CLI está en marcha y sugiere un modelo más ligero cuando la tarea no necesita el flagship, o te confirma que el actual es el adecuado.

En AgentsRoom

AgentsRoom responde a esta pregunta dentro de tu selector de modelos

AgentsRoom es un centro de mando de escritorio para agentes de código IA. Claude, Codex, GitHub Copilot CLI, Cursor y otros 10 CLI de agentes funcionan lado a lado, cada agente en el modelo que elijas. Las equivalencias de esta página son las que la app te muestra mientras eliges, y varias funciones inteligentes te ayudan a ajustar el modelo a la tarea.

≈ Opus bajo cada modelo

Cada lista de modelos (nuevo agente, agente rápido, ticket del backlog, app móvil) etiqueta cada modelo con su equivalente en el CLI que mejor conoces, y se ordena por potencia, precio o popularidad.

Equivalencias de modelos en la app

Deja que la tarea elija el modelo

AI Suggestion convierte una descripción de una línea en un nivel de complejidad (Rápida, Estándar, Compleja, Extrema) y abre el agente en el modelo más barato que encaja. Adaptive Mode revisa tu borrador y sugiere un modelo más ligero cuando el flagship es excesivo.

AI Suggestion y Adaptive Mode

Cambia al modelo equivalente

Cuando una cuenta se acerca a su límite, una regla de cuota puede lanzar los nuevos agentes en otro CLI, modelo por modelo: Fable, Opus y Sonnet van cada uno a su equivalente del mismo nivel, ya rellenado a partir de estos niveles.

Reglas de cuota y alertas de uso

El modelo adecuado para cada ticket

Fija un proveedor, un modelo y un esfuerzo de razonamiento en un ticket del backlog, para que el agente que lo ejecute use exactamente eso, y reserva el flagship para los tickets que lo necesitan.

Tablero de tareas del backlog

Pasa los tests a un modelo más barato

Un agente desarrollador en un modelo flagship pasa la ejecución de los tests a un agente QA en uno más ligero vía MCP, así el modelo caro se queda en el código.

Delegación de agente

Un modelo por paso

En un equipo de agentes, cada paso tiene su propio rol, CLI y modelo: el arquitecto en un modelo de frontera, el implementador en un modelo de nivel Opus, el revisor donde convenga.

Equipos de agentes
Descargar AgentsRoom

Para profundizar