Nivel Fable
Equivalentes de nivel Fable (frontera)
Los modelos de frontera, un escalón por encima de Opus: GPT-6 Astra en Codex, Daybreak Blue en Codex y GPT-5.6 Sol Max en Codex.
Para los problemas más difíciles, al precio más alto.
Equivalencias de modelos de IA
Te sabes la gama de Claude de memoria, abres Codex, Gemini o Grok y ningún nombre te dice qué modelo hace el papel de Opus. Esta página sitúa en una sola escala cada modelo de cada CLI de agentes de código que AgentsRoom ejecuta, para que cada uno se lea en términos que ya conoces.
Datos leídos en directo del catálogo de modelos de AgentsRoom. Popularidad actualizada el 6 oct 2026, 16:16.
CLI comparados
12
Modelos clasificados
94
Lanzamientos contados, últimos 30 días
51.051
Claude sirve de vara de medir porque es la gama que conoce la mayoría de los desarrolladores. Cada línea nombra los modelos de otros fabricantes que hoy hacen el mismo papel.
Nivel Fable
Los modelos de frontera, un escalón por encima de Opus: GPT-6 Astra en Codex, Daybreak Blue en Codex y GPT-5.6 Sol Max en Codex.
Para los problemas más difíciles, al precio más alto.
Nivel Opus
Los modelos que hacen el papel de Claude Opus: GPT-6.1 Sol en Codex, Gemini 3.1 Pro (High) en Antigravity y Grok 4.7 en Grok.
El flagship sobre el que corre la mayor parte del trabajo serio de programación.
Nivel Sonnet
Los modelos que hacen el papel de Claude Sonnet: GPT-6 Luna en Codex, GPT-5.6 Terra en Codex, Gemini 3.8 Flash (High) en Antigravity, GLM 5.3 en OpenCode, Qwen3.8 Max en OpenCode, DeepSeek en Aider, Medium 3.5 en Mistral Vibe y Kimi K3 en Kimi.
Equilibrado: lo bastante potente para la mayoría de las funcionalidades, más barato que el flagship.
Nivel Haiku
Los modelos que hacen el papel de Claude Haiku: Codex Spark en Codex, Qwen3 Coder en Ollama, GLM 4.6 en Ollama y DeepSeek V4 Flash en oh-my-pi.
Ligero y rápido: renombrados, pequeñas correcciones, resúmenes.
Una fila por cada CLI que AgentsRoom ejecuta, una columna por nivel. Primero van los modelos actuales; las versiones anteriores que una lista todavía ofrece se cuentan debajo de ellos.
| CLI | FronteraNivel Fable | Nivel Opus | Nivel Sonnet | Nivel Haiku |
|---|---|---|---|---|
Fable | OpusOpus 5.5 +2 versiones anterioresOpus 5, Opus 4.8 | SonnetSonnet 5.5 +1 versión anteriorSonnet 5 | Haiku | |
GPT-6 AstraDaybreak BlueDaybreak RedGPT-5.6 Sol Max | GPT-6.1 Sol +3 versiones anterioresGPT-6 Sol, GPT-5.6 Sol, GPT-5.5 | GPT-6 LunaGPT-5.6 Terra +4 versiones anterioresGPT-5.6 Luna, GPT-5, GPT-5.4, GPT-5.2 | Codex Spark +1 versión anteriorGPT-5.4 Mini | |
| Ninguno | Gemini 3.1 Pro (High)Claude Opus 5.5 (High)Claude Opus 5.5 (Medium) | Gemini 3.8 Flash (High)Gemini 3.8 Flash (Medium)Claude Sonnet 5.5 (High)Claude Sonnet 5.5 (Medium) +5 versiones anterioresGemini 3.7 Flash (High), Gemini 3.7 Flash (Medium), Gemini 3.6 Flash (High), Gemini 3.6 Flash (Medium), Gemini 3.5 Flash (Medium) | Ninguno | |
| Ninguno | Claude Opus | Claude SonnetGPT-5Kimi K3GLM 5.3Qwen3.8 Max | Ninguno | |
| Ninguno | Claude Opus | Claude SonnetDeepSeek | GPT-4o | |
| Ninguno | Grok 4.7 | Ninguno | Ninguno | |
| Ninguno | Ninguno | Medium 3.5 | Ninguno | |
| Ninguno | Ninguno | Qwen3 Coder 480B | Gemma 3Qwen3 CoderGLM 4.6 | |
GPT-6 Astra | GPT-6.1 SolClaude Opus 5.5GPT-5.5 +5 versiones anterioresGPT-6 Sol, Claude Opus 5, GPT-5.6 Sol, Claude Opus 4.8, Claude Opus 4.7 | Claude Sonnet 5.5GPT-6 LunaGPT-5.6 TerraGemini 3.7 FlashKimi K3 +4 versiones anterioresClaude Sonnet 5, GPT-5.6 Luna, Claude Sonnet 4.6, Gemini 3.6 Flash | Claude Haiku 4.5MAI-Code-1.1-Flash | |
| Ninguno | Ninguno | Kimi K3Kimi K3-256KKimi K2.8 PreviewK2.7 Code HighSpeed | Ninguno | |
| Ninguno | Claude Opus 5.5GPT-6 Sol | Claude Sonnet 5Gemini FlashGLM 5.3 +1 versión anteriorGLM 5.2 | DeepSeek V4 Flash | |
| Ninguno | Claude OpusGPTCodexGemini | SWEClaude SonnetGLMKimiDeepSeek | Claude Haiku | |
| Elige el modelo por ti en cada petición: sin nivel fijo. | ||||
| Elige el modelo por ti en cada petición: sin nivel fijo. | ||||
| Elige el modelo por ti en cada petición: sin nivel fijo. | ||||
Una familia de modelos no está atada a la herramienta de su fabricante. Estas son todas las familias que hoy ofrece más de un CLI, con el nombre que les da cada CLI.
7 CLI
7 CLI
4 CLI
4 CLI
3 CLI
3 CLI
3 CLI
3 CLI
2 CLI
2 CLI
2 CLI
2 CLI
Los modelos más lanzados de los últimos 30 días entre los usuarios de AgentsRoom, leídos en términos de nivel. Las equivalencias te dicen qué modelos hacen el mismo papel; los lanzamientos, cuáles elige la gente.
OpusNivel Opus
22,9 % de los lanzamientos
SonnetNivel Sonnet
12,8 % de los lanzamientos
Opus 5.5Nivel Opus
9,4 % de los lanzamientos
GPT-5.6 SolNivel Opus
5 % de los lanzamientos
GPT-6 LunaNivel Sonnet
4,9 % de los lanzamientos
Una sola escala de cuatro niveles, anclada en Claude: nivel Fable (frontera), nivel Opus (flagship), nivel Sonnet (equilibrado) y nivel Haiku (ligero). Cada familia de modelos recibe el nivel del papel que su fabricante le da en su propia gama, y una misma familia conserva el mismo nivel en todos los CLI que la ofrecen.
Astra, de OpenAI, es un modelo de frontera; Sol es su flagship; Luna y Terra, sus modelos equilibrados; Spark y los modelos mini, los ligeros. Gemini Pro está en el nivel Opus y Gemini Flash en el nivel Sonnet. Grok Heavy es de frontera y Grok a secas está en el nivel Opus.
Las familias de pesos abiertos (Kimi, GLM, DeepSeek, Qwen y otras) se sitúan como mucho en el nivel Sonnet, y sus versiones ligeras en el nivel Haiku. Entre dos niveles, la tabla elige siempre el más bajo: prefiere quedarse corta con un modelo antes que decirte que puede sustituir a Opus cuando no lo ha demostrado.
Los routers no tienen nivel, porque eligen un modelo en cada petición: GitHub Copilot (Auto), Amp (Amp default), Freebuff (Freebuff default), Devin (Adaptive) y Cursor (Default). Tampoco lo tiene una familia que la tabla todavía no conoce: mejor ninguna equivalencia que una equivocada.
Un nivel no es una puntuación de benchmark. Dos modelos del mismo nivel siguen diferenciándose en precio, velocidad, ventana de contexto, límites de uso y las tareas en las que rinden mejor. Usa la tabla para saber dónde buscar y luego prueba los dos en tu propia tarea.
Datos: el catálogo de modelos que AgentsRoom sirve a sus apps de escritorio y móvil, leído en cada visita, y las reglas de nivel que la app aplica bajo cada lista de modelos. Popularidad: lanzamientos reales de agentes de los usuarios de AgentsRoom que comparten sus datos de uso, en los últimos 30 días, actualizados cada diez minutos.
GPT-6.1 Sol. En la tabla de arriba, Claude Opus y GPT-6.1 Sol están los dos en el nivel Opus: el flagship sobre el que corre la mayor parte del trabajo serio de programación, un escalón por debajo del nivel de frontera. El modelo de frontera de Codex, el equivalente de Fable, es GPT-6 Astra. Para el trabajo de nivel Sonnet, el modelo de Codex es GPT-6 Luna. Y el modelo de nivel Haiku de la lista es Codex Spark.
Gemini 3.1 Pro (High), en Antigravity. Gemini Pro es la línea flagship de Google, así que está en el nivel Opus. Gemini Flash hace el papel de Sonnet: hoy, Gemini 3.8 Flash (High).
GPT-6 Luna, en Codex. La línea equilibrada de OpenAI está en el nivel Sonnet: lo bastante potente para la mayoría de las funcionalidades, más barata que el flagship.
Codex Spark, en Codex: el modelo ligero y rápido de la gama, para renombrados, pequeñas correcciones y preguntas rápidas.
Mismo nivel no significa mismos resultados. GPT-6.1 Sol y Opus 5.5 hacen el mismo papel en la gama de su respectivo fabricante, pero siguen diferenciándose en precio, velocidad, ventana de contexto, límites de uso y las tareas que mejor resuelven, y los rankings de benchmarks entre los dos cambian con cada versión. La respuesta fiable es ejecutar los dos sobre una misma tarea tuya: AgentsRoom lanza un agente en cada uno, lado a lado, en el mismo proyecto.
Hoy, Opus también está en las listas de modelos de Antigravity, OpenCode, Aider, GitHub Copilot, oh-my-pi y Devin, con el nombre que le da cada CLI. Misma familia, mismo nivel: la equivalencia no cambia con el CLI que lo sirve.
Porque la escala sigue el papel que desempeña un modelo, y nunca exagera. Las familias de pesos abiertos suelen tener una relación calidad-precio excelente y varios CLI las incluyen, pero situar una en el nivel Opus sería decirte que puede sustituir a Opus en cualquier tarea, algo que ninguna ha demostrado en todos los frentes. Sus versiones ligeras están en el nivel Haiku.
Porque no son un modelo: GitHub Copilot (Auto), Amp (Amp default), Freebuff (Freebuff default), Devin (Adaptive) y Cursor (Default) dejan que el servicio elija un modelo en cada petición, así que no hay una capacidad fija que comparar. La tabla los deja fuera antes que adivinar.
Se calcula cada vez que se abre la página, a partir del mismo catálogo de modelos que la app AgentsRoom sirve a cada ordenador y a cada teléfono. Cuando AgentsRoom añade un modelo que un CLI acaba de publicar, aparece aquí al instante, en su nivel, y la versión que sustituye se marca como anterior. Las llamas de popularidad se actualizan cada diez minutos a partir de los últimos 30 días de lanzamientos.
Sí, de dos formas, y las dos solo sugieren. AI Suggestion dimensiona la tarea antes de que se abra la sesión (Rápida, Estándar, Compleja o Extrema) y abre el agente en el modelo más barato de su CLI que todavía puede hacerla. Adaptive Mode lee tu borrador una vez que el CLI está en marcha y sugiere un modelo más ligero cuando la tarea no necesita el flagship, o te confirma que el actual es el adecuado.
En AgentsRoom
AgentsRoom es un centro de mando de escritorio para agentes de código IA. Claude, Codex, GitHub Copilot CLI, Cursor y otros 10 CLI de agentes funcionan lado a lado, cada agente en el modelo que elijas. Las equivalencias de esta página son las que la app te muestra mientras eliges, y varias funciones inteligentes te ayudan a ajustar el modelo a la tarea.
Cada lista de modelos (nuevo agente, agente rápido, ticket del backlog, app móvil) etiqueta cada modelo con su equivalente en el CLI que mejor conoces, y se ordena por potencia, precio o popularidad.
Equivalencias de modelos en la appAI Suggestion convierte una descripción de una línea en un nivel de complejidad (Rápida, Estándar, Compleja, Extrema) y abre el agente en el modelo más barato que encaja. Adaptive Mode revisa tu borrador y sugiere un modelo más ligero cuando el flagship es excesivo.
AI Suggestion y Adaptive ModeCuando una cuenta se acerca a su límite, una regla de cuota puede lanzar los nuevos agentes en otro CLI, modelo por modelo: Fable, Opus y Sonnet van cada uno a su equivalente del mismo nivel, ya rellenado a partir de estos niveles.
Reglas de cuota y alertas de usoFija un proveedor, un modelo y un esfuerzo de razonamiento en un ticket del backlog, para que el agente que lo ejecute use exactamente eso, y reserva el flagship para los tickets que lo necesitan.
Tablero de tareas del backlogUn agente desarrollador en un modelo flagship pasa la ejecución de los tests a un agente QA en uno más ligero vía MCP, así el modelo caro se queda en el código.
Delegación de agenteEn un equipo de agentes, cada paso tiene su propio rol, CLI y modelo: el arquitecto en un modelo de frontera, el implementador en un modelo de nivel Opus, el revisor donde convenga.
Equipos de agentesUna comparativa honesta de Claude Code y Codex CLI: precios, velocidad, MCP, control. Y por qué, tras unas semanas, dejé de elegir entre ellos.
Ollama ya es un proveedor en AgentsRoom. Ejecuta modelos open source locales como Llama, Qwen, Gemma y DeepSeek junto a los agentes cloud, con un mando local o cloud por agente, conmutable a mitad de conversación.