Livello Fable
Equivalenti di livello Fable (frontiera)
I modelli di frontiera, un gradino sopra Opus: GPT-6 Astra su Codex, Daybreak Blue su Codex e GPT-5.6 Sol Max su Codex.
Per i problemi più difficili, al prezzo più alto.
Equivalenze tra modelli IA
Conosci la gamma Claude a memoria, poi apri Codex, Gemini o Grok e nessun nome ti dice quale modello fa la parte di Opus. Questa pagina colloca su un'unica scala ogni modello di ogni CLI di agenti di codice che AgentsRoom esegue, così ognuno si legge nei termini che conosci già.
Dati letti in tempo reale dal catalogo dei modelli di AgentsRoom. Popolarità aggiornata al 6 ott 2026, 16:16.
CLI confrontate
12
Modelli classificati
94
Avvii contati, ultimi 30 giorni
51.051
Claude fa da metro di paragone perché è la gamma che la maggior parte degli sviluppatori conosce. Ogni riga indica i modelli di altri produttori che oggi svolgono lo stesso ruolo.
Livello Fable
I modelli di frontiera, un gradino sopra Opus: GPT-6 Astra su Codex, Daybreak Blue su Codex e GPT-5.6 Sol Max su Codex.
Per i problemi più difficili, al prezzo più alto.
Livello Opus
I modelli che fanno la parte di Claude Opus: GPT-6.1 Sol su Codex, Gemini 3.1 Pro (High) su Antigravity e Grok 4.7 su Grok.
Il flagship su cui gira la maggior parte del lavoro serio di programmazione.
Livello Sonnet
I modelli che fanno la parte di Claude Sonnet: GPT-6 Luna su Codex, GPT-5.6 Terra su Codex, Gemini 3.8 Flash (High) su Antigravity, GLM 5.3 su OpenCode, Qwen3.8 Max su OpenCode, DeepSeek su Aider, Medium 3.5 su Mistral Vibe e Kimi K3 su Kimi.
Equilibrato: abbastanza potente per la maggior parte delle funzionalità, più economico del flagship.
Livello Haiku
I modelli che fanno la parte di Claude Haiku: Codex Spark su Codex, Qwen3 Coder su Ollama, GLM 4.6 su Ollama e DeepSeek V4 Flash su oh-my-pi.
Leggero e veloce: ridenominazioni, piccole correzioni, riassunti.
Una riga per ogni CLI che AgentsRoom esegue, una colonna per livello. Prima vengono i modelli attuali; le versioni precedenti che una lista offre ancora sono conteggiate sotto di essi.
| CLI | FrontieraLivello Fable | Livello Opus | Livello Sonnet | Livello Haiku |
|---|---|---|---|---|
Fable | OpusOpus 5.5 +2 versioni precedentiOpus 5, Opus 4.8 | SonnetSonnet 5.5 +1 versione precedenteSonnet 5 | Haiku | |
GPT-6 AstraDaybreak BlueDaybreak RedGPT-5.6 Sol Max | GPT-6.1 Sol +3 versioni precedentiGPT-6 Sol, GPT-5.6 Sol, GPT-5.5 | GPT-6 LunaGPT-5.6 Terra +4 versioni precedentiGPT-5.6 Luna, GPT-5, GPT-5.4, GPT-5.2 | Codex Spark +1 versione precedenteGPT-5.4 Mini | |
| Nessuno | Gemini 3.1 Pro (High)Claude Opus 5.5 (High)Claude Opus 5.5 (Medium) | Gemini 3.8 Flash (High)Gemini 3.8 Flash (Medium)Claude Sonnet 5.5 (High)Claude Sonnet 5.5 (Medium) +5 versioni precedentiGemini 3.7 Flash (High), Gemini 3.7 Flash (Medium), Gemini 3.6 Flash (High), Gemini 3.6 Flash (Medium), Gemini 3.5 Flash (Medium) | Nessuno | |
| Nessuno | Claude Opus | Claude SonnetGPT-5Kimi K3GLM 5.3Qwen3.8 Max | Nessuno | |
| Nessuno | Claude Opus | Claude SonnetDeepSeek | GPT-4o | |
| Nessuno | Grok 4.7 | Nessuno | Nessuno | |
| Nessuno | Nessuno | Medium 3.5 | Nessuno | |
| Nessuno | Nessuno | Qwen3 Coder 480B | Gemma 3Qwen3 CoderGLM 4.6 | |
GPT-6 Astra | GPT-6.1 SolClaude Opus 5.5GPT-5.5 +5 versioni precedentiGPT-6 Sol, Claude Opus 5, GPT-5.6 Sol, Claude Opus 4.8, Claude Opus 4.7 | Claude Sonnet 5.5GPT-6 LunaGPT-5.6 TerraGemini 3.7 FlashKimi K3 +4 versioni precedentiClaude Sonnet 5, GPT-5.6 Luna, Claude Sonnet 4.6, Gemini 3.6 Flash | Claude Haiku 4.5MAI-Code-1.1-Flash | |
| Nessuno | Nessuno | Kimi K3Kimi K3-256KKimi K2.8 PreviewK2.7 Code HighSpeed | Nessuno | |
| Nessuno | Claude Opus 5.5GPT-6 Sol | Claude Sonnet 5Gemini FlashGLM 5.3 +1 versione precedenteGLM 5.2 | DeepSeek V4 Flash | |
| Nessuno | Claude OpusGPTCodexGemini | SWEClaude SonnetGLMKimiDeepSeek | Claude Haiku | |
| Sceglie il modello per te a ogni richiesta: nessun livello fisso. | ||||
| Sceglie il modello per te a ogni richiesta: nessun livello fisso. | ||||
| Sceglie il modello per te a ogni richiesta: nessun livello fisso. | ||||
Una famiglia di modelli non è legata allo strumento del suo produttore. Ecco ogni famiglia offerta oggi da più di una CLI, con il nome che le dà ciascuna CLI.
7 CLI
7 CLI
4 CLI
4 CLI
3 CLI
3 CLI
3 CLI
3 CLI
2 CLI
2 CLI
2 CLI
2 CLI
I modelli più avviati degli ultimi 30 giorni tra gli utenti di AgentsRoom, letti in termini di livello. Le equivalenze ti dicono quali modelli svolgono lo stesso ruolo; gli avvii ti dicono quali scelgono le persone.
OpusLivello Opus
22,9% degli avvii
SonnetLivello Sonnet
12,8% degli avvii
Opus 5.5Livello Opus
9,4% degli avvii
GPT-5.6 SolLivello Opus
5% degli avvii
GPT-6 LunaLivello Sonnet
4,9% degli avvii
Un'unica scala a quattro livelli, ancorata a Claude: livello Fable (frontiera), livello Opus (flagship), livello Sonnet (equilibrato) e livello Haiku (leggero). Ogni famiglia di modelli riceve il livello del ruolo che il suo produttore le assegna nella propria gamma, e la stessa famiglia mantiene lo stesso livello in tutte le CLI che la offrono.
In casa OpenAI, Astra è un modello di frontiera, Sol il flagship, Luna e Terra i modelli equilibrati, Spark e i modelli mini quelli leggeri. Gemini Pro è nel livello Opus e Gemini Flash nel livello Sonnet. Grok Heavy è di frontiera e Grok vero e proprio è nel livello Opus.
Le famiglie a pesi aperti (Kimi, GLM, DeepSeek, Qwen e altre) sono collocate al massimo nel livello Sonnet, e le loro versioni leggere nel livello Haiku. Tra due livelli, la tabella sceglie sempre quello più basso: preferisce sottovalutare un modello piuttosto che dirti che può sostituire Opus quando non l'ha dimostrato.
I router non hanno livello, perché scelgono un modello a ogni richiesta: GitHub Copilot (Auto), Amp (Amp default), Freebuff (Freebuff default), Devin (Adaptive) e Cursor (Default). Nemmeno una famiglia che la tabella non conosce ancora ne ha uno: meglio nessuna equivalenza che una sbagliata.
Un livello non è un punteggio di benchmark. Due modelli dello stesso livello differiscono comunque per prezzo, velocità, finestra di contesto, limiti di utilizzo e attività in cui rendono meglio. Usa la tabella per sapere dove guardare, poi provali entrambi sulla tua attività.
Dati: il catalogo dei modelli che AgentsRoom fornisce alle sue app desktop e mobile, letto a ogni visita, e le regole di livello che l'app applica sotto ogni lista di modelli. Popolarità: avvii reali di agenti da parte degli utenti di AgentsRoom che condividono i dati di utilizzo, negli ultimi 30 giorni, aggiornati ogni dieci minuti.
GPT-6.1 Sol. Nella tabella qui sopra, Claude Opus e GPT-6.1 Sol sono entrambi nel livello Opus: il flagship su cui gira la maggior parte del lavoro serio di programmazione, un gradino sotto il livello di frontiera. Il modello di frontiera di Codex, l'equivalente di Fable, è GPT-6 Astra. Per il lavoro di livello Sonnet, il modello Codex è GPT-6 Luna. E il modello di livello Haiku della lista è Codex Spark.
Gemini 3.1 Pro (High), su Antigravity. Gemini Pro è la linea flagship di Google, quindi è nel livello Opus. Gemini Flash fa la parte di Sonnet: oggi è Gemini 3.8 Flash (High).
GPT-6 Luna, su Codex. La linea equilibrata di OpenAI è nel livello Sonnet: abbastanza potente per la maggior parte delle funzionalità, più economica del flagship.
Codex Spark, su Codex: il modello leggero e veloce della gamma, per ridenominazioni, piccole correzioni e domande rapide.
Stesso livello non vuol dire stessi risultati. GPT-6.1 Sol e Opus 5.5 svolgono lo stesso ruolo nella gamma del rispettivo produttore, ma differiscono comunque per prezzo, velocità, finestra di contesto, limiti di utilizzo e attività che gestiscono meglio, e le classifiche dei benchmark tra i due cambiano a ogni rilascio. La risposta affidabile è provarli entrambi sulla stessa attività, presa dal tuo lavoro: AgentsRoom avvia un agente su ciascuno, fianco a fianco, nello stesso progetto.
Oggi Opus è presente anche nelle liste di modelli di Antigravity, OpenCode, Aider, GitHub Copilot, oh-my-pi e Devin, con il nome che gli dà ciascuna CLI. Stessa famiglia, stesso livello: l'equivalenza non cambia con la CLI che lo serve.
Perché la scala segue il ruolo che un modello svolge, e non esagera mai. Le famiglie a pesi aperti hanno spesso un ottimo rapporto qualità-prezzo e diverse CLI le offrono, ma collocarne una nel livello Opus vorrebbe dire che può sostituire Opus su qualsiasi attività, cosa che nessuna ha dimostrato su tutta la linea. Le loro versioni leggere sono nel livello Haiku.
Perché non sono un modello: GitHub Copilot (Auto), Amp (Amp default), Freebuff (Freebuff default), Devin (Adaptive) e Cursor (Default) lasciano che sia il servizio a scegliere un modello a ogni richiesta, quindi non c'è una capacità fissa da confrontare. La tabella li lascia fuori invece di tirare a indovinare.
Viene calcolata ogni volta che la pagina viene aperta, a partire dallo stesso catalogo dei modelli che l'app AgentsRoom fornisce a ogni computer e a ogni telefono. Quando AgentsRoom aggiunge un modello appena rilasciato da una CLI, compare qui subito, nel suo livello, e la versione che sostituisce viene contrassegnata come precedente. Le fiamme di popolarità si aggiornano ogni dieci minuti in base agli avvii degli ultimi 30 giorni.
Sì, in due modi, ed entrambi si limitano a suggerire. AI Suggestion valuta la dimensione dell'attività prima che si apra la sessione (Rapida, Standard, Complessa o Estrema) e apre l'agente sul modello più economico della sua CLI che riesce ancora a svolgerla. Adaptive Mode legge la tua bozza una volta avviata la CLI e suggerisce un modello più leggero quando l'attività non ha bisogno del flagship, oppure ti conferma che quello attuale è quello giusto.
Dentro AgentsRoom
AgentsRoom è un centro di comando desktop per agenti di codice IA. Claude, Codex, GitHub Copilot CLI, Cursor e altre 10 CLI di agenti girano fianco a fianco, ogni agente sul modello che scegli. Le equivalenze di questa pagina sono quelle che l'app ti mostra mentre scegli, e alcune funzioni intelligenti ti aiutano a dimensionare il modello sull'attività.
Ogni lista di modelli (nuovo agente, agente rapido, ticket del backlog, app mobile) etichetta ogni modello con il suo equivalente nella CLI che conosci meglio, e si ordina per potenza, prezzo o popolarità.
Equivalenze tra modelli nell'appAI Suggestion trasforma una descrizione di una riga in un livello di complessità (Rapida, Standard, Complessa, Estrema) e apre l'agente sul modello più economico adatto. Adaptive Mode controlla la tua bozza e suggerisce un modello più leggero quando il flagship è eccessivo.
AI Suggestion e Adaptive ModeQuando un account si avvicina al limite, una regola di quota può avviare i nuovi agenti su un'altra CLI, modello per modello: Fable, Opus e Sonnet passano ciascuno al proprio equivalente dello stesso livello, precompilato a partire da questi livelli.
Regole di quota e avvisi di utilizzoFissa un provider, un modello e uno sforzo di ragionamento su un ticket del backlog, così l'agente che lo esegue usa esattamente quelli, e riserva il flagship ai ticket che ne hanno bisogno.
Bacheca attività BacklogUn agente sviluppatore su un modello flagship passa l'esecuzione dei test a un agente QA su un modello più leggero tramite MCP, così il modello costoso resta sul codice.
Delega di agenteIn un team di agenti, ogni step ha il proprio ruolo, la propria CLI e il proprio modello: l'architetto su un modello di frontiera, l'implementatore su un modello di livello Opus, il revisore dove conviene.
Team di agentiUn confronto onesto tra Claude Code e Codex CLI: prezzi, velocità, MCP, controllo. E perché, dopo qualche settimana, ho smesso di scegliere tra i due.
Ollama è ora un provider in AgentsRoom. Fai girare modelli open source locali come Llama, Qwen, Gemma e DeepSeek accanto agli agenti cloud, con una manopola locale o cloud per ogni agente, commutabile a metà conversazione.