Equivalenze tra modelli IA

Equivalenze tra modelli IA: l'Opus, il Sonnet e l'Haiku di ogni CLI di codice

Conosci la gamma Claude a memoria, poi apri Codex, Gemini o Grok e nessun nome ti dice quale modello fa la parte di Opus. Questa pagina colloca su un'unica scala ogni modello di ogni CLI di agenti di codice che AgentsRoom esegue, così ognuno si legge nei termini che conosci già.

Dati letti in tempo reale dal catalogo dei modelli di AgentsRoom. Popolarità aggiornata al 6 ott 2026, 16:16.

CLI confrontate

12

Modelli classificati

94

Avvii contati, ultimi 30 giorni

51.051

La risposta breve

Claude fa da metro di paragone perché è la gamma che la maggior parte degli sviluppatori conosce. Ogni riga indica i modelli di altri produttori che oggi svolgono lo stesso ruolo.

Livello Fable

Equivalenti di livello Fable (frontiera)

I modelli di frontiera, un gradino sopra Opus: GPT-6 Astra su Codex, Daybreak Blue su Codex e GPT-5.6 Sol Max su Codex.

Per i problemi più difficili, al prezzo più alto.

Livello Opus

Equivalenti di Opus

I modelli che fanno la parte di Claude Opus: GPT-6.1 Sol su Codex, Gemini 3.1 Pro (High) su Antigravity e Grok 4.7 su Grok.

Il flagship su cui gira la maggior parte del lavoro serio di programmazione.

Livello Sonnet

Equivalenti di Sonnet

I modelli che fanno la parte di Claude Sonnet: GPT-6 Luna su Codex, GPT-5.6 Terra su Codex, Gemini 3.8 Flash (High) su Antigravity, GLM 5.3 su OpenCode, Qwen3.8 Max su OpenCode, DeepSeek su Aider, Medium 3.5 su Mistral Vibe e Kimi K3 su Kimi.

Equilibrato: abbastanza potente per la maggior parte delle funzionalità, più economico del flagship.

Livello Haiku

Equivalenti di Haiku

I modelli che fanno la parte di Claude Haiku: Codex Spark su Codex, Qwen3 Coder su Ollama, GLM 4.6 su Ollama e DeepSeek V4 Flash su oh-my-pi.

Leggero e veloce: ridenominazioni, piccole correzioni, riassunti.

Tutte le CLI di codice, livello per livello

Una riga per ogni CLI che AgentsRoom esegue, una colonna per livello. Prima vengono i modelli attuali; le versioni precedenti che una lista offre ancora sono conteggiate sotto di essi.

Equivalenze tra modelli IA per CLI di agenti di codice e per livello di capacità
CLIFrontieraLivello FableLivello OpusLivello SonnetLivello Haiku
Claude
Fable
OpusOpus 5.5
+2 versioni precedenti

Opus 5, Opus 4.8

SonnetSonnet 5.5
+1 versione precedente

Sonnet 5

Haiku
Codex
GPT-6 AstraDaybreak BlueDaybreak RedGPT-5.6 Sol Max
GPT-6.1 Sol
+3 versioni precedenti

GPT-6 Sol, GPT-5.6 Sol, GPT-5.5

GPT-6 LunaGPT-5.6 Terra
+4 versioni precedenti

GPT-5.6 Luna, GPT-5, GPT-5.4, GPT-5.2

Codex Spark
+1 versione precedente

GPT-5.4 Mini

AntigravityNessuno
Gemini 3.1 Pro (High)Claude Opus 5.5 (High)Claude Opus 5.5 (Medium)
Gemini 3.8 Flash (High)Gemini 3.8 Flash (Medium)Claude Sonnet 5.5 (High)Claude Sonnet 5.5 (Medium)
+5 versioni precedenti

Gemini 3.7 Flash (High), Gemini 3.7 Flash (Medium), Gemini 3.6 Flash (High), Gemini 3.6 Flash (Medium), Gemini 3.5 Flash (Medium)

Nessuno
OpenCodeNessuno
Claude Opus
Claude SonnetGPT-5Kimi K3GLM 5.3Qwen3.8 Max
Nessuno
AiderNessuno
Claude Opus
Claude SonnetDeepSeek
GPT-4o
GrokNessuno
Grok 4.7
NessunoNessuno
Mistral VibeNessunoNessuno
Medium 3.5
Nessuno
OllamaNessunoNessuno
Qwen3 Coder 480B
Gemma 3Qwen3 CoderGLM 4.6
GitHub Copilot
GPT-6 Astra
GPT-6.1 SolClaude Opus 5.5GPT-5.5
+5 versioni precedenti

GPT-6 Sol, Claude Opus 5, GPT-5.6 Sol, Claude Opus 4.8, Claude Opus 4.7

Claude Sonnet 5.5GPT-6 LunaGPT-5.6 TerraGemini 3.7 FlashKimi K3
+4 versioni precedenti

Claude Sonnet 5, GPT-5.6 Luna, Claude Sonnet 4.6, Gemini 3.6 Flash

Claude Haiku 4.5MAI-Code-1.1-Flash
KimiNessunoNessuno
Kimi K3Kimi K3-256KKimi K2.8 PreviewK2.7 Code HighSpeed
Nessuno
oh-my-piNessuno
Claude Opus 5.5GPT-6 Sol
Claude Sonnet 5Gemini FlashGLM 5.3
+1 versione precedente

GLM 5.2

DeepSeek V4 Flash
DevinNessuno
Claude OpusGPTCodexGemini
SWEClaude SonnetGLMKimiDeepSeek
Claude Haiku
AmpSceglie il modello per te a ogni richiesta: nessun livello fisso.
FreebuffSceglie il modello per te a ogni richiesta: nessun livello fisso.
CursorSceglie il modello per te a ogni richiesta: nessun livello fisso.
  • Tra i tre modelli della sua CLI che la community avvia di più
  • Versione precedente: una generazione più recente dello stesso modello è nella stessa lista

Stesso modello, più CLI

Una famiglia di modelli non è legata allo strumento del suo produttore. Ecco ogni famiglia offerta oggi da più di una CLI, con il nome che le dà ciascuna CLI.

Claude Opus

Livello Opus

7 CLI

  • ClaudeOpus 5.5
  • AntigravityClaude Opus 5.5 (High)
  • OpenCodeClaude Opus
  • AiderClaude Opus
  • GitHub CopilotClaude Opus 5.5
  • oh-my-piClaude Opus 5.5
  • DevinClaude Opus

Claude Sonnet

Livello Sonnet

7 CLI

  • ClaudeSonnet 5.5
  • AntigravityClaude Sonnet 5.5 (High)
  • OpenCodeClaude Sonnet
  • AiderClaude Sonnet
  • GitHub CopilotClaude Sonnet 5.5
  • oh-my-piClaude Sonnet 5
  • DevinClaude Sonnet

Kimi

Livello Sonnet

4 CLI

  • KimiKimi K3
  • OpenCodeKimi K3
  • GitHub CopilotKimi K3
  • DevinKimi

GLM

Livello Sonnet

4 CLI

  • OpenCodeGLM 5.3
  • OllamaGLM 4.6
  • oh-my-piGLM 5.3
  • DevinGLM

Claude Haiku

Livello Haiku

3 CLI

  • ClaudeHaiku
  • GitHub CopilotClaude Haiku 4.5
  • DevinClaude Haiku

GPT Sol

Livello Opus

3 CLI

  • CodexGPT-6.1 Sol
  • GitHub CopilotGPT-6.1 Sol
  • oh-my-piGPT-6 Sol

Gemini Flash

Livello Sonnet

3 CLI

  • AntigravityGemini 3.8 Flash (High)
  • GitHub CopilotGemini 3.7 Flash
  • oh-my-piGemini Flash

DeepSeek

Livello Sonnet

3 CLI

  • AiderDeepSeek
  • oh-my-piDeepSeek V4 Flash
  • DevinDeepSeek

GPT Astra

Livello Fable

2 CLI

  • CodexGPT-6 Astra
  • GitHub CopilotGPT-6 Astra

GPT Luna

Livello Sonnet

2 CLI

  • CodexGPT-6 Luna
  • GitHub CopilotGPT-6 Luna

GPT Terra

Livello Sonnet

2 CLI

  • CodexGPT-5.6 Terra
  • GitHub CopilotGPT-5.6 Terra

Qwen

Livello Sonnet

2 CLI

  • OpenCodeQwen3.8 Max
  • OllamaQwen3 Coder

Cosa avviano davvero gli sviluppatori

I modelli più avviati degli ultimi 30 giorni tra gli utenti di AgentsRoom, letti in termini di livello. Le equivalenze ti dicono quali modelli svolgono lo stesso ruolo; gli avvii ti dicono quali scelgono le persone.

  1. 1

    OpusLivello Opus

    Claude439 membri

    22,9% degli avvii

  2. 2

    SonnetLivello Sonnet

    Claude173 membri

    12,8% degli avvii

  3. 3

    Opus 5.5Livello Opus

    Claude103 membri

    9,4% degli avvii

  4. 4

    GPT-5.6 SolLivello Opus

    Codex119 membri

    5% degli avvii

  5. 5

    GPT-6 LunaLivello Sonnet

    Codex47 membri

    4,9% degli avvii

Tutte le statistiche d'uso, per CLI e per modello

Come vengono assegnati i livelli

Un'unica scala a quattro livelli, ancorata a Claude: livello Fable (frontiera), livello Opus (flagship), livello Sonnet (equilibrato) e livello Haiku (leggero). Ogni famiglia di modelli riceve il livello del ruolo che il suo produttore le assegna nella propria gamma, e la stessa famiglia mantiene lo stesso livello in tutte le CLI che la offrono.

In casa OpenAI, Astra è un modello di frontiera, Sol il flagship, Luna e Terra i modelli equilibrati, Spark e i modelli mini quelli leggeri. Gemini Pro è nel livello Opus e Gemini Flash nel livello Sonnet. Grok Heavy è di frontiera e Grok vero e proprio è nel livello Opus.

Le famiglie a pesi aperti (Kimi, GLM, DeepSeek, Qwen e altre) sono collocate al massimo nel livello Sonnet, e le loro versioni leggere nel livello Haiku. Tra due livelli, la tabella sceglie sempre quello più basso: preferisce sottovalutare un modello piuttosto che dirti che può sostituire Opus quando non l'ha dimostrato.

I router non hanno livello, perché scelgono un modello a ogni richiesta: GitHub Copilot (Auto), Amp (Amp default), Freebuff (Freebuff default), Devin (Adaptive) e Cursor (Default). Nemmeno una famiglia che la tabella non conosce ancora ne ha uno: meglio nessuna equivalenza che una sbagliata.

Un livello non è un punteggio di benchmark. Due modelli dello stesso livello differiscono comunque per prezzo, velocità, finestra di contesto, limiti di utilizzo e attività in cui rendono meglio. Usa la tabella per sapere dove guardare, poi provali entrambi sulla tua attività.

Dati: il catalogo dei modelli che AgentsRoom fornisce alle sue app desktop e mobile, letto a ogni visita, e le regole di livello che l'app applica sotto ogni lista di modelli. Popolarità: avvii reali di agenti da parte degli utenti di AgentsRoom che condividono i dati di utilizzo, negli ultimi 30 giorni, aggiornati ogni dieci minuti.

Domande frequenti

Quale modello Codex è l'equivalente di Claude Opus?

GPT-6.1 Sol. Nella tabella qui sopra, Claude Opus e GPT-6.1 Sol sono entrambi nel livello Opus: il flagship su cui gira la maggior parte del lavoro serio di programmazione, un gradino sotto il livello di frontiera. Il modello di frontiera di Codex, l'equivalente di Fable, è GPT-6 Astra. Per il lavoro di livello Sonnet, il modello Codex è GPT-6 Luna. E il modello di livello Haiku della lista è Codex Spark.

Qual è l'equivalente Gemini di Claude Opus?

Gemini 3.1 Pro (High), su Antigravity. Gemini Pro è la linea flagship di Google, quindi è nel livello Opus. Gemini Flash fa la parte di Sonnet: oggi è Gemini 3.8 Flash (High).

Quale modello GPT è l'equivalente di Claude Sonnet?

GPT-6 Luna, su Codex. La linea equilibrata di OpenAI è nel livello Sonnet: abbastanza potente per la maggior parte delle funzionalità, più economica del flagship.

Qual è l'equivalente OpenAI di Claude Haiku?

Codex Spark, su Codex: il modello leggero e veloce della gamma, per ridenominazioni, piccole correzioni e domande rapide.

GPT-6.1 Sol è all'altezza di Opus 5.5?

Stesso livello non vuol dire stessi risultati. GPT-6.1 Sol e Opus 5.5 svolgono lo stesso ruolo nella gamma del rispettivo produttore, ma differiscono comunque per prezzo, velocità, finestra di contesto, limiti di utilizzo e attività che gestiscono meglio, e le classifiche dei benchmark tra i due cambiano a ogni rilascio. La risposta affidabile è provarli entrambi sulla stessa attività, presa dal tuo lavoro: AgentsRoom avvia un agente su ciascuno, fianco a fianco, nello stesso progetto.

Dove posso usare Claude Opus al di fuori di Claude Code?

Oggi Opus è presente anche nelle liste di modelli di Antigravity, OpenCode, Aider, GitHub Copilot, oh-my-pi e Devin, con il nome che gli dà ciascuna CLI. Stessa famiglia, stesso livello: l'equivalenza non cambia con la CLI che lo serve.

Perché la tabella limita Kimi, GLM o Qwen al livello Sonnet?

Perché la scala segue il ruolo che un modello svolge, e non esagera mai. Le famiglie a pesi aperti hanno spesso un ottimo rapporto qualità-prezzo e diverse CLI le offrono, ma collocarne una nel livello Opus vorrebbe dire che può sostituire Opus su qualsiasi attività, cosa che nessuna ha dimostrato su tutta la linea. Le loro versioni leggere sono nel livello Haiku.

Perché Auto e Default non hanno un equivalente?

Perché non sono un modello: GitHub Copilot (Auto), Amp (Amp default), Freebuff (Freebuff default), Devin (Adaptive) e Cursor (Default) lasciano che sia il servizio a scegliere un modello a ogni richiesta, quindi non c'è una capacità fissa da confrontare. La tabella li lascia fuori invece di tirare a indovinare.

Quanto è aggiornata questa tabella?

Viene calcolata ogni volta che la pagina viene aperta, a partire dallo stesso catalogo dei modelli che l'app AgentsRoom fornisce a ogni computer e a ogni telefono. Quando AgentsRoom aggiunge un modello appena rilasciato da una CLI, compare qui subito, nel suo livello, e la versione che sostituisce viene contrassegnata come precedente. Le fiamme di popolarità si aggiornano ogni dieci minuti in base agli avvii degli ultimi 30 giorni.

AgentsRoom può scegliere il modello giusto per la mia attività?

Sì, in due modi, ed entrambi si limitano a suggerire. AI Suggestion valuta la dimensione dell'attività prima che si apra la sessione (Rapida, Standard, Complessa o Estrema) e apre l'agente sul modello più economico della sua CLI che riesce ancora a svolgerla. Adaptive Mode legge la tua bozza una volta avviata la CLI e suggerisce un modello più leggero quando l'attività non ha bisogno del flagship, oppure ti conferma che quello attuale è quello giusto.

Dentro AgentsRoom

AgentsRoom risponde a questa domanda direttamente nel tuo selettore di modelli

AgentsRoom è un centro di comando desktop per agenti di codice IA. Claude, Codex, GitHub Copilot CLI, Cursor e altre 10 CLI di agenti girano fianco a fianco, ogni agente sul modello che scegli. Le equivalenze di questa pagina sono quelle che l'app ti mostra mentre scegli, e alcune funzioni intelligenti ti aiutano a dimensionare il modello sull'attività.

≈ Opus sotto ogni modello

Ogni lista di modelli (nuovo agente, agente rapido, ticket del backlog, app mobile) etichetta ogni modello con il suo equivalente nella CLI che conosci meglio, e si ordina per potenza, prezzo o popolarità.

Equivalenze tra modelli nell'app

Lascia che sia l'attività a scegliere il modello

AI Suggestion trasforma una descrizione di una riga in un livello di complessità (Rapida, Standard, Complessa, Estrema) e apre l'agente sul modello più economico adatto. Adaptive Mode controlla la tua bozza e suggerisce un modello più leggero quando il flagship è eccessivo.

AI Suggestion e Adaptive Mode

Passa al modello equivalente

Quando un account si avvicina al limite, una regola di quota può avviare i nuovi agenti su un'altra CLI, modello per modello: Fable, Opus e Sonnet passano ciascuno al proprio equivalente dello stesso livello, precompilato a partire da questi livelli.

Regole di quota e avvisi di utilizzo

Il modello giusto per ogni ticket

Fissa un provider, un modello e uno sforzo di ragionamento su un ticket del backlog, così l'agente che lo esegue usa esattamente quelli, e riserva il flagship ai ticket che ne hanno bisogno.

Bacheca attività Backlog

Affida i test a un modello più economico

Un agente sviluppatore su un modello flagship passa l'esecuzione dei test a un agente QA su un modello più leggero tramite MCP, così il modello costoso resta sul codice.

Delega di agente

Un modello per ogni step

In un team di agenti, ogni step ha il proprio ruolo, la propria CLI e il proprio modello: l'architetto su un modello di frontiera, l'implementatore su un modello di livello Opus, il revisore dove conviene.

Team di agenti
Scarica AgentsRoom

Approfondimenti