KI-Modell-Äquivalente

KI-Modell-Äquivalente: das Opus, Sonnet und Haiku jeder Coding-CLI

Sie kennen die Claude-Modellreihe auswendig, dann öffnen Sie Codex, Gemini oder Grok, und kein einziger Name verrät Ihnen, welches Modell die Rolle von Opus spielt. Diese Seite ordnet jedes Modell jeder Coding-Agent-CLI, die AgentsRoom ausführt, auf einer einzigen Skala ein, sodass Sie jedes Modell in Begriffen lesen, die Sie schon kennen.

Live aus dem AgentsRoom-Modellkatalog gelesen. Beliebtheit, Stand 06.10.2026, 16:16.

Verglichene CLIs

12

Eingeordnete Modelle

94

Gezählte Starts, letzte 30 Tage

51.051

Die kurze Antwort

Claude dient als Maßstab, weil die meisten Entwickler diese Modellreihe kennen. Jede Zeile nennt die Modelle anderer Hersteller, die heute dieselbe Rolle spielen.

Fable-Stufe

Äquivalente der Fable-Stufe (Frontier)

Die Frontier-Modelle, eine Stufe über Opus: GPT-6 Astra bei Codex, Daybreak Blue bei Codex und GPT-5.6 Sol Max bei Codex.

Für die schwierigsten Probleme, zum höchsten Preis.

Opus-Stufe

Opus-Äquivalente

Die Modelle, die die Rolle von Claude Opus spielen: GPT-6.1 Sol bei Codex, Gemini 3.1 Pro (High) bei Antigravity und Grok 4.7 bei Grok.

Das Flaggschiff, auf dem der Großteil ernsthafter Coding-Arbeit läuft.

Sonnet-Stufe

Sonnet-Äquivalente

Die Modelle, die die Rolle von Claude Sonnet spielen: GPT-6 Luna bei Codex, GPT-5.6 Terra bei Codex, Gemini 3.8 Flash (High) bei Antigravity, GLM 5.3 bei OpenCode, Qwen3.8 Max bei OpenCode, DeepSeek bei Aider, Medium 3.5 bei Mistral Vibe und Kimi K3 bei Kimi.

Ausgewogen: stark genug für die meisten Features, günstiger als das Flaggschiff.

Haiku-Stufe

Haiku-Äquivalente

Die Modelle, die die Rolle von Claude Haiku spielen: Codex Spark bei Codex, Qwen3 Coder bei Ollama, GLM 4.6 bei Ollama und DeepSeek V4 Flash bei oh-my-pi.

Leicht und schnell: Umbenennungen, kleine Korrekturen, Zusammenfassungen.

Jede Coding-CLI, Stufe für Stufe

Eine Zeile pro CLI, die AgentsRoom ausführt, eine Spalte pro Stufe. Aktuelle Modelle stehen zuerst; die älteren Versionen, die eine Liste noch anbietet, werden darunter gezählt.

KI-Modell-Äquivalente nach Coding-Agent-CLI und Leistungsstufe
CLIFrontier-StufeFable-StufeOpus-StufeSonnet-StufeHaiku-Stufe
Claude
Fable
OpusOpus 5.5
+2 ältere Versionen

Opus 5, Opus 4.8

SonnetSonnet 5.5
+1 ältere Version

Sonnet 5

Haiku
Codex
GPT-6 AstraDaybreak BlueDaybreak RedGPT-5.6 Sol Max
GPT-6.1 Sol
+3 ältere Versionen

GPT-6 Sol, GPT-5.6 Sol, GPT-5.5

GPT-6 LunaGPT-5.6 Terra
+4 ältere Versionen

GPT-5.6 Luna, GPT-5, GPT-5.4, GPT-5.2

Codex Spark
+1 ältere Version

GPT-5.4 Mini

AntigravityKeines
Gemini 3.1 Pro (High)Claude Opus 5.5 (High)Claude Opus 5.5 (Medium)
Gemini 3.8 Flash (High)Gemini 3.8 Flash (Medium)Claude Sonnet 5.5 (High)Claude Sonnet 5.5 (Medium)
+5 ältere Versionen

Gemini 3.7 Flash (High), Gemini 3.7 Flash (Medium), Gemini 3.6 Flash (High), Gemini 3.6 Flash (Medium), Gemini 3.5 Flash (Medium)

Keines
OpenCodeKeines
Claude Opus
Claude SonnetGPT-5Kimi K3GLM 5.3Qwen3.8 Max
Keines
AiderKeines
Claude Opus
Claude SonnetDeepSeek
GPT-4o
GrokKeines
Grok 4.7
KeinesKeines
Mistral VibeKeinesKeines
Medium 3.5
Keines
OllamaKeinesKeines
Qwen3 Coder 480B
Gemma 3Qwen3 CoderGLM 4.6
GitHub Copilot
GPT-6 Astra
GPT-6.1 SolClaude Opus 5.5GPT-5.5
+5 ältere Versionen

GPT-6 Sol, Claude Opus 5, GPT-5.6 Sol, Claude Opus 4.8, Claude Opus 4.7

Claude Sonnet 5.5GPT-6 LunaGPT-5.6 TerraGemini 3.7 FlashKimi K3
+4 ältere Versionen

Claude Sonnet 5, GPT-5.6 Luna, Claude Sonnet 4.6, Gemini 3.6 Flash

Claude Haiku 4.5MAI-Code-1.1-Flash
KimiKeinesKeines
Kimi K3Kimi K3-256KKimi K2.8 PreviewK2.7 Code HighSpeed
Keines
oh-my-piKeines
Claude Opus 5.5GPT-6 Sol
Claude Sonnet 5Gemini FlashGLM 5.3
+1 ältere Version

GLM 5.2

DeepSeek V4 Flash
DevinKeines
Claude OpusGPTCodexGemini
SWEClaude SonnetGLMKimiDeepSeek
Claude Haiku
AmpWählt bei jeder Anfrage das Modell für Sie: keine feste Stufe.
FreebuffWählt bei jeder Anfrage das Modell für Sie: keine feste Stufe.
CursorWählt bei jeder Anfrage das Modell für Sie: keine feste Stufe.
  • Unter den drei meistgestarteten Modellen seiner CLI in der Community
  • Ältere Version: Eine neuere Generation desselben Modells steht in derselben Liste

Dasselbe Modell, mehrere CLIs

Eine Modellfamilie ist nicht an das Tool ihres Herstellers gebunden. Hier ist jede Familie, die heute in mehr als einer CLI verfügbar ist, mit dem Namen, den die jeweilige CLI ihr gibt.

Claude Opus

Opus-Stufe

7 CLIs

  • ClaudeOpus 5.5
  • AntigravityClaude Opus 5.5 (High)
  • OpenCodeClaude Opus
  • AiderClaude Opus
  • GitHub CopilotClaude Opus 5.5
  • oh-my-piClaude Opus 5.5
  • DevinClaude Opus

Claude Sonnet

Sonnet-Stufe

7 CLIs

  • ClaudeSonnet 5.5
  • AntigravityClaude Sonnet 5.5 (High)
  • OpenCodeClaude Sonnet
  • AiderClaude Sonnet
  • GitHub CopilotClaude Sonnet 5.5
  • oh-my-piClaude Sonnet 5
  • DevinClaude Sonnet

Kimi

Sonnet-Stufe

4 CLIs

  • KimiKimi K3
  • OpenCodeKimi K3
  • GitHub CopilotKimi K3
  • DevinKimi

GLM

Sonnet-Stufe

4 CLIs

  • OpenCodeGLM 5.3
  • OllamaGLM 4.6
  • oh-my-piGLM 5.3
  • DevinGLM

Claude Haiku

Haiku-Stufe

3 CLIs

  • ClaudeHaiku
  • GitHub CopilotClaude Haiku 4.5
  • DevinClaude Haiku

GPT Sol

Opus-Stufe

3 CLIs

  • CodexGPT-6.1 Sol
  • GitHub CopilotGPT-6.1 Sol
  • oh-my-piGPT-6 Sol

Gemini Flash

Sonnet-Stufe

3 CLIs

  • AntigravityGemini 3.8 Flash (High)
  • GitHub CopilotGemini 3.7 Flash
  • oh-my-piGemini Flash

DeepSeek

Sonnet-Stufe

3 CLIs

  • AiderDeepSeek
  • oh-my-piDeepSeek V4 Flash
  • DevinDeepSeek

GPT Astra

Fable-Stufe

2 CLIs

  • CodexGPT-6 Astra
  • GitHub CopilotGPT-6 Astra

GPT Luna

Sonnet-Stufe

2 CLIs

  • CodexGPT-6 Luna
  • GitHub CopilotGPT-6 Luna

GPT Terra

Sonnet-Stufe

2 CLIs

  • CodexGPT-5.6 Terra
  • GitHub CopilotGPT-5.6 Terra

Qwen

Sonnet-Stufe

2 CLIs

  • OpenCodeQwen3.8 Max
  • OllamaQwen3 Coder

Was Entwickler tatsächlich starten

Die meistgestarteten Modelle der letzten 30 Tage unter AgentsRoom-Nutzern, in Stufen gelesen. Die Äquivalente verraten Ihnen, welche Modelle dieselbe Rolle spielen; die Starts, welche davon die Leute wählen.

  1. 1

    OpusOpus-Stufe

    Claude439 Nutzer

    22,9 % der Starts

  2. 2

    SonnetSonnet-Stufe

    Claude173 Nutzer

    12,8 % der Starts

  3. 3

    Opus 5.5Opus-Stufe

    Claude103 Nutzer

    9,4 % der Starts

  4. 4

    GPT-5.6 SolOpus-Stufe

    Codex119 Nutzer

    5 % der Starts

  5. 5

    GPT-6 LunaSonnet-Stufe

    Codex47 Nutzer

    4,9 % der Starts

Alle Nutzungsstatistiken, nach CLI und nach Modell

Wie die Stufen vergeben werden

Eine Skala mit vier Stufen, verankert an Claude: Fable-Stufe (Frontier), Opus-Stufe (Flaggschiff), Sonnet-Stufe (ausgewogen) und Haiku-Stufe (leicht). Jede Modellfamilie bekommt die Stufe der Rolle, die ihr Hersteller ihr in seiner eigenen Modellreihe gibt, und dieselbe Familie behält dieselbe Stufe in jeder CLI, die sie anbietet.

Bei OpenAI ist Astra ein Frontier-Modell, Sol das Flaggschiff, Luna und Terra die ausgewogenen Modelle, Spark und die Mini-Modelle die leichten. Gemini Pro liegt auf der Opus-Stufe und Gemini Flash auf der Sonnet-Stufe. Grok Heavy gehört zur Frontier-Stufe und Grok selbst zur Opus-Stufe.

Open-Weight-Familien (Kimi, GLM, DeepSeek, Qwen und andere) werden höchstens auf der Sonnet-Stufe eingeordnet, ihre leichten Varianten auf der Haiku-Stufe. Zwischen zwei Stufen wählt die Tabelle immer die niedrigere: Lieber verkauft sie ein Modell unter Wert, als Ihnen zu sagen, es könne Opus ersetzen, solange es das nicht gezeigt hat.

Router bekommen keine Stufe, weil sie bei jeder Anfrage ein Modell wählen: GitHub Copilot (Auto), Amp (Amp default), Freebuff (Freebuff default), Devin (Adaptive) und Cursor (Default). Auch eine Familie, die die Tabelle noch nicht kennt, bekommt keine: Kein Äquivalent ist besser als ein falsches.

Eine Stufe ist kein Benchmark-Ergebnis. Zwei Modelle derselben Stufe unterscheiden sich weiterhin in Preis, Geschwindigkeit, Kontextfenster, Nutzungslimits und den Aufgaben, die sie am besten erledigen. Nutzen Sie die Tabelle, um zu wissen, wo Sie suchen sollten, und testen Sie dann beide an Ihrer eigenen Aufgabe.

Daten: der Modellkatalog, den AgentsRoom seinen Apps für Desktop und Mobilgeräte bereitstellt, bei jedem Besuch gelesen, und die Stufenregeln, die die App unter jeder Modellliste anwendet. Beliebtheit: echte Agenten-Starts von AgentsRoom-Nutzern, die Nutzungsdaten teilen, über die letzten 30 Tage, alle zehn Minuten aktualisiert.

Häufig gestellte Fragen

Welches Codex-Modell ist das Äquivalent zu Claude Opus?

GPT-6.1 Sol. In der Tabelle oben liegen Claude Opus und GPT-6.1 Sol beide auf der Opus-Stufe: Das ist das Flaggschiff, auf dem der Großteil ernsthafter Coding-Arbeit läuft, direkt unter der Frontier-Stufe. Das Frontier-Modell von Codex, das Gegenstück zu Fable, ist GPT-6 Astra. Für Arbeit auf der Sonnet-Stufe ist das Codex-Modell GPT-6 Luna. Und das Modell der Haiku-Stufe in der Liste ist Codex Spark.

Was ist das Gemini-Äquivalent zu Claude Opus?

Gemini 3.1 Pro (High), in Antigravity. Gemini Pro ist die Flaggschiff-Reihe von Google und liegt daher auf der Opus-Stufe. Gemini Flash spielt die Rolle von Sonnet: heute Gemini 3.8 Flash (High).

Welches GPT-Modell ist das Äquivalent zu Claude Sonnet?

GPT-6 Luna, in Codex. Die ausgewogene Reihe von OpenAI liegt auf der Sonnet-Stufe: stark genug für die meisten Features, günstiger als das Flaggschiff.

Was ist das OpenAI-Äquivalent zu Claude Haiku?

Codex Spark, in Codex: das leichte, schnelle Modell der Reihe, für Umbenennungen, kleine Korrekturen und schnelle Fragen.

Ist GPT-6.1 Sol so gut wie Opus 5.5?

Dieselbe Stufe heißt nicht dieselben Ergebnisse. GPT-6.1 Sol und Opus 5.5 spielen in der Modellreihe ihres jeweiligen Herstellers dieselbe Rolle, unterscheiden sich aber weiterhin in Preis, Geschwindigkeit, Kontextfenster, Nutzungslimits und den Aufgaben, die sie am besten bewältigen, und die Benchmark-Rankings zwischen beiden ändern sich mit jedem Release. Verlässlich ist nur ein Test beider Modelle an derselben Aufgabe aus Ihrer eigenen Arbeit: AgentsRoom startet auf jedem Modell einen Agenten, nebeneinander, im selben Projekt.

Wo kann ich Claude Opus außerhalb von Claude Code nutzen?

Heute steht Opus auch in den Modelllisten von Antigravity, OpenCode, Aider, GitHub Copilot, oh-my-pi und Devin, unter dem Namen, den die jeweilige CLI ihm gibt. Gleiche Familie, gleiche Stufe: Die Äquivalenz ändert sich nicht mit der CLI, die das Modell anbietet.

Warum begrenzt die Tabelle Kimi, GLM oder Qwen auf die Sonnet-Stufe?

Weil die Skala der Rolle folgt, die ein Modell spielt, und nie übertreibt. Open-Weight-Familien bieten oft ein hervorragendes Preis-Leistungs-Verhältnis, und mehrere CLIs führen sie, doch eine davon auf die Opus-Stufe zu setzen hieße, Ihnen zu sagen, sie könne Opus bei jeder Aufgabe ersetzen, was bisher keine durchgängig gezeigt hat. Ihre leichten Varianten liegen auf der Haiku-Stufe.

Warum haben Auto und Default kein Äquivalent?

Weil sie kein Modell sind: GitHub Copilot (Auto), Amp (Amp default), Freebuff (Freebuff default), Devin (Adaptive) und Cursor (Default) lassen den Dienst bei jeder Anfrage ein Modell wählen, es gibt also keine feste Leistungsfähigkeit, die sich vergleichen ließe. Die Tabelle lässt sie weg, statt zu raten.

Wie aktuell ist diese Tabelle?

Die Tabelle wird bei jedem Aufruf der Seite berechnet, aus demselben Modellkatalog, den die AgentsRoom-App jedem Desktop und jedem Smartphone bereitstellt. Wenn AgentsRoom ein Modell hinzufügt, das eine CLI veröffentlicht hat, erscheint es hier sofort auf seiner Stufe, und die Version, die es ersetzt, wird als Ältere Version markiert. Die Beliebtheitsflammen werden alle zehn Minuten aus den Starts der letzten 30 Tage aktualisiert.

Kann AgentsRoom das richtige Modell für meine Aufgabe wählen?

Ja, auf zwei Arten, und beide machen nur Vorschläge. AI Suggestion schätzt den Umfang der Aufgabe ein, bevor sich die Sitzung öffnet (Schnell, Standard, Komplex oder Extrem), und öffnet den Agenten auf dem günstigsten Modell seiner CLI, das sie noch bewältigen kann. Adaptive Mode liest Ihren Entwurf, sobald die CLI läuft, und schlägt ein leichteres Modell vor, wenn die Aufgabe kein Flaggschiff braucht, oder bestätigt Ihnen, dass das aktuelle Modell das richtige ist.

Direkt in AgentsRoom

AgentsRoom beantwortet diese Frage in Ihrer Modellauswahl

AgentsRoom ist eine Desktop-Kommandozentrale für KI-Coding-Agenten. Claude, Codex, GitHub Copilot CLI, Cursor und 10 weitere Agent-CLIs laufen nebeneinander, jeder Agent auf dem Modell, das Sie wählen. Die Äquivalente dieser Seite sind dieselben, die Ihnen die App bei der Auswahl zeigt, und einige intelligente Funktionen helfen Ihnen, das Modell auf die Aufgabe abzustimmen.

≈ Opus unter jedem Modell

Jede Modellliste (neuer Agent, Schnell-Agent, Backlog-Ticket, mobile App) zeigt unter jedem Modell ein Etikett mit seinem Gegenstück in der CLI, die Sie am besten kennen, und sortiert nach Leistung, Preis oder Beliebtheit.

Modell-Entsprechungen in der App

Lassen Sie die Aufgabe das Modell wählen

AI Suggestion macht aus einer einzeiligen Beschreibung eine Komplexitätsstufe (Schnell, Standard, Komplex, Extrem) und öffnet den Agenten auf dem günstigsten passenden Modell. Adaptive Mode prüft Ihren Entwurf und schlägt ein leichteres Modell vor, wenn das Flaggschiff überdimensioniert ist.

AI Suggestion und Adaptive Mode

Auf das äquivalente Modell ausweichen

Nähert sich ein Konto seinem Limit, kann eine Kontingentregel neue Agenten auf einer anderen CLI starten, Modell für Modell: Fable, Opus und Sonnet gehen jeweils an ihr Gegenstück derselben Stufe, vorausgefüllt anhand dieser Stufen.

Kontingentregeln und Nutzungsbenachrichtigungen

Das richtige Modell pro Ticket

Legen Sie auf einem Backlog-Ticket Provider, Modell und Reasoning-Aufwand fest, damit der Agent, der es bearbeitet, genau diese nutzt, und heben Sie das Flaggschiff für die Tickets auf, die es brauchen.

Backlog-Board

Die Tests an ein günstigeres Modell abgeben

Ein Dev-Agent auf einem Flaggschiff-Modell übergibt den Testlauf per MCP an einen QA-Agenten auf einem leichteren Modell, sodass das teure Modell beim Code bleibt.

Agent-Delegation

Ein Modell pro Schritt

In einem Agenten-Team hat jeder Schritt eine eigene Rolle, eine eigene CLI und ein eigenes Modell: der Architekt auf einem Frontier-Modell, der Implementierer auf der Opus-Stufe, der Reviewer dort, wo es sich lohnt.

Agent Teams
AgentsRoom herunterladen

Mehr zum Thema