AI 模型對照表

AI 模型對照表:每個程式設計 CLI 裡的 Opus、Sonnet 和 Haiku

你對 Claude 的產品線瞭如指掌,可一開啟 Codex、Gemini 或 Grok,沒有一個名字能告訴你哪個模型扮演 Opus 的角色。本頁把 AgentsRoom 能執行的每個程式設計代理 CLI 的每個模型都放到同一把尺子上,讓每個模型都能用你已經熟悉的說法來讀懂。

即時讀取自 AgentsRoom 模型目錄。熱度資料截至 2026年10月6日 下午4:16。

對比的 CLI

12

已分檔的模型

94

統計的啟動次數(最近 30 天)

51,051

先說結論

以 Claude 為標尺,是因為它是大多數開發者都熟悉的產品線。每一項都列出目前扮演同一角色的其他廠商的模型。

Fable 級

對標 Fable 級(前沿)的模型

比 Opus 高一檔的前沿模型:Codex 的 GPT-6 Astra、Codex 的 Daybreak Blue和Codex 的 GPT-5.6 Sol Max。

用於最難的問題,價格也最高。

Opus 級

對標 Opus 的模型

扮演 Claude Opus 角色的模型:Codex 的 GPT-6.1 Sol、Antigravity 的 Gemini 3.1 Pro (High)和Grok 的 Grok 4.7。

大多數正式程式設計工作所依賴的旗艦模型。

Sonnet 級

對標 Sonnet 的模型

扮演 Claude Sonnet 角色的模型:Codex 的 GPT-6 Luna、Codex 的 GPT-5.6 Terra、Antigravity 的 Gemini 3.8 Flash (High)、OpenCode 的 GLM 5.3、OpenCode 的 Qwen3.8 Max、Aider 的 DeepSeek、Mistral Vibe 的 Medium 3.5和Kimi 的 Kimi K3。

均衡型:足以應對大多數功能開發,又比旗艦便宜。

Haiku 級

對標 Haiku 的模型

扮演 Claude Haiku 角色的模型:Codex 的 Codex Spark、Ollama 的 Qwen3 Coder、Ollama 的 GLM 4.6和oh-my-pi 的 DeepSeek V4 Flash。

輕量快速:重新命名、小修復、摘要。

每個程式設計 CLI,逐檔對照

AgentsRoom 能執行的每個 CLI 佔一行,每個檔位佔一列。當前模型排在前面;列表中仍在提供的舊版本,以數量顯示在其下方。

按程式設計代理 CLI 和能力檔位排列的 AI 模型對照表
CLI前沿Fable 級Opus 級Sonnet 級Haiku 級
Claude
Fable
OpusOpus 5.5
+2 箇舊版本

Opus 5, Opus 4.8

SonnetSonnet 5.5
+1 箇舊版本

Sonnet 5

Haiku
Codex
GPT-6 AstraDaybreak BlueDaybreak RedGPT-5.6 Sol Max
GPT-6.1 Sol
+3 箇舊版本

GPT-6 Sol, GPT-5.6 Sol, GPT-5.5

GPT-6 LunaGPT-5.6 Terra
+4 箇舊版本

GPT-5.6 Luna, GPT-5, GPT-5.4, GPT-5.2

Codex Spark
+1 箇舊版本

GPT-5.4 Mini

Antigravity無
Gemini 3.1 Pro (High)Claude Opus 5.5 (High)Claude Opus 5.5 (Medium)
Gemini 3.8 Flash (High)Gemini 3.8 Flash (Medium)Claude Sonnet 5.5 (High)Claude Sonnet 5.5 (Medium)
+5 箇舊版本

Gemini 3.7 Flash (High), Gemini 3.7 Flash (Medium), Gemini 3.6 Flash (High), Gemini 3.6 Flash (Medium), Gemini 3.5 Flash (Medium)

無
OpenCode無
Claude Opus
Claude SonnetGPT-5Kimi K3GLM 5.3Qwen3.8 Max
無
Aider無
Claude Opus
Claude SonnetDeepSeek
GPT-4o
Grok無
Grok 4.7
無無
Mistral Vibe無無
Medium 3.5
無
Ollama無無
Qwen3 Coder 480B
Gemma 3Qwen3 CoderGLM 4.6
GitHub Copilot
GPT-6 Astra
GPT-6.1 SolClaude Opus 5.5GPT-5.5
+5 箇舊版本

GPT-6 Sol, Claude Opus 5, GPT-5.6 Sol, Claude Opus 4.8, Claude Opus 4.7

Claude Sonnet 5.5GPT-6 LunaGPT-5.6 TerraGemini 3.7 FlashKimi K3
+4 箇舊版本

Claude Sonnet 5, GPT-5.6 Luna, Claude Sonnet 4.6, Gemini 3.6 Flash

Claude Haiku 4.5MAI-Code-1.1-Flash
Kimi無無
Kimi K3Kimi K3-256KKimi K2.8 PreviewK2.7 Code HighSpeed
無
oh-my-pi無
Claude Opus 5.5GPT-6 Sol
Claude Sonnet 5Gemini FlashGLM 5.3
+1 箇舊版本

GLM 5.2

DeepSeek V4 Flash
Devin無
Claude OpusGPTCodexGemini
SWEClaude SonnetGLMKimiDeepSeek
Claude Haiku
Amp每次請求都替你挑選模型:沒有固定檔位。
Freebuff每次請求都替你挑選模型:沒有固定檔位。
Cursor每次請求都替你挑選模型:沒有固定檔位。
  • 所在 CLI 中社群啟動最多的三個模型之一
  • 舊版本:同一模型的更新一代就在同一列表中

同一模型,多個 CLI

模型系列並不綁定在其廠商自家的工具上。下面列出目前由不止一個 CLI 提供的每個系列,以及每個 CLI 給它起的名字。

Claude Opus

Opus 級

7 個 CLI

  • ClaudeOpus 5.5
  • AntigravityClaude Opus 5.5 (High)
  • OpenCodeClaude Opus
  • AiderClaude Opus
  • GitHub CopilotClaude Opus 5.5
  • oh-my-piClaude Opus 5.5
  • DevinClaude Opus

Claude Sonnet

Sonnet 級

7 個 CLI

  • ClaudeSonnet 5.5
  • AntigravityClaude Sonnet 5.5 (High)
  • OpenCodeClaude Sonnet
  • AiderClaude Sonnet
  • GitHub CopilotClaude Sonnet 5.5
  • oh-my-piClaude Sonnet 5
  • DevinClaude Sonnet

Kimi

Sonnet 級

4 個 CLI

  • KimiKimi K3
  • OpenCodeKimi K3
  • GitHub CopilotKimi K3
  • DevinKimi

GLM

Sonnet 級

4 個 CLI

  • OpenCodeGLM 5.3
  • OllamaGLM 4.6
  • oh-my-piGLM 5.3
  • DevinGLM

Claude Haiku

Haiku 級

3 個 CLI

  • ClaudeHaiku
  • GitHub CopilotClaude Haiku 4.5
  • DevinClaude Haiku

GPT Sol

Opus 級

3 個 CLI

  • CodexGPT-6.1 Sol
  • GitHub CopilotGPT-6.1 Sol
  • oh-my-piGPT-6 Sol

Gemini Flash

Sonnet 級

3 個 CLI

  • AntigravityGemini 3.8 Flash (High)
  • GitHub CopilotGemini 3.7 Flash
  • oh-my-piGemini Flash

DeepSeek

Sonnet 級

3 個 CLI

  • AiderDeepSeek
  • oh-my-piDeepSeek V4 Flash
  • DevinDeepSeek

GPT Astra

Fable 級

2 個 CLI

  • CodexGPT-6 Astra
  • GitHub CopilotGPT-6 Astra

GPT Luna

Sonnet 級

2 個 CLI

  • CodexGPT-6 Luna
  • GitHub CopilotGPT-6 Luna

GPT Terra

Sonnet 級

2 個 CLI

  • CodexGPT-5.6 Terra
  • GitHub CopilotGPT-5.6 Terra

Qwen

Sonnet 級

2 個 CLI

  • OpenCodeQwen3.8 Max
  • OllamaQwen3 Coder

開發者真正在啟動的模型

過去 30 天 AgentsRoom 使用者啟動最多的模型,按檔位來解讀。對照告訴你哪些模型扮演同一角色;啟動次數告訴你大家實際選了哪些。

  1. 1

    OpusOpus 級

    Claude439 位成員

    佔啟動的 22.9%

  2. 2

    SonnetSonnet 級

    Claude173 位成員

    佔啟動的 12.8%

  3. 3

    Opus 5.5Opus 級

    Claude103 位成員

    佔啟動的 9.4%

  4. 4

    GPT-5.6 SolOpus 級

    Codex119 位成員

    佔啟動的 5%

  5. 5

    GPT-6 LunaSonnet 級

    Codex47 位成員

    佔啟動的 4.9%

完整使用統計,按 CLI 和模型劃分

檔位是如何劃分的

一把以 Claude 為基準、分為四個檔位的尺子:Fable 級(前沿)、Opus 級(旗艦)、Sonnet 級(均衡)和 Haiku 級(輕量)。每個模型系列都按其廠商在自家產品線中賦予它的角色歸入相應檔位,同一系列在提供它的每個 CLI 中都保持同一檔位。

OpenAI 的 Astra 是前沿模型,Sol 是旗艦,Luna 和 Terra 是均衡模型,Spark 和 mini 系列是輕量模型。Gemini Pro 屬於 Opus 級,Gemini Flash 屬於 Sonnet 級。Grok Heavy 屬於前沿,Grok 本身屬於 Opus 級。

開放權重的系列(Kimi、GLM、DeepSeek、Qwen 等)最高只放到 Sonnet 級,它們的輕量版放在 Haiku 級。在兩個檔位之間,表格總是選較低的那個:寧可低估一個模型,也不在它尚未證明自己時告訴你它能替代 Opus。

路由器沒有檔位,因為它們每次請求都會挑一個模型:GitHub Copilot(Auto)、Amp(Amp default)、Freebuff(Freebuff default)、Devin(Adaptive)和Cursor(Default)。表格還不認識的系列同樣沒有檔位:沒有對照,總比錯誤的對照好。

檔位不是基準測試分數。同一檔位的兩個模型,在價格、速度、上下文視窗、用量上限和最擅長的任務上仍有差別。用這張表知道該往哪裡看,然後在你自己的任務上把兩個都試一試。

資料:AgentsRoom 提供給其桌面和行動應用的模型目錄(每次訪問時讀取),以及應用在每個模型列表下所用的檔位規則。熱度:共享使用資料的 AgentsRoom 使用者在過去 30 天裡真實的代理啟動,每十分鐘重新整理一次。

常見問題

哪個 Codex 模型相當於 Claude Opus?

GPT-6.1 Sol。在上面的表格中,Claude Opus 和 GPT-6.1 Sol 都屬於 Opus 級:大多數正式程式設計工作所依賴的旗艦,比前沿檔位低一檔。 Codex 的前沿模型,也就是 Fable 的對應模型,是 GPT-6 Astra。 做 Sonnet 級的工作,Codex 對應的模型是 GPT-6 Luna。 而列表裡的 Haiku 級模型是 Codex Spark。

Claude Opus 對應的 Gemini 模型是哪個?

Antigravity 中的 Gemini 3.1 Pro (High)。Gemini Pro 是 Google 的旗艦系列,所以屬於 Opus 級。 Gemini Flash 扮演 Sonnet 的角色:目前是 Gemini 3.8 Flash (High)。

哪個 GPT 模型相當於 Claude Sonnet?

Codex 中的 GPT-6 Luna。OpenAI 的均衡系列屬於 Sonnet 級:足以應對大多數功能開發,又比旗艦便宜。

Claude Haiku 對應的 OpenAI 模型是哪個?

Codex 中的 Codex Spark:這條產品線裡輕量、快速的模型,適合重新命名、小修復和簡單提問。

GPT-6.1 Sol 和 Opus 5.5 一樣好嗎?

同一檔位不等於同樣的結果。GPT-6.1 Sol 和 Opus 5.5 在各自廠商的產品線裡扮演同一角色,但它們在價格、速度、上下文視窗、用量上限和最擅長的任務上仍有差別,兩者的基準測試排名也會隨每次發布而變化。可靠的答案是在你自己的同一個任務上把兩個都跑一遍:AgentsRoom 會在同一個專案裡為每個模型各啟動一個代理,並排執行。

在 Claude Code 之外,哪裡還能用 Claude Opus?

目前,Opus 也出現在 Antigravity、OpenCode、Aider、GitHub Copilot、oh-my-pi和Devin 的模型列表裡,名字由各個 CLI 自己起。同一系列,同一檔位:對照關係不會因為提供它的 CLI 不同而改變。

為什麼表格把 Kimi、GLM 或 Qwen 最高只定在 Sonnet 級?

因為這把尺子按模型扮演的角色來定,而且從不誇大。開放權重的系列往往價效比很高,也有好幾個 CLI 提供它們,但把其中一個放進 Opus 級,就等於告訴你它能在任何任務上替代 Opus,而目前還沒有哪一個全面證明過這一點。它們的輕量版屬於 Haiku 級。

為什麼 Auto 和 Default 沒有對應模型?

因為它們不是模型:GitHub Copilot(Auto)、Amp(Amp default)、Freebuff(Freebuff default)、Devin(Adaptive)和Cursor(Default) 都讓服務在每次請求時自己挑模型,所以沒有固定的能力可比。表格寧可把它們排除在外,也不去猜。

這張表有多新?

每次開啟頁面時都會重新計算,資料來自 AgentsRoom 應用提供給每台電腦和手機的同一份模型目錄。AgentsRoom 一旦加入某個 CLI 新發布的模型,它就會立即以其檔位出現在這裡,被它取代的版本則標為舊版本。熱度火焰圖示每十分鐘根據過去 30 天的啟動資料重新整理一次。

AgentsRoom 能為我的任務挑選合適的模型嗎?

可以,有兩種方式,而且都只是建議。AI Suggestion 在會話開啟之前評估任務的規模(輕量、標準、複雜或極難),然後用該 CLI 中仍能勝任的最便宜模型開啟代理。Adaptive Mode 在 CLI 執行後讀取你的草稿,任務用不著旗艦時就建議換個更輕的模型,或者告訴你當前的模型正合適。

在 AgentsRoom 中

AgentsRoom 直接在模型選擇器裡給出答案

AgentsRoom 是面向 AI 程式設計代理的桌面指揮中心。Claude、Codex、GitHub Copilot CLI、Cursor 以及另外 10 個代理 CLI 並排執行,每個代理都跑在你選的模型上。本頁的對照關係,就是你在應用裡選模型時看到的那些;另外還有幾項智慧功能,幫你按任務選對模型。

每個模型下方的 ≈ Opus

每個模型列表(新建代理、快捷代理、待辦工單、行動應用)都會給每個模型打上標籤,寫出它在你最熟悉的 CLI 中的對應模型,並可按能力、價格或熱度排序。

應用內的模型對照

讓任務來挑模型

AI Suggestion 把一句話的描述轉成一個複雜度級別(輕量、標準、複雜、極難),並用夠用的最便宜模型開啟代理。Adaptive Mode 會檢查你的草稿,在旗艦大材小用時建議換個更輕的模型。

AI Suggestion 與 Adaptive Mode

切到對應的模型

當某個帳號接近上限時,配額規則可以按模型逐一把新代理放到另一個 CLI 上啟動:Fable、Opus 和 Sonnet 各自轉到同一檔位的對應模型,這些對應關係已按本頁的檔位預先填好。

配額規則與用量提醒

每個工單用對模型

在待辦工單上固定供應商、模型和推理強度,執行它的代理就會嚴格照此執行;旗艦模型則留給真正需要它的工單。

待辦任務看板

把測試交給更便宜的模型

跑在旗艦模型上的開發代理透過 MCP 把測試交給跑在更輕模型上的 QA 代理,貴的模型就能一直專注在程式碼上。

代理委派

每一步一個模型

在代理團隊裡,每一步都有自己的角色、CLI 和模型:架構師用前沿模型,實現者用 Opus 級,審查者放在最划算的地方。

代理團隊
下載 AgentsRoom

延伸閱讀