Fable 級
對標 Fable 級(前沿)的模型
比 Opus 高一檔的前沿模型:Codex 的 GPT-6 Astra、Codex 的 Daybreak Blue和Codex 的 GPT-5.6 Sol Max。
用於最難的問題,價格也最高。
AI 模型對照表
你對 Claude 的產品線瞭如指掌,可一開啟 Codex、Gemini 或 Grok,沒有一個名字能告訴你哪個模型扮演 Opus 的角色。本頁把 AgentsRoom 能執行的每個程式設計代理 CLI 的每個模型都放到同一把尺子上,讓每個模型都能用你已經熟悉的說法來讀懂。
即時讀取自 AgentsRoom 模型目錄。熱度資料截至 2026年10月6日 下午4:16。
對比的 CLI
12
已分檔的模型
94
統計的啟動次數(最近 30 天)
51,051
以 Claude 為標尺,是因為它是大多數開發者都熟悉的產品線。每一項都列出目前扮演同一角色的其他廠商的模型。
Fable 級
比 Opus 高一檔的前沿模型:Codex 的 GPT-6 Astra、Codex 的 Daybreak Blue和Codex 的 GPT-5.6 Sol Max。
用於最難的問題,價格也最高。
Opus 級
扮演 Claude Opus 角色的模型:Codex 的 GPT-6.1 Sol、Antigravity 的 Gemini 3.1 Pro (High)和Grok 的 Grok 4.7。
大多數正式程式設計工作所依賴的旗艦模型。
Sonnet 級
扮演 Claude Sonnet 角色的模型:Codex 的 GPT-6 Luna、Codex 的 GPT-5.6 Terra、Antigravity 的 Gemini 3.8 Flash (High)、OpenCode 的 GLM 5.3、OpenCode 的 Qwen3.8 Max、Aider 的 DeepSeek、Mistral Vibe 的 Medium 3.5和Kimi 的 Kimi K3。
均衡型:足以應對大多數功能開發,又比旗艦便宜。
Haiku 級
扮演 Claude Haiku 角色的模型:Codex 的 Codex Spark、Ollama 的 Qwen3 Coder、Ollama 的 GLM 4.6和oh-my-pi 的 DeepSeek V4 Flash。
輕量快速:重新命名、小修復、摘要。
AgentsRoom 能執行的每個 CLI 佔一行,每個檔位佔一列。當前模型排在前面;列表中仍在提供的舊版本,以數量顯示在其下方。
| CLI | 前沿Fable 級 | Opus 級 | Sonnet 級 | Haiku 級 |
|---|---|---|---|---|
Fable | OpusOpus 5.5 +2 箇舊版本Opus 5, Opus 4.8 | SonnetSonnet 5.5 +1 箇舊版本Sonnet 5 | Haiku | |
GPT-6 AstraDaybreak BlueDaybreak RedGPT-5.6 Sol Max | GPT-6.1 Sol +3 箇舊版本GPT-6 Sol, GPT-5.6 Sol, GPT-5.5 | GPT-6 LunaGPT-5.6 Terra +4 箇舊版本GPT-5.6 Luna, GPT-5, GPT-5.4, GPT-5.2 | Codex Spark +1 箇舊版本GPT-5.4 Mini | |
| 無 | Gemini 3.1 Pro (High)Claude Opus 5.5 (High)Claude Opus 5.5 (Medium) | Gemini 3.8 Flash (High)Gemini 3.8 Flash (Medium)Claude Sonnet 5.5 (High)Claude Sonnet 5.5 (Medium) +5 箇舊版本Gemini 3.7 Flash (High), Gemini 3.7 Flash (Medium), Gemini 3.6 Flash (High), Gemini 3.6 Flash (Medium), Gemini 3.5 Flash (Medium) | 無 | |
| 無 | Claude Opus | Claude SonnetGPT-5Kimi K3GLM 5.3Qwen3.8 Max | 無 | |
| 無 | Claude Opus | Claude SonnetDeepSeek | GPT-4o | |
| 無 | Grok 4.7 | 無 | 無 | |
| 無 | 無 | Medium 3.5 | 無 | |
| 無 | 無 | Qwen3 Coder 480B | Gemma 3Qwen3 CoderGLM 4.6 | |
GPT-6 Astra | GPT-6.1 SolClaude Opus 5.5GPT-5.5 +5 箇舊版本GPT-6 Sol, Claude Opus 5, GPT-5.6 Sol, Claude Opus 4.8, Claude Opus 4.7 | Claude Sonnet 5.5GPT-6 LunaGPT-5.6 TerraGemini 3.7 FlashKimi K3 +4 箇舊版本Claude Sonnet 5, GPT-5.6 Luna, Claude Sonnet 4.6, Gemini 3.6 Flash | Claude Haiku 4.5MAI-Code-1.1-Flash | |
| 無 | 無 | Kimi K3Kimi K3-256KKimi K2.8 PreviewK2.7 Code HighSpeed | 無 | |
| 無 | Claude Opus 5.5GPT-6 Sol | Claude Sonnet 5Gemini FlashGLM 5.3 +1 箇舊版本GLM 5.2 | DeepSeek V4 Flash | |
| 無 | Claude OpusGPTCodexGemini | SWEClaude SonnetGLMKimiDeepSeek | Claude Haiku | |
| 每次請求都替你挑選模型:沒有固定檔位。 | ||||
| 每次請求都替你挑選模型:沒有固定檔位。 | ||||
| 每次請求都替你挑選模型:沒有固定檔位。 | ||||
模型系列並不綁定在其廠商自家的工具上。下面列出目前由不止一個 CLI 提供的每個系列,以及每個 CLI 給它起的名字。
7 個 CLI
7 個 CLI
4 個 CLI
4 個 CLI
3 個 CLI
3 個 CLI
3 個 CLI
3 個 CLI
2 個 CLI
2 個 CLI
2 個 CLI
2 個 CLI
過去 30 天 AgentsRoom 使用者啟動最多的模型,按檔位來解讀。對照告訴你哪些模型扮演同一角色;啟動次數告訴你大家實際選了哪些。
OpusOpus 級
佔啟動的 22.9%
SonnetSonnet 級
佔啟動的 12.8%
Opus 5.5Opus 級
佔啟動的 9.4%
GPT-5.6 SolOpus 級
佔啟動的 5%
GPT-6 LunaSonnet 級
佔啟動的 4.9%
一把以 Claude 為基準、分為四個檔位的尺子:Fable 級(前沿)、Opus 級(旗艦)、Sonnet 級(均衡)和 Haiku 級(輕量)。每個模型系列都按其廠商在自家產品線中賦予它的角色歸入相應檔位,同一系列在提供它的每個 CLI 中都保持同一檔位。
OpenAI 的 Astra 是前沿模型,Sol 是旗艦,Luna 和 Terra 是均衡模型,Spark 和 mini 系列是輕量模型。Gemini Pro 屬於 Opus 級,Gemini Flash 屬於 Sonnet 級。Grok Heavy 屬於前沿,Grok 本身屬於 Opus 級。
開放權重的系列(Kimi、GLM、DeepSeek、Qwen 等)最高只放到 Sonnet 級,它們的輕量版放在 Haiku 級。在兩個檔位之間,表格總是選較低的那個:寧可低估一個模型,也不在它尚未證明自己時告訴你它能替代 Opus。
路由器沒有檔位,因為它們每次請求都會挑一個模型:GitHub Copilot(Auto)、Amp(Amp default)、Freebuff(Freebuff default)、Devin(Adaptive)和Cursor(Default)。表格還不認識的系列同樣沒有檔位:沒有對照,總比錯誤的對照好。
檔位不是基準測試分數。同一檔位的兩個模型,在價格、速度、上下文視窗、用量上限和最擅長的任務上仍有差別。用這張表知道該往哪裡看,然後在你自己的任務上把兩個都試一試。
資料:AgentsRoom 提供給其桌面和行動應用的模型目錄(每次訪問時讀取),以及應用在每個模型列表下所用的檔位規則。熱度:共享使用資料的 AgentsRoom 使用者在過去 30 天裡真實的代理啟動,每十分鐘重新整理一次。
GPT-6.1 Sol。在上面的表格中,Claude Opus 和 GPT-6.1 Sol 都屬於 Opus 級:大多數正式程式設計工作所依賴的旗艦,比前沿檔位低一檔。 Codex 的前沿模型,也就是 Fable 的對應模型,是 GPT-6 Astra。 做 Sonnet 級的工作,Codex 對應的模型是 GPT-6 Luna。 而列表裡的 Haiku 級模型是 Codex Spark。
Antigravity 中的 Gemini 3.1 Pro (High)。Gemini Pro 是 Google 的旗艦系列,所以屬於 Opus 級。 Gemini Flash 扮演 Sonnet 的角色:目前是 Gemini 3.8 Flash (High)。
Codex 中的 GPT-6 Luna。OpenAI 的均衡系列屬於 Sonnet 級:足以應對大多數功能開發,又比旗艦便宜。
Codex 中的 Codex Spark:這條產品線裡輕量、快速的模型,適合重新命名、小修復和簡單提問。
同一檔位不等於同樣的結果。GPT-6.1 Sol 和 Opus 5.5 在各自廠商的產品線裡扮演同一角色,但它們在價格、速度、上下文視窗、用量上限和最擅長的任務上仍有差別,兩者的基準測試排名也會隨每次發布而變化。可靠的答案是在你自己的同一個任務上把兩個都跑一遍:AgentsRoom 會在同一個專案裡為每個模型各啟動一個代理,並排執行。
目前,Opus 也出現在 Antigravity、OpenCode、Aider、GitHub Copilot、oh-my-pi和Devin 的模型列表裡,名字由各個 CLI 自己起。同一系列,同一檔位:對照關係不會因為提供它的 CLI 不同而改變。
因為這把尺子按模型扮演的角色來定,而且從不誇大。開放權重的系列往往價效比很高,也有好幾個 CLI 提供它們,但把其中一個放進 Opus 級,就等於告訴你它能在任何任務上替代 Opus,而目前還沒有哪一個全面證明過這一點。它們的輕量版屬於 Haiku 級。
因為它們不是模型:GitHub Copilot(Auto)、Amp(Amp default)、Freebuff(Freebuff default)、Devin(Adaptive)和Cursor(Default) 都讓服務在每次請求時自己挑模型,所以沒有固定的能力可比。表格寧可把它們排除在外,也不去猜。
每次開啟頁面時都會重新計算,資料來自 AgentsRoom 應用提供給每台電腦和手機的同一份模型目錄。AgentsRoom 一旦加入某個 CLI 新發布的模型,它就會立即以其檔位出現在這裡,被它取代的版本則標為舊版本。熱度火焰圖示每十分鐘根據過去 30 天的啟動資料重新整理一次。
可以,有兩種方式,而且都只是建議。AI Suggestion 在會話開啟之前評估任務的規模(輕量、標準、複雜或極難),然後用該 CLI 中仍能勝任的最便宜模型開啟代理。Adaptive Mode 在 CLI 執行後讀取你的草稿,任務用不著旗艦時就建議換個更輕的模型,或者告訴你當前的模型正合適。
在 AgentsRoom 中
AgentsRoom 是面向 AI 程式設計代理的桌面指揮中心。Claude、Codex、GitHub Copilot CLI、Cursor 以及另外 10 個代理 CLI 並排執行,每個代理都跑在你選的模型上。本頁的對照關係,就是你在應用裡選模型時看到的那些;另外還有幾項智慧功能,幫你按任務選對模型。
AI Suggestion 把一句話的描述轉成一個複雜度級別(輕量、標準、複雜、極難),並用夠用的最便宜模型開啟代理。Adaptive Mode 會檢查你的草稿,在旗艦大材小用時建議換個更輕的模型。
AI Suggestion 與 Adaptive Mode當某個帳號接近上限時,配額規則可以按模型逐一把新代理放到另一個 CLI 上啟動:Fable、Opus 和 Sonnet 各自轉到同一檔位的對應模型,這些對應關係已按本頁的檔位預先填好。
配額規則與用量提醒