Fable 级
对标 Fable 级(前沿)的模型
比 Opus 高一档的前沿模型:Codex 的 GPT-6 Astra、Codex 的 Daybreak Blue和Codex 的 GPT-5.6 Sol Max。
用于最难的问题,价格也最高。
AI 模型对照表
你对 Claude 的产品线了如指掌,可一打开 Codex、Gemini 或 Grok,没有一个名字能告诉你哪个模型扮演 Opus 的角色。本页把 AgentsRoom 能运行的每个编程代理 CLI 的每个模型都放到同一把尺子上,让每个模型都能用你已经熟悉的说法来读懂。
实时读取自 AgentsRoom 模型目录。热度数据截至 2026年10月6日 16:16。
对比的 CLI
12
已分档的模型
94
统计的启动次数(最近 30 天)
51,051
以 Claude 为标尺,是因为它是大多数开发者都熟悉的产品线。每一项都列出目前扮演同一角色的其他厂商的模型。
Fable 级
比 Opus 高一档的前沿模型:Codex 的 GPT-6 Astra、Codex 的 Daybreak Blue和Codex 的 GPT-5.6 Sol Max。
用于最难的问题,价格也最高。
Opus 级
扮演 Claude Opus 角色的模型:Codex 的 GPT-6.1 Sol、Antigravity 的 Gemini 3.1 Pro (High)和Grok 的 Grok 4.7。
大多数正式编程工作所依赖的旗舰模型。
Sonnet 级
扮演 Claude Sonnet 角色的模型:Codex 的 GPT-6 Luna、Codex 的 GPT-5.6 Terra、Antigravity 的 Gemini 3.8 Flash (High)、OpenCode 的 GLM 5.3、OpenCode 的 Qwen3.8 Max、Aider 的 DeepSeek、Mistral Vibe 的 Medium 3.5和Kimi 的 Kimi K3。
均衡型:足以应对大多数功能开发,又比旗舰便宜。
Haiku 级
扮演 Claude Haiku 角色的模型:Codex 的 Codex Spark、Ollama 的 Qwen3 Coder、Ollama 的 GLM 4.6和oh-my-pi 的 DeepSeek V4 Flash。
轻量快速:重命名、小修复、摘要。
AgentsRoom 能运行的每个 CLI 占一行,每个档位占一列。当前模型排在前面;列表中仍在提供的旧版本,以数量显示在其下方。
| CLI | 前沿Fable 级 | Opus 级 | Sonnet 级 | Haiku 级 |
|---|---|---|---|---|
Fable | OpusOpus 5.5 +2 个旧版本Opus 5, Opus 4.8 | SonnetSonnet 5.5 +1 个旧版本Sonnet 5 | Haiku | |
GPT-6 AstraDaybreak BlueDaybreak RedGPT-5.6 Sol Max | GPT-6.1 Sol +3 个旧版本GPT-6 Sol, GPT-5.6 Sol, GPT-5.5 | GPT-6 LunaGPT-5.6 Terra +4 个旧版本GPT-5.6 Luna, GPT-5, GPT-5.4, GPT-5.2 | Codex Spark +1 个旧版本GPT-5.4 Mini | |
| 无 | Gemini 3.1 Pro (High)Claude Opus 5.5 (High)Claude Opus 5.5 (Medium) | Gemini 3.8 Flash (High)Gemini 3.8 Flash (Medium)Claude Sonnet 5.5 (High)Claude Sonnet 5.5 (Medium) +5 个旧版本Gemini 3.7 Flash (High), Gemini 3.7 Flash (Medium), Gemini 3.6 Flash (High), Gemini 3.6 Flash (Medium), Gemini 3.5 Flash (Medium) | 无 | |
| 无 | Claude Opus | Claude SonnetGPT-5Kimi K3GLM 5.3Qwen3.8 Max | 无 | |
| 无 | Claude Opus | Claude SonnetDeepSeek | GPT-4o | |
| 无 | Grok 4.7 | 无 | 无 | |
| 无 | 无 | Medium 3.5 | 无 | |
| 无 | 无 | Qwen3 Coder 480B | Gemma 3Qwen3 CoderGLM 4.6 | |
GPT-6 Astra | GPT-6.1 SolClaude Opus 5.5GPT-5.5 +5 个旧版本GPT-6 Sol, Claude Opus 5, GPT-5.6 Sol, Claude Opus 4.8, Claude Opus 4.7 | Claude Sonnet 5.5GPT-6 LunaGPT-5.6 TerraGemini 3.7 FlashKimi K3 +4 个旧版本Claude Sonnet 5, GPT-5.6 Luna, Claude Sonnet 4.6, Gemini 3.6 Flash | Claude Haiku 4.5MAI-Code-1.1-Flash | |
| 无 | 无 | Kimi K3Kimi K3-256KKimi K2.8 PreviewK2.7 Code HighSpeed | 无 | |
| 无 | Claude Opus 5.5GPT-6 Sol | Claude Sonnet 5Gemini FlashGLM 5.3 +1 个旧版本GLM 5.2 | DeepSeek V4 Flash | |
| 无 | Claude OpusGPTCodexGemini | SWEClaude SonnetGLMKimiDeepSeek | Claude Haiku | |
| 每次请求都替你挑选模型:没有固定档位。 | ||||
| 每次请求都替你挑选模型:没有固定档位。 | ||||
| 每次请求都替你挑选模型:没有固定档位。 | ||||
模型系列并不绑定在其厂商自家的工具上。下面列出目前由不止一个 CLI 提供的每个系列,以及每个 CLI 给它起的名字。
7 个 CLI
7 个 CLI
4 个 CLI
4 个 CLI
3 个 CLI
3 个 CLI
3 个 CLI
3 个 CLI
2 个 CLI
2 个 CLI
2 个 CLI
2 个 CLI
过去 30 天 AgentsRoom 用户启动最多的模型,按档位来解读。对照告诉你哪些模型扮演同一角色;启动次数告诉你大家实际选了哪些。
OpusOpus 级
占启动的 22.9%
SonnetSonnet 级
占启动的 12.8%
Opus 5.5Opus 级
占启动的 9.4%
GPT-5.6 SolOpus 级
占启动的 5%
GPT-6 LunaSonnet 级
占启动的 4.9%
一把以 Claude 为基准、分为四个档位的尺子:Fable 级(前沿)、Opus 级(旗舰)、Sonnet 级(均衡)和 Haiku 级(轻量)。每个模型系列都按其厂商在自家产品线中赋予它的角色归入相应档位,同一系列在提供它的每个 CLI 中都保持同一档位。
OpenAI 的 Astra 是前沿模型,Sol 是旗舰,Luna 和 Terra 是均衡模型,Spark 和 mini 系列是轻量模型。Gemini Pro 属于 Opus 级,Gemini Flash 属于 Sonnet 级。Grok Heavy 属于前沿,Grok 本身属于 Opus 级。
开放权重的系列(Kimi、GLM、DeepSeek、Qwen 等)最高只放到 Sonnet 级,它们的轻量版放在 Haiku 级。在两个档位之间,表格总是选较低的那个:宁可低估一个模型,也不在它尚未证明自己时告诉你它能替代 Opus。
路由器没有档位,因为它们每次请求都会挑一个模型:GitHub Copilot(Auto)、Amp(Amp default)、Freebuff(Freebuff default)、Devin(Adaptive)和Cursor(Default)。表格还不认识的系列同样没有档位:没有对照,总比错误的对照好。
档位不是基准测试分数。同一档位的两个模型,在价格、速度、上下文窗口、用量上限和最擅长的任务上仍有差别。用这张表知道该往哪里看,然后在你自己的任务上把两个都试一试。
数据:AgentsRoom 提供给其桌面和移动应用的模型目录(每次访问时读取),以及应用在每个模型列表下所用的档位规则。热度:共享使用数据的 AgentsRoom 用户在过去 30 天里真实的代理启动,每十分钟刷新一次。
GPT-6.1 Sol。在上面的表格中,Claude Opus 和 GPT-6.1 Sol 都属于 Opus 级:大多数正式编程工作所依赖的旗舰,比前沿档位低一档。 Codex 的前沿模型,也就是 Fable 的对应模型,是 GPT-6 Astra。 做 Sonnet 级的工作,Codex 对应的模型是 GPT-6 Luna。 而列表里的 Haiku 级模型是 Codex Spark。
Antigravity 中的 Gemini 3.1 Pro (High)。Gemini Pro 是 Google 的旗舰系列,所以属于 Opus 级。 Gemini Flash 扮演 Sonnet 的角色:目前是 Gemini 3.8 Flash (High)。
Codex 中的 GPT-6 Luna。OpenAI 的均衡系列属于 Sonnet 级:足以应对大多数功能开发,又比旗舰便宜。
Codex 中的 Codex Spark:这条产品线里轻量、快速的模型,适合重命名、小修复和简单提问。
同一档位不等于同样的结果。GPT-6.1 Sol 和 Opus 5.5 在各自厂商的产品线里扮演同一角色,但它们在价格、速度、上下文窗口、用量上限和最擅长的任务上仍有差别,两者的基准测试排名也会随每次发布而变化。可靠的答案是在你自己的同一个任务上把两个都跑一遍:AgentsRoom 会在同一个项目里为每个模型各启动一个代理,并排运行。
目前,Opus 也出现在 Antigravity、OpenCode、Aider、GitHub Copilot、oh-my-pi和Devin 的模型列表里,名字由各个 CLI 自己起。同一系列,同一档位:对照关系不会因为提供它的 CLI 不同而改变。
因为这把尺子按模型扮演的角色来定,而且从不夸大。开放权重的系列往往性价比很高,也有好几个 CLI 提供它们,但把其中一个放进 Opus 级,就等于告诉你它能在任何任务上替代 Opus,而目前还没有哪一个全面证明过这一点。它们的轻量版属于 Haiku 级。
因为它们不是模型:GitHub Copilot(Auto)、Amp(Amp default)、Freebuff(Freebuff default)、Devin(Adaptive)和Cursor(Default) 都让服务在每次请求时自己挑模型,所以没有固定的能力可比。表格宁可把它们排除在外,也不去猜。
每次打开页面时都会重新计算,数据来自 AgentsRoom 应用提供给每台电脑和手机的同一份模型目录。AgentsRoom 一旦加入某个 CLI 新发布的模型,它就会立即以其档位出现在这里,被它取代的版本则标为旧版本。热度火焰图标每十分钟根据过去 30 天的启动数据刷新一次。
可以,有两种方式,而且都只是建议。AI Suggestion 在会话打开之前评估任务的规模(轻量、标准、复杂或极难),然后用该 CLI 中仍能胜任的最便宜模型打开代理。Adaptive Mode 在 CLI 运行后读取你的草稿,任务用不着旗舰时就建议换个更轻的模型,或者告诉你当前的模型正合适。
在 AgentsRoom 中
AgentsRoom 是面向 AI 编程代理的桌面指挥中心。Claude、Codex、GitHub Copilot CLI、Cursor 以及另外 10 个代理 CLI 并排运行,每个代理都跑在你选的模型上。本页的对照关系,就是你在应用里选模型时看到的那些;另外还有几项智能功能,帮你按任务选对模型。
AI Suggestion 把一句话的描述转成一个复杂度级别(轻量、标准、复杂、极难),并用够用的最便宜模型打开代理。Adaptive Mode 会检查你的草稿,在旗舰大材小用时建议换个更轻的模型。
AI Suggestion 与 Adaptive Mode当某个账号接近上限时,配额规则可以按模型逐一把新代理放到另一个 CLI 上启动:Fable、Opus 和 Sonnet 各自转到同一档位的对应模型,这些对应关系已按本页的档位预先填好。
配额规则与用量提醒