AI 模型对照表

AI 模型对照表:每个编程 CLI 里的 Opus、Sonnet 和 Haiku

你对 Claude 的产品线了如指掌,可一打开 Codex、Gemini 或 Grok,没有一个名字能告诉你哪个模型扮演 Opus 的角色。本页把 AgentsRoom 能运行的每个编程代理 CLI 的每个模型都放到同一把尺子上,让每个模型都能用你已经熟悉的说法来读懂。

实时读取自 AgentsRoom 模型目录。热度数据截至 2026年10月6日 16:16。

对比的 CLI

12

已分档的模型

94

统计的启动次数(最近 30 天)

51,051

先说结论

以 Claude 为标尺,是因为它是大多数开发者都熟悉的产品线。每一项都列出目前扮演同一角色的其他厂商的模型。

Fable 级

对标 Fable 级(前沿)的模型

比 Opus 高一档的前沿模型:Codex 的 GPT-6 Astra、Codex 的 Daybreak Blue和Codex 的 GPT-5.6 Sol Max。

用于最难的问题,价格也最高。

Opus 级

对标 Opus 的模型

扮演 Claude Opus 角色的模型:Codex 的 GPT-6.1 Sol、Antigravity 的 Gemini 3.1 Pro (High)和Grok 的 Grok 4.7。

大多数正式编程工作所依赖的旗舰模型。

Sonnet 级

对标 Sonnet 的模型

扮演 Claude Sonnet 角色的模型:Codex 的 GPT-6 Luna、Codex 的 GPT-5.6 Terra、Antigravity 的 Gemini 3.8 Flash (High)、OpenCode 的 GLM 5.3、OpenCode 的 Qwen3.8 Max、Aider 的 DeepSeek、Mistral Vibe 的 Medium 3.5和Kimi 的 Kimi K3。

均衡型:足以应对大多数功能开发,又比旗舰便宜。

Haiku 级

对标 Haiku 的模型

扮演 Claude Haiku 角色的模型:Codex 的 Codex Spark、Ollama 的 Qwen3 Coder、Ollama 的 GLM 4.6和oh-my-pi 的 DeepSeek V4 Flash。

轻量快速:重命名、小修复、摘要。

每个编程 CLI,逐档对照

AgentsRoom 能运行的每个 CLI 占一行,每个档位占一列。当前模型排在前面;列表中仍在提供的旧版本,以数量显示在其下方。

按编程代理 CLI 和能力档位排列的 AI 模型对照表
CLI前沿Fable 级Opus 级Sonnet 级Haiku 级
Claude
Fable
OpusOpus 5.5
+2 个旧版本

Opus 5, Opus 4.8

SonnetSonnet 5.5
+1 个旧版本

Sonnet 5

Haiku
Codex
GPT-6 AstraDaybreak BlueDaybreak RedGPT-5.6 Sol Max
GPT-6.1 Sol
+3 个旧版本

GPT-6 Sol, GPT-5.6 Sol, GPT-5.5

GPT-6 LunaGPT-5.6 Terra
+4 个旧版本

GPT-5.6 Luna, GPT-5, GPT-5.4, GPT-5.2

Codex Spark
+1 个旧版本

GPT-5.4 Mini

Antigravity无
Gemini 3.1 Pro (High)Claude Opus 5.5 (High)Claude Opus 5.5 (Medium)
Gemini 3.8 Flash (High)Gemini 3.8 Flash (Medium)Claude Sonnet 5.5 (High)Claude Sonnet 5.5 (Medium)
+5 个旧版本

Gemini 3.7 Flash (High), Gemini 3.7 Flash (Medium), Gemini 3.6 Flash (High), Gemini 3.6 Flash (Medium), Gemini 3.5 Flash (Medium)

无
OpenCode无
Claude Opus
Claude SonnetGPT-5Kimi K3GLM 5.3Qwen3.8 Max
无
Aider无
Claude Opus
Claude SonnetDeepSeek
GPT-4o
Grok无
Grok 4.7
无无
Mistral Vibe无无
Medium 3.5
无
Ollama无无
Qwen3 Coder 480B
Gemma 3Qwen3 CoderGLM 4.6
GitHub Copilot
GPT-6 Astra
GPT-6.1 SolClaude Opus 5.5GPT-5.5
+5 个旧版本

GPT-6 Sol, Claude Opus 5, GPT-5.6 Sol, Claude Opus 4.8, Claude Opus 4.7

Claude Sonnet 5.5GPT-6 LunaGPT-5.6 TerraGemini 3.7 FlashKimi K3
+4 个旧版本

Claude Sonnet 5, GPT-5.6 Luna, Claude Sonnet 4.6, Gemini 3.6 Flash

Claude Haiku 4.5MAI-Code-1.1-Flash
Kimi无无
Kimi K3Kimi K3-256KKimi K2.8 PreviewK2.7 Code HighSpeed
无
oh-my-pi无
Claude Opus 5.5GPT-6 Sol
Claude Sonnet 5Gemini FlashGLM 5.3
+1 个旧版本

GLM 5.2

DeepSeek V4 Flash
Devin无
Claude OpusGPTCodexGemini
SWEClaude SonnetGLMKimiDeepSeek
Claude Haiku
Amp每次请求都替你挑选模型:没有固定档位。
Freebuff每次请求都替你挑选模型:没有固定档位。
Cursor每次请求都替你挑选模型:没有固定档位。
  • 所在 CLI 中社区启动最多的三个模型之一
  • 旧版本:同一模型的更新一代就在同一列表中

同一模型,多个 CLI

模型系列并不绑定在其厂商自家的工具上。下面列出目前由不止一个 CLI 提供的每个系列,以及每个 CLI 给它起的名字。

Claude Opus

Opus 级

7 个 CLI

  • ClaudeOpus 5.5
  • AntigravityClaude Opus 5.5 (High)
  • OpenCodeClaude Opus
  • AiderClaude Opus
  • GitHub CopilotClaude Opus 5.5
  • oh-my-piClaude Opus 5.5
  • DevinClaude Opus

Claude Sonnet

Sonnet 级

7 个 CLI

  • ClaudeSonnet 5.5
  • AntigravityClaude Sonnet 5.5 (High)
  • OpenCodeClaude Sonnet
  • AiderClaude Sonnet
  • GitHub CopilotClaude Sonnet 5.5
  • oh-my-piClaude Sonnet 5
  • DevinClaude Sonnet

Kimi

Sonnet 级

4 个 CLI

  • KimiKimi K3
  • OpenCodeKimi K3
  • GitHub CopilotKimi K3
  • DevinKimi

GLM

Sonnet 级

4 个 CLI

  • OpenCodeGLM 5.3
  • OllamaGLM 4.6
  • oh-my-piGLM 5.3
  • DevinGLM

Claude Haiku

Haiku 级

3 个 CLI

  • ClaudeHaiku
  • GitHub CopilotClaude Haiku 4.5
  • DevinClaude Haiku

GPT Sol

Opus 级

3 个 CLI

  • CodexGPT-6.1 Sol
  • GitHub CopilotGPT-6.1 Sol
  • oh-my-piGPT-6 Sol

Gemini Flash

Sonnet 级

3 个 CLI

  • AntigravityGemini 3.8 Flash (High)
  • GitHub CopilotGemini 3.7 Flash
  • oh-my-piGemini Flash

DeepSeek

Sonnet 级

3 个 CLI

  • AiderDeepSeek
  • oh-my-piDeepSeek V4 Flash
  • DevinDeepSeek

GPT Astra

Fable 级

2 个 CLI

  • CodexGPT-6 Astra
  • GitHub CopilotGPT-6 Astra

GPT Luna

Sonnet 级

2 个 CLI

  • CodexGPT-6 Luna
  • GitHub CopilotGPT-6 Luna

GPT Terra

Sonnet 级

2 个 CLI

  • CodexGPT-5.6 Terra
  • GitHub CopilotGPT-5.6 Terra

Qwen

Sonnet 级

2 个 CLI

  • OpenCodeQwen3.8 Max
  • OllamaQwen3 Coder

开发者真正在启动的模型

过去 30 天 AgentsRoom 用户启动最多的模型,按档位来解读。对照告诉你哪些模型扮演同一角色;启动次数告诉你大家实际选了哪些。

  1. 1

    OpusOpus 级

    Claude439 位成员

    占启动的 22.9%

  2. 2

    SonnetSonnet 级

    Claude173 位成员

    占启动的 12.8%

  3. 3

    Opus 5.5Opus 级

    Claude103 位成员

    占启动的 9.4%

  4. 4

    GPT-5.6 SolOpus 级

    Codex119 位成员

    占启动的 5%

  5. 5

    GPT-6 LunaSonnet 级

    Codex47 位成员

    占启动的 4.9%

完整使用统计,按 CLI 和模型划分

档位是如何划分的

一把以 Claude 为基准、分为四个档位的尺子:Fable 级(前沿)、Opus 级(旗舰)、Sonnet 级(均衡)和 Haiku 级(轻量)。每个模型系列都按其厂商在自家产品线中赋予它的角色归入相应档位,同一系列在提供它的每个 CLI 中都保持同一档位。

OpenAI 的 Astra 是前沿模型,Sol 是旗舰,Luna 和 Terra 是均衡模型,Spark 和 mini 系列是轻量模型。Gemini Pro 属于 Opus 级,Gemini Flash 属于 Sonnet 级。Grok Heavy 属于前沿,Grok 本身属于 Opus 级。

开放权重的系列(Kimi、GLM、DeepSeek、Qwen 等)最高只放到 Sonnet 级,它们的轻量版放在 Haiku 级。在两个档位之间,表格总是选较低的那个:宁可低估一个模型,也不在它尚未证明自己时告诉你它能替代 Opus。

路由器没有档位,因为它们每次请求都会挑一个模型:GitHub Copilot(Auto)、Amp(Amp default)、Freebuff(Freebuff default)、Devin(Adaptive)和Cursor(Default)。表格还不认识的系列同样没有档位:没有对照,总比错误的对照好。

档位不是基准测试分数。同一档位的两个模型,在价格、速度、上下文窗口、用量上限和最擅长的任务上仍有差别。用这张表知道该往哪里看,然后在你自己的任务上把两个都试一试。

数据:AgentsRoom 提供给其桌面和移动应用的模型目录(每次访问时读取),以及应用在每个模型列表下所用的档位规则。热度:共享使用数据的 AgentsRoom 用户在过去 30 天里真实的代理启动,每十分钟刷新一次。

常见问题

哪个 Codex 模型相当于 Claude Opus?

GPT-6.1 Sol。在上面的表格中,Claude Opus 和 GPT-6.1 Sol 都属于 Opus 级:大多数正式编程工作所依赖的旗舰,比前沿档位低一档。 Codex 的前沿模型,也就是 Fable 的对应模型,是 GPT-6 Astra。 做 Sonnet 级的工作,Codex 对应的模型是 GPT-6 Luna。 而列表里的 Haiku 级模型是 Codex Spark。

Claude Opus 对应的 Gemini 模型是哪个?

Antigravity 中的 Gemini 3.1 Pro (High)。Gemini Pro 是 Google 的旗舰系列,所以属于 Opus 级。 Gemini Flash 扮演 Sonnet 的角色:目前是 Gemini 3.8 Flash (High)。

哪个 GPT 模型相当于 Claude Sonnet?

Codex 中的 GPT-6 Luna。OpenAI 的均衡系列属于 Sonnet 级:足以应对大多数功能开发,又比旗舰便宜。

Claude Haiku 对应的 OpenAI 模型是哪个?

Codex 中的 Codex Spark:这条产品线里轻量、快速的模型,适合重命名、小修复和简单提问。

GPT-6.1 Sol 和 Opus 5.5 一样好吗?

同一档位不等于同样的结果。GPT-6.1 Sol 和 Opus 5.5 在各自厂商的产品线里扮演同一角色,但它们在价格、速度、上下文窗口、用量上限和最擅长的任务上仍有差别,两者的基准测试排名也会随每次发布而变化。可靠的答案是在你自己的同一个任务上把两个都跑一遍:AgentsRoom 会在同一个项目里为每个模型各启动一个代理,并排运行。

在 Claude Code 之外,哪里还能用 Claude Opus?

目前,Opus 也出现在 Antigravity、OpenCode、Aider、GitHub Copilot、oh-my-pi和Devin 的模型列表里,名字由各个 CLI 自己起。同一系列,同一档位:对照关系不会因为提供它的 CLI 不同而改变。

为什么表格把 Kimi、GLM 或 Qwen 最高只定在 Sonnet 级?

因为这把尺子按模型扮演的角色来定,而且从不夸大。开放权重的系列往往性价比很高,也有好几个 CLI 提供它们,但把其中一个放进 Opus 级,就等于告诉你它能在任何任务上替代 Opus,而目前还没有哪一个全面证明过这一点。它们的轻量版属于 Haiku 级。

为什么 Auto 和 Default 没有对应模型?

因为它们不是模型:GitHub Copilot(Auto)、Amp(Amp default)、Freebuff(Freebuff default)、Devin(Adaptive)和Cursor(Default) 都让服务在每次请求时自己挑模型,所以没有固定的能力可比。表格宁可把它们排除在外,也不去猜。

这张表有多新?

每次打开页面时都会重新计算,数据来自 AgentsRoom 应用提供给每台电脑和手机的同一份模型目录。AgentsRoom 一旦加入某个 CLI 新发布的模型,它就会立即以其档位出现在这里,被它取代的版本则标为旧版本。热度火焰图标每十分钟根据过去 30 天的启动数据刷新一次。

AgentsRoom 能为我的任务挑选合适的模型吗?

可以,有两种方式,而且都只是建议。AI Suggestion 在会话打开之前评估任务的规模(轻量、标准、复杂或极难),然后用该 CLI 中仍能胜任的最便宜模型打开代理。Adaptive Mode 在 CLI 运行后读取你的草稿,任务用不着旗舰时就建议换个更轻的模型,或者告诉你当前的模型正合适。

在 AgentsRoom 中

AgentsRoom 直接在模型选择器里给出答案

AgentsRoom 是面向 AI 编程代理的桌面指挥中心。Claude、Codex、GitHub Copilot CLI、Cursor 以及另外 10 个代理 CLI 并排运行,每个代理都跑在你选的模型上。本页的对照关系,就是你在应用里选模型时看到的那些;另外还有几项智能功能,帮你按任务选对模型。

每个模型下方的 ≈ Opus

每个模型列表(新建代理、快捷代理、待办工单、移动应用)都会给每个模型打上标签,写出它在你最熟悉的 CLI 中的对应模型,并可按能力、价格或热度排序。

应用内的模型对照

让任务来挑模型

AI Suggestion 把一句话的描述转成一个复杂度级别(轻量、标准、复杂、极难),并用够用的最便宜模型打开代理。Adaptive Mode 会检查你的草稿,在旗舰大材小用时建议换个更轻的模型。

AI Suggestion 与 Adaptive Mode

切到对应的模型

当某个账号接近上限时,配额规则可以按模型逐一把新代理放到另一个 CLI 上启动:Fable、Opus 和 Sonnet 各自转到同一档位的对应模型,这些对应关系已按本页的档位预先填好。

配额规则与用量提醒

每个工单用对模型

在待办工单上固定供应商、模型和推理强度,执行它的代理就会严格照此运行;旗舰模型则留给真正需要它的工单。

待办任务看板

把测试交给更便宜的模型

跑在旗舰模型上的开发代理通过 MCP 把测试交给跑在更轻模型上的 QA 代理,贵的模型就能一直专注在代码上。

代理委派

每一步一个模型

在代理团队里,每一步都有自己的角色、CLI 和模型:架构师用前沿模型,实现者用 Opus 级,审查者放在最划算的地方。

代理团队
下载 AgentsRoom

延伸阅读