Mô hình AI tương đương

Mô hình AI tương đương: Opus, Sonnet và Haiku của mọi CLI lập trình

Bạn thuộc lòng dải mô hình Claude, rồi bạn mở Codex, Gemini hay Grok và chẳng cái tên nào cho biết mô hình nào đóng vai Opus. Trang này đặt mọi mô hình của mọi CLI agent lập trình mà AgentsRoom điều khiển lên cùng một thang đo, để mỗi mô hình đều đọc được bằng những thuật ngữ bạn đã quen.

Đọc trực tiếp từ danh mục mô hình của AgentsRoom. Độ phổ biến tính đến 16:16 6 thg 10, 2026.

CLI được so sánh

12

Mô hình đã xếp mức

94

Lượt khởi chạy được tính, 30 ngày qua

51.051

Câu trả lời ngắn gọn

Claude được dùng làm thước đo vì đó là dải mô hình mà phần lớn lập trình viên đều biết. Mỗi mục nêu tên các mô hình của những hãng khác đang đóng cùng vai trò hiện nay.

Mức Fable

Mô hình tương đương mức Fable (tiên phong)

Các mô hình tiên phong, cao hơn Opus một bậc: GPT-6 Astra trên Codex, Daybreak Blue trên Codex và GPT-5.6 Sol Max trên Codex.

Dành cho những bài toán khó nhất, với giá cao nhất.

Mức Opus

Mô hình tương đương Opus

Các mô hình đóng vai Claude Opus: GPT-6.1 Sol trên Codex, Gemini 3.1 Pro (High) trên Antigravity và Grok 4.7 trên Grok.

Mô hình flagship gánh phần lớn công việc lập trình nghiêm túc.

Mức Sonnet

Mô hình tương đương Sonnet

Các mô hình đóng vai Claude Sonnet: GPT-6 Luna trên Codex, GPT-5.6 Terra trên Codex, Gemini 3.8 Flash (High) trên Antigravity, GLM 5.3 trên OpenCode, Qwen3.8 Max trên OpenCode, DeepSeek trên Aider, Medium 3.5 trên Mistral Vibe và Kimi K3 trên Kimi.

Cân bằng: đủ mạnh cho phần lớn tính năng, rẻ hơn mô hình flagship.

Mức Haiku

Mô hình tương đương Haiku

Các mô hình đóng vai Claude Haiku: Codex Spark trên Codex, Qwen3 Coder trên Ollama, GLM 4.6 trên Ollama và DeepSeek V4 Flash trên oh-my-pi.

Nhẹ và nhanh: đổi tên, sửa lỗi nhỏ, tóm tắt.

Mọi CLI lập trình, theo từng mức

Mỗi hàng là một CLI mà AgentsRoom điều khiển, mỗi cột là một mức. Các mô hình hiện hành đứng trước; những phiên bản cũ mà danh sách vẫn còn cung cấp được tính ở bên dưới.

Mô hình AI tương đương theo CLI agent lập trình và mức năng lực
CLITiên phongMức FableMức OpusMức SonnetMức Haiku
Claude
Fable
OpusOpus 5.5
+2 phiên bản cũ

Opus 5, Opus 4.8

SonnetSonnet 5.5
+1 phiên bản cũ

Sonnet 5

Haiku
Codex
GPT-6 AstraDaybreak BlueDaybreak RedGPT-5.6 Sol Max
GPT-6.1 Sol
+3 phiên bản cũ

GPT-6 Sol, GPT-5.6 Sol, GPT-5.5

GPT-6 LunaGPT-5.6 Terra
+4 phiên bản cũ

GPT-5.6 Luna, GPT-5, GPT-5.4, GPT-5.2

Codex Spark
+1 phiên bản cũ

GPT-5.4 Mini

AntigravityKhông có
Gemini 3.1 Pro (High)Claude Opus 5.5 (High)Claude Opus 5.5 (Medium)
Gemini 3.8 Flash (High)Gemini 3.8 Flash (Medium)Claude Sonnet 5.5 (High)Claude Sonnet 5.5 (Medium)
+5 phiên bản cũ

Gemini 3.7 Flash (High), Gemini 3.7 Flash (Medium), Gemini 3.6 Flash (High), Gemini 3.6 Flash (Medium), Gemini 3.5 Flash (Medium)

Không có
OpenCodeKhông có
Claude Opus
Claude SonnetGPT-5Kimi K3GLM 5.3Qwen3.8 Max
Không có
AiderKhông có
Claude Opus
Claude SonnetDeepSeek
GPT-4o
GrokKhông có
Grok 4.7
Không cóKhông có
Mistral VibeKhông cóKhông có
Medium 3.5
Không có
OllamaKhông cóKhông có
Qwen3 Coder 480B
Gemma 3Qwen3 CoderGLM 4.6
GitHub Copilot
GPT-6 Astra
GPT-6.1 SolClaude Opus 5.5GPT-5.5
+5 phiên bản cũ

GPT-6 Sol, Claude Opus 5, GPT-5.6 Sol, Claude Opus 4.8, Claude Opus 4.7

Claude Sonnet 5.5GPT-6 LunaGPT-5.6 TerraGemini 3.7 FlashKimi K3
+4 phiên bản cũ

Claude Sonnet 5, GPT-5.6 Luna, Claude Sonnet 4.6, Gemini 3.6 Flash

Claude Haiku 4.5MAI-Code-1.1-Flash
KimiKhông cóKhông có
Kimi K3Kimi K3-256KKimi K2.8 PreviewK2.7 Code HighSpeed
Không có
oh-my-piKhông có
Claude Opus 5.5GPT-6 Sol
Claude Sonnet 5Gemini FlashGLM 5.3
+1 phiên bản cũ

GLM 5.2

DeepSeek V4 Flash
DevinKhông có
Claude OpusGPTCodexGemini
SWEClaude SonnetGLMKimiDeepSeek
Claude Haiku
AmpTự chọn mô hình cho bạn ở mỗi yêu cầu: không có mức cố định.
FreebuffTự chọn mô hình cho bạn ở mỗi yêu cầu: không có mức cố định.
CursorTự chọn mô hình cho bạn ở mỗi yêu cầu: không có mức cố định.
  • Thuộc ba mô hình của CLI đó được cộng đồng khởi chạy nhiều nhất
  • Phiên bản cũ: danh sách có một thế hệ mới hơn của cùng mô hình

Cùng mô hình, nhiều CLI

Một dòng mô hình không bị gắn chặt với công cụ của hãng làm ra nó. Đây là mọi dòng mô hình hiện có mặt trên hơn một CLI, kèm tên mà mỗi CLI đặt cho nó.

Claude Opus

Mức Opus

7 CLI

  • ClaudeOpus 5.5
  • AntigravityClaude Opus 5.5 (High)
  • OpenCodeClaude Opus
  • AiderClaude Opus
  • GitHub CopilotClaude Opus 5.5
  • oh-my-piClaude Opus 5.5
  • DevinClaude Opus

Claude Sonnet

Mức Sonnet

7 CLI

  • ClaudeSonnet 5.5
  • AntigravityClaude Sonnet 5.5 (High)
  • OpenCodeClaude Sonnet
  • AiderClaude Sonnet
  • GitHub CopilotClaude Sonnet 5.5
  • oh-my-piClaude Sonnet 5
  • DevinClaude Sonnet

Kimi

Mức Sonnet

4 CLI

  • KimiKimi K3
  • OpenCodeKimi K3
  • GitHub CopilotKimi K3
  • DevinKimi

GLM

Mức Sonnet

4 CLI

  • OpenCodeGLM 5.3
  • OllamaGLM 4.6
  • oh-my-piGLM 5.3
  • DevinGLM

Claude Haiku

Mức Haiku

3 CLI

  • ClaudeHaiku
  • GitHub CopilotClaude Haiku 4.5
  • DevinClaude Haiku

GPT Sol

Mức Opus

3 CLI

  • CodexGPT-6.1 Sol
  • GitHub CopilotGPT-6.1 Sol
  • oh-my-piGPT-6 Sol

Gemini Flash

Mức Sonnet

3 CLI

  • AntigravityGemini 3.8 Flash (High)
  • GitHub CopilotGemini 3.7 Flash
  • oh-my-piGemini Flash

DeepSeek

Mức Sonnet

3 CLI

  • AiderDeepSeek
  • oh-my-piDeepSeek V4 Flash
  • DevinDeepSeek

GPT Astra

Mức Fable

2 CLI

  • CodexGPT-6 Astra
  • GitHub CopilotGPT-6 Astra

GPT Luna

Mức Sonnet

2 CLI

  • CodexGPT-6 Luna
  • GitHub CopilotGPT-6 Luna

GPT Terra

Mức Sonnet

2 CLI

  • CodexGPT-5.6 Terra
  • GitHub CopilotGPT-5.6 Terra

Qwen

Mức Sonnet

2 CLI

  • OpenCodeQwen3.8 Max
  • OllamaQwen3 Coder

Những gì lập trình viên thực sự khởi chạy

Những mô hình được người dùng AgentsRoom khởi chạy nhiều nhất trong 30 ngày qua, đọc theo mức. Sự tương đương cho biết mô hình nào đóng cùng vai trò; lượt khởi chạy cho biết mọi người chọn mô hình nào.

  1. 1

    OpusMức Opus

    Claude439 thành viên

    22,9% lượt khởi chạy

  2. 2

    SonnetMức Sonnet

    Claude173 thành viên

    12,8% lượt khởi chạy

  3. 3

    Opus 5.5Mức Opus

    Claude103 thành viên

    9,4% lượt khởi chạy

  4. 4

    GPT-5.6 SolMức Opus

    Codex119 thành viên

    5% lượt khởi chạy

  5. 5

    GPT-6 LunaMức Sonnet

    Codex47 thành viên

    4,9% lượt khởi chạy

Thống kê sử dụng đầy đủ, theo CLI và theo mô hình

Các mức được xếp như thế nào

Một thang đo với bốn mức, lấy Claude làm mốc: mức Fable (tiên phong), mức Opus (flagship), mức Sonnet (cân bằng) và mức Haiku (nhẹ). Mỗi dòng mô hình nhận mức ứng với vai trò mà hãng của nó giao cho nó trong dải mô hình của chính hãng, và cùng một dòng giữ nguyên mức đó trên mọi CLI cung cấp nó.

Ở OpenAI, Astra là mô hình tiên phong, Sol là mô hình flagship, Luna và Terra là các mô hình cân bằng, Spark và các mô hình mini là các mô hình nhẹ. Gemini Pro thuộc mức Opus và Gemini Flash thuộc mức Sonnet. Grok Heavy là mô hình tiên phong, còn bản thân Grok thuộc mức Opus.

Các dòng mô hình trọng số mở (Kimi, GLM, DeepSeek, Qwen và các dòng khác) được xếp cao nhất ở mức Sonnet, còn các bản nhẹ của chúng ở mức Haiku. Khi phân vân giữa hai mức, bảng luôn chọn mức thấp hơn: bảng thà đánh giá thấp một mô hình còn hơn nói với bạn rằng nó thay được Opus khi nó chưa chứng minh điều đó.

Các bộ định tuyến không có mức, vì chúng chọn mô hình ở mỗi yêu cầu: GitHub Copilot (Auto), Amp (Amp default), Freebuff (Freebuff default), Devin (Adaptive) và Cursor (Default). Một dòng mô hình mà bảng chưa biết cũng vậy: không có tương đương còn hơn một tương đương sai.

Mức không phải là điểm benchmark. Hai mô hình cùng mức vẫn khác nhau về giá, tốc độ, cửa sổ ngữ cảnh, giới hạn sử dụng và những tác vụ chúng làm tốt nhất. Hãy dùng bảng để biết nên tìm ở đâu, rồi thử cả hai trên chính tác vụ của bạn.

Dữ liệu: danh mục mô hình mà AgentsRoom cung cấp cho ứng dụng desktop và di động của mình, được đọc ở mỗi lượt truy cập, cùng các quy tắc xếp mức mà ứng dụng áp dụng dưới mọi danh sách mô hình. Độ phổ biến: các lượt khởi chạy agent thực tế của những người dùng AgentsRoom có chia sẻ dữ liệu sử dụng, trong 30 ngày qua, làm mới mỗi mười phút.

Câu hỏi thường gặp

Mô hình Codex nào tương đương với Claude Opus?

Đó là GPT-6.1 Sol. Trong bảng phía trên, Claude Opus và GPT-6.1 Sol cùng thuộc mức Opus: mô hình flagship gánh phần lớn công việc lập trình nghiêm túc, thấp hơn mức tiên phong một bậc. Mô hình tiên phong của Codex, tương đương với Fable, là GPT-6 Astra. Với công việc ở mức Sonnet, mô hình Codex là GPT-6 Luna. Còn mô hình mức Haiku trong danh sách là Codex Spark.

Mô hình Gemini nào tương đương với Claude Opus?

Đó là Gemini 3.1 Pro (High), trên Antigravity. Gemini Pro là dòng flagship của Google, nên nó thuộc mức Opus. Gemini Flash đóng vai Sonnet: hiện nay là Gemini 3.8 Flash (High).

Mô hình GPT nào tương đương với Claude Sonnet?

Đó là GPT-6 Luna, trên Codex. Dòng cân bằng của OpenAI thuộc mức Sonnet: đủ mạnh cho phần lớn tính năng, rẻ hơn mô hình flagship.

Mô hình nào của OpenAI tương đương với Claude Haiku?

Đó là Codex Spark, trên Codex: mô hình nhẹ và nhanh trong dải mô hình, cho việc đổi tên, sửa lỗi nhỏ và các câu hỏi nhanh.

GPT-6.1 Sol có tốt bằng Opus 5.5 không?

Cùng mức không có nghĩa là cùng kết quả. GPT-6.1 Sol và Opus 5.5 đóng cùng một vai trò trong dải mô hình của hãng mình, nhưng vẫn khác nhau về giá, tốc độ, cửa sổ ngữ cảnh, giới hạn sử dụng và những tác vụ chúng xử lý tốt nhất, và thứ hạng benchmark giữa hai mô hình thay đổi sau mỗi lần phát hành. Câu trả lời đáng tin cậy là chạy cả hai trên cùng một tác vụ của bạn: AgentsRoom khởi chạy một agent trên mỗi mô hình, cạnh nhau, trong cùng một dự án.

Có thể dùng Claude Opus ở đâu ngoài Claude Code?

Hiện nay, Opus cũng có trong danh sách mô hình của Antigravity, OpenCode, Aider, GitHub Copilot, oh-my-pi và Devin, dưới cái tên mà mỗi CLI đặt cho nó. Cùng dòng, cùng mức: sự tương đương không thay đổi theo CLI cung cấp nó.

Vì sao bảng giới hạn Kimi, GLM hay Qwen ở mức Sonnet?

Vì thang đo đi theo vai trò mà một mô hình đảm nhận, và không bao giờ thổi phồng. Các dòng mô hình trọng số mở thường rất đáng đồng tiền và nhiều CLI cung cấp chúng, nhưng xếp một dòng vào mức Opus đồng nghĩa với việc nói rằng nó thay được Opus ở mọi tác vụ, điều mà chưa dòng nào chứng minh được trên mọi mặt. Các bản nhẹ của chúng thuộc mức Haiku.

Vì sao Auto và Default không có mô hình tương đương?

Vì chúng không phải là một mô hình: GitHub Copilot (Auto), Amp (Amp default), Freebuff (Freebuff default), Devin (Adaptive) và Cursor (Default) để dịch vụ tự chọn mô hình ở mỗi yêu cầu, nên không có năng lực cố định nào để so sánh. Bảng bỏ chúng ra thay vì đoán.

Bảng này được cập nhật bao lâu một lần?

Bảng được tính lại mỗi khi trang được mở, từ chính danh mục mô hình mà ứng dụng AgentsRoom cung cấp cho mọi máy desktop và điện thoại. Khi AgentsRoom thêm một mô hình mà một CLI vừa phát hành, mô hình đó xuất hiện ở đây ngay lập tức, đúng mức của nó, và phiên bản bị thay thế được đánh dấu là cũ. Các biểu tượng ngọn lửa phổ biến được làm mới mỗi mười phút từ các lượt khởi chạy trong 30 ngày qua.

AgentsRoom có thể chọn đúng mô hình cho tác vụ của tôi không?

Có, theo hai cách, và cả hai đều chỉ gợi ý. AI Suggestion ước lượng tác vụ trước khi phiên mở ra (Nhanh, Tiêu chuẩn, Phức tạp hoặc Cực khó) và mở agent trên mô hình rẻ nhất của CLI đó mà vẫn làm được việc. Adaptive Mode đọc bản nháp của bạn khi CLI đã chạy và gợi ý một mô hình nhẹ hơn khi tác vụ không cần đến flagship, hoặc cho bạn biết mô hình hiện tại là phù hợp.

Trong AgentsRoom

AgentsRoom trả lời câu hỏi này ngay trong bộ chọn mô hình của bạn

AgentsRoom là trung tâm điều khiển trên desktop dành cho các agent coding AI. Claude, Codex, GitHub Copilot CLI, Cursor và 10 CLI agent khác chạy song song, mỗi agent trên mô hình bạn chọn. Các mối tương đương trên trang này chính là những gì ứng dụng hiển thị khi bạn chọn, và một vài tính năng thông minh giúp bạn chọn cỡ mô hình vừa với tác vụ.

≈ Opus dưới mỗi mô hình

Mọi danh sách mô hình (agent mới, khởi chạy nhanh, ticket backlog, ứng dụng di động) gắn cho mỗi mô hình một nhãn ghi mô hình tương đương trong CLI bạn rành nhất, và sắp xếp được theo sức mạnh, giá hoặc độ phổ biến.

Mô hình tương đương trong ứng dụng

Để tác vụ tự chọn mô hình

AI Suggestion biến một mô tả dài một dòng thành một mức độ phức tạp (Nhanh, Tiêu chuẩn, Phức tạp, Cực khó) và mở agent trên mô hình rẻ nhất phù hợp. Adaptive Mode xem bản nháp của bạn và gợi ý một mô hình nhẹ hơn khi dùng flagship là thừa.

AI Suggestion và Adaptive Mode

Chuyển sang mô hình tương đương

Khi một tài khoản sắp chạm giới hạn, một quy tắc hạn mức có thể khởi chạy các agent mới trên một CLI khác theo từng mô hình: Fable, Opus và Sonnet đều chuyển sang mô hình tương đương cùng mức của mình, được điền sẵn từ các mức này.

Quy tắc hạn mức và cảnh báo mức sử dụng

Đúng mô hình cho từng ticket

Ghim nhà cung cấp, mô hình và mức suy luận trên một ticket backlog, để agent chạy ticket đó dùng đúng như vậy, và giữ flagship cho những ticket thực sự cần.

Bảng nhiệm vụ Backlog

Giao việc chạy test cho mô hình rẻ hơn

Một agent developer trên mô hình flagship giao việc chạy test cho một agent QA trên mô hình nhẹ hơn qua MCP, nhờ đó mô hình đắt tiền vẫn tập trung vào code.

Ủy quyền agent

Mỗi bước một mô hình

Trong một đội agent, mỗi bước có vai trò, CLI và mô hình riêng: Architect trên một mô hình tiên phong, phần triển khai ở mức Opus, phần review ở mức nào đáng tiền nhất.

Đội ngũ agent
Tải AgentsRoom

Tìm hiểu thêm