Mức Fable
Mô hình tương đương mức Fable (tiên phong)
Các mô hình tiên phong, cao hơn Opus một bậc: GPT-6 Astra trên Codex, Daybreak Blue trên Codex và GPT-5.6 Sol Max trên Codex.
Dành cho những bài toán khó nhất, với giá cao nhất.
Mô hình AI tương đương
Bạn thuộc lòng dải mô hình Claude, rồi bạn mở Codex, Gemini hay Grok và chẳng cái tên nào cho biết mô hình nào đóng vai Opus. Trang này đặt mọi mô hình của mọi CLI agent lập trình mà AgentsRoom điều khiển lên cùng một thang đo, để mỗi mô hình đều đọc được bằng những thuật ngữ bạn đã quen.
Đọc trực tiếp từ danh mục mô hình của AgentsRoom. Độ phổ biến tính đến 16:16 6 thg 10, 2026.
CLI được so sánh
12
Mô hình đã xếp mức
94
Lượt khởi chạy được tính, 30 ngày qua
51.051
Claude được dùng làm thước đo vì đó là dải mô hình mà phần lớn lập trình viên đều biết. Mỗi mục nêu tên các mô hình của những hãng khác đang đóng cùng vai trò hiện nay.
Mức Fable
Các mô hình tiên phong, cao hơn Opus một bậc: GPT-6 Astra trên Codex, Daybreak Blue trên Codex và GPT-5.6 Sol Max trên Codex.
Dành cho những bài toán khó nhất, với giá cao nhất.
Mức Opus
Các mô hình đóng vai Claude Opus: GPT-6.1 Sol trên Codex, Gemini 3.1 Pro (High) trên Antigravity và Grok 4.7 trên Grok.
Mô hình flagship gánh phần lớn công việc lập trình nghiêm túc.
Mức Sonnet
Các mô hình đóng vai Claude Sonnet: GPT-6 Luna trên Codex, GPT-5.6 Terra trên Codex, Gemini 3.8 Flash (High) trên Antigravity, GLM 5.3 trên OpenCode, Qwen3.8 Max trên OpenCode, DeepSeek trên Aider, Medium 3.5 trên Mistral Vibe và Kimi K3 trên Kimi.
Cân bằng: đủ mạnh cho phần lớn tính năng, rẻ hơn mô hình flagship.
Mức Haiku
Các mô hình đóng vai Claude Haiku: Codex Spark trên Codex, Qwen3 Coder trên Ollama, GLM 4.6 trên Ollama và DeepSeek V4 Flash trên oh-my-pi.
Nhẹ và nhanh: đổi tên, sửa lỗi nhỏ, tóm tắt.
Mỗi hàng là một CLI mà AgentsRoom điều khiển, mỗi cột là một mức. Các mô hình hiện hành đứng trước; những phiên bản cũ mà danh sách vẫn còn cung cấp được tính ở bên dưới.
| CLI | Tiên phongMức Fable | Mức Opus | Mức Sonnet | Mức Haiku |
|---|---|---|---|---|
Fable | OpusOpus 5.5 +2 phiên bản cũOpus 5, Opus 4.8 | SonnetSonnet 5.5 +1 phiên bản cũSonnet 5 | Haiku | |
GPT-6 AstraDaybreak BlueDaybreak RedGPT-5.6 Sol Max | GPT-6.1 Sol +3 phiên bản cũGPT-6 Sol, GPT-5.6 Sol, GPT-5.5 | GPT-6 LunaGPT-5.6 Terra +4 phiên bản cũGPT-5.6 Luna, GPT-5, GPT-5.4, GPT-5.2 | Codex Spark +1 phiên bản cũGPT-5.4 Mini | |
| Không có | Gemini 3.1 Pro (High)Claude Opus 5.5 (High)Claude Opus 5.5 (Medium) | Gemini 3.8 Flash (High)Gemini 3.8 Flash (Medium)Claude Sonnet 5.5 (High)Claude Sonnet 5.5 (Medium) +5 phiên bản cũGemini 3.7 Flash (High), Gemini 3.7 Flash (Medium), Gemini 3.6 Flash (High), Gemini 3.6 Flash (Medium), Gemini 3.5 Flash (Medium) | Không có | |
| Không có | Claude Opus | Claude SonnetGPT-5Kimi K3GLM 5.3Qwen3.8 Max | Không có | |
| Không có | Claude Opus | Claude SonnetDeepSeek | GPT-4o | |
| Không có | Grok 4.7 | Không có | Không có | |
| Không có | Không có | Medium 3.5 | Không có | |
| Không có | Không có | Qwen3 Coder 480B | Gemma 3Qwen3 CoderGLM 4.6 | |
GPT-6 Astra | GPT-6.1 SolClaude Opus 5.5GPT-5.5 +5 phiên bản cũGPT-6 Sol, Claude Opus 5, GPT-5.6 Sol, Claude Opus 4.8, Claude Opus 4.7 | Claude Sonnet 5.5GPT-6 LunaGPT-5.6 TerraGemini 3.7 FlashKimi K3 +4 phiên bản cũClaude Sonnet 5, GPT-5.6 Luna, Claude Sonnet 4.6, Gemini 3.6 Flash | Claude Haiku 4.5MAI-Code-1.1-Flash | |
| Không có | Không có | Kimi K3Kimi K3-256KKimi K2.8 PreviewK2.7 Code HighSpeed | Không có | |
| Không có | Claude Opus 5.5GPT-6 Sol | Claude Sonnet 5Gemini FlashGLM 5.3 +1 phiên bản cũGLM 5.2 | DeepSeek V4 Flash | |
| Không có | Claude OpusGPTCodexGemini | SWEClaude SonnetGLMKimiDeepSeek | Claude Haiku | |
| Tự chọn mô hình cho bạn ở mỗi yêu cầu: không có mức cố định. | ||||
| Tự chọn mô hình cho bạn ở mỗi yêu cầu: không có mức cố định. | ||||
| Tự chọn mô hình cho bạn ở mỗi yêu cầu: không có mức cố định. | ||||
Một dòng mô hình không bị gắn chặt với công cụ của hãng làm ra nó. Đây là mọi dòng mô hình hiện có mặt trên hơn một CLI, kèm tên mà mỗi CLI đặt cho nó.
7 CLI
7 CLI
4 CLI
4 CLI
3 CLI
3 CLI
3 CLI
3 CLI
2 CLI
2 CLI
2 CLI
2 CLI
Những mô hình được người dùng AgentsRoom khởi chạy nhiều nhất trong 30 ngày qua, đọc theo mức. Sự tương đương cho biết mô hình nào đóng cùng vai trò; lượt khởi chạy cho biết mọi người chọn mô hình nào.
OpusMức Opus
22,9% lượt khởi chạy
SonnetMức Sonnet
12,8% lượt khởi chạy
Opus 5.5Mức Opus
9,4% lượt khởi chạy
GPT-5.6 SolMức Opus
5% lượt khởi chạy
GPT-6 LunaMức Sonnet
4,9% lượt khởi chạy
Một thang đo với bốn mức, lấy Claude làm mốc: mức Fable (tiên phong), mức Opus (flagship), mức Sonnet (cân bằng) và mức Haiku (nhẹ). Mỗi dòng mô hình nhận mức ứng với vai trò mà hãng của nó giao cho nó trong dải mô hình của chính hãng, và cùng một dòng giữ nguyên mức đó trên mọi CLI cung cấp nó.
Ở OpenAI, Astra là mô hình tiên phong, Sol là mô hình flagship, Luna và Terra là các mô hình cân bằng, Spark và các mô hình mini là các mô hình nhẹ. Gemini Pro thuộc mức Opus và Gemini Flash thuộc mức Sonnet. Grok Heavy là mô hình tiên phong, còn bản thân Grok thuộc mức Opus.
Các dòng mô hình trọng số mở (Kimi, GLM, DeepSeek, Qwen và các dòng khác) được xếp cao nhất ở mức Sonnet, còn các bản nhẹ của chúng ở mức Haiku. Khi phân vân giữa hai mức, bảng luôn chọn mức thấp hơn: bảng thà đánh giá thấp một mô hình còn hơn nói với bạn rằng nó thay được Opus khi nó chưa chứng minh điều đó.
Các bộ định tuyến không có mức, vì chúng chọn mô hình ở mỗi yêu cầu: GitHub Copilot (Auto), Amp (Amp default), Freebuff (Freebuff default), Devin (Adaptive) và Cursor (Default). Một dòng mô hình mà bảng chưa biết cũng vậy: không có tương đương còn hơn một tương đương sai.
Mức không phải là điểm benchmark. Hai mô hình cùng mức vẫn khác nhau về giá, tốc độ, cửa sổ ngữ cảnh, giới hạn sử dụng và những tác vụ chúng làm tốt nhất. Hãy dùng bảng để biết nên tìm ở đâu, rồi thử cả hai trên chính tác vụ của bạn.
Dữ liệu: danh mục mô hình mà AgentsRoom cung cấp cho ứng dụng desktop và di động của mình, được đọc ở mỗi lượt truy cập, cùng các quy tắc xếp mức mà ứng dụng áp dụng dưới mọi danh sách mô hình. Độ phổ biến: các lượt khởi chạy agent thực tế của những người dùng AgentsRoom có chia sẻ dữ liệu sử dụng, trong 30 ngày qua, làm mới mỗi mười phút.
Đó là GPT-6.1 Sol. Trong bảng phía trên, Claude Opus và GPT-6.1 Sol cùng thuộc mức Opus: mô hình flagship gánh phần lớn công việc lập trình nghiêm túc, thấp hơn mức tiên phong một bậc. Mô hình tiên phong của Codex, tương đương với Fable, là GPT-6 Astra. Với công việc ở mức Sonnet, mô hình Codex là GPT-6 Luna. Còn mô hình mức Haiku trong danh sách là Codex Spark.
Đó là Gemini 3.1 Pro (High), trên Antigravity. Gemini Pro là dòng flagship của Google, nên nó thuộc mức Opus. Gemini Flash đóng vai Sonnet: hiện nay là Gemini 3.8 Flash (High).
Đó là GPT-6 Luna, trên Codex. Dòng cân bằng của OpenAI thuộc mức Sonnet: đủ mạnh cho phần lớn tính năng, rẻ hơn mô hình flagship.
Đó là Codex Spark, trên Codex: mô hình nhẹ và nhanh trong dải mô hình, cho việc đổi tên, sửa lỗi nhỏ và các câu hỏi nhanh.
Cùng mức không có nghĩa là cùng kết quả. GPT-6.1 Sol và Opus 5.5 đóng cùng một vai trò trong dải mô hình của hãng mình, nhưng vẫn khác nhau về giá, tốc độ, cửa sổ ngữ cảnh, giới hạn sử dụng và những tác vụ chúng xử lý tốt nhất, và thứ hạng benchmark giữa hai mô hình thay đổi sau mỗi lần phát hành. Câu trả lời đáng tin cậy là chạy cả hai trên cùng một tác vụ của bạn: AgentsRoom khởi chạy một agent trên mỗi mô hình, cạnh nhau, trong cùng một dự án.
Hiện nay, Opus cũng có trong danh sách mô hình của Antigravity, OpenCode, Aider, GitHub Copilot, oh-my-pi và Devin, dưới cái tên mà mỗi CLI đặt cho nó. Cùng dòng, cùng mức: sự tương đương không thay đổi theo CLI cung cấp nó.
Vì thang đo đi theo vai trò mà một mô hình đảm nhận, và không bao giờ thổi phồng. Các dòng mô hình trọng số mở thường rất đáng đồng tiền và nhiều CLI cung cấp chúng, nhưng xếp một dòng vào mức Opus đồng nghĩa với việc nói rằng nó thay được Opus ở mọi tác vụ, điều mà chưa dòng nào chứng minh được trên mọi mặt. Các bản nhẹ của chúng thuộc mức Haiku.
Vì chúng không phải là một mô hình: GitHub Copilot (Auto), Amp (Amp default), Freebuff (Freebuff default), Devin (Adaptive) và Cursor (Default) để dịch vụ tự chọn mô hình ở mỗi yêu cầu, nên không có năng lực cố định nào để so sánh. Bảng bỏ chúng ra thay vì đoán.
Bảng được tính lại mỗi khi trang được mở, từ chính danh mục mô hình mà ứng dụng AgentsRoom cung cấp cho mọi máy desktop và điện thoại. Khi AgentsRoom thêm một mô hình mà một CLI vừa phát hành, mô hình đó xuất hiện ở đây ngay lập tức, đúng mức của nó, và phiên bản bị thay thế được đánh dấu là cũ. Các biểu tượng ngọn lửa phổ biến được làm mới mỗi mười phút từ các lượt khởi chạy trong 30 ngày qua.
Có, theo hai cách, và cả hai đều chỉ gợi ý. AI Suggestion ước lượng tác vụ trước khi phiên mở ra (Nhanh, Tiêu chuẩn, Phức tạp hoặc Cực khó) và mở agent trên mô hình rẻ nhất của CLI đó mà vẫn làm được việc. Adaptive Mode đọc bản nháp của bạn khi CLI đã chạy và gợi ý một mô hình nhẹ hơn khi tác vụ không cần đến flagship, hoặc cho bạn biết mô hình hiện tại là phù hợp.
Trong AgentsRoom
AgentsRoom là trung tâm điều khiển trên desktop dành cho các agent coding AI. Claude, Codex, GitHub Copilot CLI, Cursor và 10 CLI agent khác chạy song song, mỗi agent trên mô hình bạn chọn. Các mối tương đương trên trang này chính là những gì ứng dụng hiển thị khi bạn chọn, và một vài tính năng thông minh giúp bạn chọn cỡ mô hình vừa với tác vụ.
Mọi danh sách mô hình (agent mới, khởi chạy nhanh, ticket backlog, ứng dụng di động) gắn cho mỗi mô hình một nhãn ghi mô hình tương đương trong CLI bạn rành nhất, và sắp xếp được theo sức mạnh, giá hoặc độ phổ biến.
Mô hình tương đương trong ứng dụngAI Suggestion biến một mô tả dài một dòng thành một mức độ phức tạp (Nhanh, Tiêu chuẩn, Phức tạp, Cực khó) và mở agent trên mô hình rẻ nhất phù hợp. Adaptive Mode xem bản nháp của bạn và gợi ý một mô hình nhẹ hơn khi dùng flagship là thừa.
AI Suggestion và Adaptive ModeKhi một tài khoản sắp chạm giới hạn, một quy tắc hạn mức có thể khởi chạy các agent mới trên một CLI khác theo từng mô hình: Fable, Opus và Sonnet đều chuyển sang mô hình tương đương cùng mức của mình, được điền sẵn từ các mức này.
Quy tắc hạn mức và cảnh báo mức sử dụngGhim nhà cung cấp, mô hình và mức suy luận trên một ticket backlog, để agent chạy ticket đó dùng đúng như vậy, và giữ flagship cho những ticket thực sự cần.
Bảng nhiệm vụ BacklogMột agent developer trên mô hình flagship giao việc chạy test cho một agent QA trên mô hình nhẹ hơn qua MCP, nhờ đó mô hình đắt tiền vẫn tập trung vào code.
Ủy quyền agentTrong một đội agent, mỗi bước có vai trò, CLI và mô hình riêng: Architect trên một mô hình tiên phong, phần triển khai ở mức Opus, phần review ở mức nào đáng tiền nhất.
Đội ngũ agentSo sánh thẳng thắn giữa Claude Code và Codex CLI: giá, tốc độ, MCP, khả năng kiểm soát. Và vì sao sau vài tuần, tôi ngừng phải chọn giữa hai cái.
Ollama giờ là một nhà cung cấp trong AgentsRoom. Chạy các model mã nguồn mở cục bộ như Llama, Qwen, Gemma và DeepSeek ngay cạnh các agent cloud, với một núm gạt cục bộ hay cloud trên từng agent, đổi được ngay giữa cuộc hội thoại.