ระดับ Fable
โมเดลที่เทียบเท่าระดับ Fable (แนวหน้า)
โมเดลแนวหน้า สูงกว่า Opus หนึ่งขั้น: GPT-6 Astra ใน Codex Daybreak Blue ใน Codex และGPT-5.6 Sol Max ใน Codex
สำหรับปัญหาที่ยากที่สุด ในราคาที่สูงที่สุด
โมเดล AI ที่เทียบเท่ากัน
คุณจำรุ่นต่าง ๆ ของ Claude ได้ขึ้นใจ แต่พอเปิด Codex, Gemini หรือ Grok ก็ไม่มีชื่อไหนบอกเลยว่าโมเดลตัวไหนทำหน้าที่แบบ Opus หน้านี้จัดวางทุกโมเดลของทุก CLI เอเจนต์เขียนโค้ดที่ AgentsRoom รองรับไว้บนมาตรวัดเดียว เพื่อให้คุณอ่านแต่ละตัวได้ด้วยคำที่คุณรู้จักอยู่แล้ว
อ่านสดจากแคตตาล็อกโมเดลของ AgentsRoom ความนิยม ณ 6 ต.ค. 2569 16:16
CLI ที่นำมาเปรียบเทียบ
12
โมเดลที่จัดระดับแล้ว
94
การเปิดใช้ที่นับ ช่วง 30 วันล่าสุด
51,051
Claude ถูกใช้เป็นมาตรวัดเพราะเป็นกลุ่มโมเดลที่นักพัฒนาส่วนใหญ่รู้จัก แต่ละรายการระบุโมเดลจากผู้ผลิตรายอื่นที่ทำหน้าที่เดียวกันในวันนี้
ระดับ Fable
โมเดลแนวหน้า สูงกว่า Opus หนึ่งขั้น: GPT-6 Astra ใน Codex Daybreak Blue ใน Codex และGPT-5.6 Sol Max ใน Codex
สำหรับปัญหาที่ยากที่สุด ในราคาที่สูงที่สุด
ระดับ Opus
โมเดลที่ทำหน้าที่แบบ Claude Opus: GPT-6.1 Sol ใน Codex Gemini 3.1 Pro (High) ใน Antigravity และGrok 4.7 ใน Grok
โมเดลเรือธงที่งานเขียนโค้ดจริงจังส่วนใหญ่ใช้
ระดับ Sonnet
โมเดลที่ทำหน้าที่แบบ Claude Sonnet: GPT-6 Luna ใน Codex GPT-5.6 Terra ใน Codex Gemini 3.8 Flash (High) ใน Antigravity GLM 5.3 ใน OpenCode Qwen3.8 Max ใน OpenCode DeepSeek ใน Aider Medium 3.5 ใน Mistral Vibe และKimi K3 ใน Kimi
สมดุล: แรงพอสำหรับฟีเจอร์ส่วนใหญ่ และถูกกว่าโมเดลเรือธง
ระดับ Haiku
โมเดลที่ทำหน้าที่แบบ Claude Haiku: Codex Spark ใน Codex Qwen3 Coder ใน Ollama GLM 4.6 ใน Ollama และDeepSeek V4 Flash ใน oh-my-pi
เบาและเร็ว: เปลี่ยนชื่อ แก้ไขเล็กน้อย สรุปความ
หนึ่งแถวต่อหนึ่ง CLI ที่ AgentsRoom รองรับ หนึ่งคอลัมน์ต่อหนึ่งระดับ โมเดลปัจจุบันแสดงก่อน ส่วนเวอร์ชันเก่าที่รายการยังมีให้เลือกจะนับรวมไว้ด้านล่าง
| CLI | แนวหน้าระดับ Fable | ระดับ Opus | ระดับ Sonnet | ระดับ Haiku |
|---|---|---|---|---|
Fable | OpusOpus 5.5 +2 เวอร์ชันเก่าOpus 5, Opus 4.8 | SonnetSonnet 5.5 +1 เวอร์ชันเก่าSonnet 5 | Haiku | |
GPT-6 AstraDaybreak BlueDaybreak RedGPT-5.6 Sol Max | GPT-6.1 Sol +3 เวอร์ชันเก่าGPT-6 Sol, GPT-5.6 Sol, GPT-5.5 | GPT-6 LunaGPT-5.6 Terra +4 เวอร์ชันเก่าGPT-5.6 Luna, GPT-5, GPT-5.4, GPT-5.2 | Codex Spark +1 เวอร์ชันเก่าGPT-5.4 Mini | |
| ไม่มี | Gemini 3.1 Pro (High)Claude Opus 5.5 (High)Claude Opus 5.5 (Medium) | Gemini 3.8 Flash (High)Gemini 3.8 Flash (Medium)Claude Sonnet 5.5 (High)Claude Sonnet 5.5 (Medium) +5 เวอร์ชันเก่าGemini 3.7 Flash (High), Gemini 3.7 Flash (Medium), Gemini 3.6 Flash (High), Gemini 3.6 Flash (Medium), Gemini 3.5 Flash (Medium) | ไม่มี | |
| ไม่มี | Claude Opus | Claude SonnetGPT-5Kimi K3GLM 5.3Qwen3.8 Max | ไม่มี | |
| ไม่มี | Claude Opus | Claude SonnetDeepSeek | GPT-4o | |
| ไม่มี | Grok 4.7 | ไม่มี | ไม่มี | |
| ไม่มี | ไม่มี | Medium 3.5 | ไม่มี | |
| ไม่มี | ไม่มี | Qwen3 Coder 480B | Gemma 3Qwen3 CoderGLM 4.6 | |
GPT-6 Astra | GPT-6.1 SolClaude Opus 5.5GPT-5.5 +5 เวอร์ชันเก่าGPT-6 Sol, Claude Opus 5, GPT-5.6 Sol, Claude Opus 4.8, Claude Opus 4.7 | Claude Sonnet 5.5GPT-6 LunaGPT-5.6 TerraGemini 3.7 FlashKimi K3 +4 เวอร์ชันเก่าClaude Sonnet 5, GPT-5.6 Luna, Claude Sonnet 4.6, Gemini 3.6 Flash | Claude Haiku 4.5MAI-Code-1.1-Flash | |
| ไม่มี | ไม่มี | Kimi K3Kimi K3-256KKimi K2.8 PreviewK2.7 Code HighSpeed | ไม่มี | |
| ไม่มี | Claude Opus 5.5GPT-6 Sol | Claude Sonnet 5Gemini FlashGLM 5.3 +1 เวอร์ชันเก่าGLM 5.2 | DeepSeek V4 Flash | |
| ไม่มี | Claude OpusGPTCodexGemini | SWEClaude SonnetGLMKimiDeepSeek | Claude Haiku | |
| เลือกโมเดลให้คุณในทุกคำขอ: ไม่มีระดับตายตัว | ||||
| เลือกโมเดลให้คุณในทุกคำขอ: ไม่มีระดับตายตัว | ||||
| เลือกโมเดลให้คุณในทุกคำขอ: ไม่มีระดับตายตัว | ||||
ตระกูลโมเดลไม่ได้ผูกติดกับเครื่องมือของผู้ผลิตที่สร้างมัน นี่คือทุกตระกูลที่มีให้ใช้ในมากกว่าหนึ่ง CLI ในวันนี้ พร้อมชื่อที่แต่ละ CLI ใช้เรียก
7 CLI
7 CLI
4 CLI
4 CLI
3 CLI
3 CLI
3 CLI
3 CLI
2 CLI
2 CLI
2 CLI
2 CLI
โมเดลที่ผู้ใช้ AgentsRoom เปิดใช้มากที่สุดใน 30 วันล่าสุด อ่านในแง่ของระดับ ความเทียบเท่าบอกว่าโมเดลไหนทำหน้าที่เดียวกัน ส่วนการเปิดใช้บอกว่าผู้คนเลือกตัวไหน
Opusระดับ Opus
22.9% ของการเปิดใช้
Sonnetระดับ Sonnet
12.8% ของการเปิดใช้
Opus 5.5ระดับ Opus
9.4% ของการเปิดใช้
GPT-5.6 Solระดับ Opus
5% ของการเปิดใช้
GPT-6 Lunaระดับ Sonnet
4.9% ของการเปิดใช้
มาตรวัดเดียวที่มีสี่ระดับ โดยยึด Claude เป็นหลัก: ระดับ Fable (แนวหน้า), ระดับ Opus (เรือธง), ระดับ Sonnet (สมดุล) และระดับ Haiku (เบา) ตระกูลโมเดลแต่ละตระกูลได้ระดับตามบทบาทที่ผู้ผลิตกำหนดให้ในกลุ่มโมเดลของตัวเอง และตระกูลเดียวกันจะอยู่ในระดับเดียวกันในทุก CLI ที่มีให้ใช้
ฝั่ง OpenAI นั้น Astra เป็นโมเดลแนวหน้า Sol เป็นเรือธง Luna และ Terra เป็นโมเดลสมดุล ส่วน Spark และโมเดล mini เป็นโมเดลเบา Gemini Pro อยู่ในระดับ Opus และ Gemini Flash อยู่ในระดับ Sonnet ส่วน Grok Heavy เป็นโมเดลแนวหน้า และ Grok เองอยู่ในระดับ Opus
ตระกูลโมเดลแบบน้ำหนักเปิด (Kimi, GLM, DeepSeek, Qwen และอื่น ๆ) ถูกจัดไว้สูงสุดที่ระดับ Sonnet และรุ่นย่อยแบบเบาของตระกูลเหล่านี้อยู่ในระดับ Haiku เมื่อก้ำกึ่งระหว่างสองระดับ ตารางจะเลือกระดับที่ต่ำกว่าเสมอ: ขอประเมินโมเดลต่ำไว้ก่อน ดีกว่าบอกคุณว่ามันแทน Opus ได้ทั้งที่ยังไม่เคยพิสูจน์ให้เห็น
เราเตอร์ไม่มีระดับ เพราะมันเลือกโมเดลในทุกคำขอ: GitHub Copilot (Auto) Amp (Amp default) Freebuff (Freebuff default) Devin (Adaptive) และCursor (Default) ตระกูลที่ตารางยังไม่รู้จักก็ไม่มีระดับเช่นกัน: ไม่มีความเทียบเท่าเลยยังดีกว่ามีความเทียบเท่าที่ผิด
ระดับไม่ใช่คะแนนเบนช์มาร์ก โมเดลสองตัวในระดับเดียวกันยังต่างกันทั้งราคา ความเร็ว หน้าต่างบริบท ขีดจำกัดการใช้งาน และงานที่ทำได้ดีที่สุด ใช้ตารางเพื่อรู้ว่าควรดูตรงไหน แล้วลองทั้งสองตัวกับงานของคุณเอง
ข้อมูล: แคตตาล็อกโมเดลที่ AgentsRoom ส่งให้แอปเดสก์ท็อปและแอปมือถือ ซึ่งอ่านใหม่ทุกครั้งที่เข้าชม และกฎการจัดระดับที่แอปใช้แสดงป้ายในทุกรายการโมเดล ความนิยม: การเปิดใช้เอเจนต์จริงของผู้ใช้ AgentsRoom ที่แชร์ข้อมูลการใช้งาน ในช่วง 30 วันล่าสุด รีเฟรชทุกสิบนาที
คำตอบคือ GPT-6.1 Sol โดยในตารางด้านบน Claude Opus และ GPT-6.1 Sol อยู่ในระดับ Opus ทั้งคู่: โมเดลเรือธงที่งานเขียนโค้ดจริงจังส่วนใหญ่ใช้ ต่ำกว่าระดับแนวหน้าหนึ่งขั้น โมเดลแนวหน้าของ Codex ซึ่งเทียบเท่ากับ Fable คือ GPT-6 Astra สำหรับงานระดับ Sonnet โมเดลของ Codex คือ GPT-6 Luna ส่วนโมเดลระดับ Haiku ในรายการคือ Codex Spark
คำตอบคือ Gemini 3.1 Pro (High) ใน Antigravity โดย Gemini Pro เป็นสายโมเดลเรือธงของ Google จึงอยู่ในระดับ Opus Gemini Flash ทำหน้าที่แบบ Sonnet: ตอนนี้คือ Gemini 3.8 Flash (High)
คำตอบคือ GPT-6 Luna ใน Codex โดยสายโมเดลสมดุลของ OpenAI อยู่ในระดับ Sonnet: แรงพอสำหรับฟีเจอร์ส่วนใหญ่ และถูกกว่าโมเดลเรือธง
คำตอบคือ Codex Spark ใน Codex: โมเดลที่เบาและเร็วในกลุ่มโมเดลนี้ สำหรับการเปลี่ยนชื่อ การแก้ไขเล็กน้อย และคำถามสั้น ๆ
ระดับเดียวกันไม่ได้แปลว่าผลลัพธ์เดียวกัน GPT-6.1 Sol และ Opus 5.5 ทำหน้าที่เดียวกันในกลุ่มโมเดลของผู้ผลิตแต่ละราย แต่ยังต่างกันทั้งราคา ความเร็ว หน้าต่างบริบท ขีดจำกัดการใช้งาน และงานที่รับมือได้ดีที่สุด อีกทั้งอันดับเบนช์มาร์กระหว่างสองตัวนี้ก็เปลี่ยนไปทุกครั้งที่มีรุ่นใหม่ คำตอบที่เชื่อถือได้คือรันทั้งสองตัวกับงานเดียวกันของคุณ: AgentsRoom เปิดเอเจนต์หนึ่งตัวบนแต่ละโมเดล เคียงข้างกัน ในโปรเจกต์เดียวกัน
ตอนนี้ Opus ยังมีอยู่ในรายการโมเดลของ Antigravity OpenCode Aider GitHub Copilot oh-my-pi และDevin ด้วย ภายใต้ชื่อที่แต่ละ CLI ใช้เรียก ตระกูลเดียวกัน ระดับเดียวกัน: ความเทียบเท่าไม่เปลี่ยนไปตาม CLI ที่ให้บริการ
เพราะมาตรวัดนี้ยึดตามบทบาทที่โมเดลทำหน้าที่ และไม่เคยประเมินเกินจริง ตระกูลโมเดลแบบน้ำหนักเปิดมักคุ้มค่ามาก และหลาย CLI ก็มีให้ใช้ แต่การจัดตัวใดตัวหนึ่งไว้ในระดับ Opus จะเท่ากับบอกคุณว่ามันแทน Opus ได้ในทุกงาน ซึ่งยังไม่มีตัวไหนพิสูจน์ได้ในทุกด้าน ส่วนรุ่นย่อยแบบเบาของตระกูลเหล่านี้อยู่ในระดับ Haiku
เพราะสิ่งเหล่านี้ไม่ใช่โมเดล: GitHub Copilot (Auto) Amp (Amp default) Freebuff (Freebuff default) Devin (Adaptive) และCursor (Default) ปล่อยให้บริการเป็นผู้เลือกโมเดลในทุกคำขอ จึงไม่มีความสามารถตายตัวให้เปรียบเทียบ ตารางจึงไม่นำมารวมไว้ แทนที่จะเดาเอา
ตารางถูกคำนวณใหม่ทุกครั้งที่เปิดหน้านี้ จากแคตตาล็อกโมเดลชุดเดียวกับที่แอป AgentsRoom ส่งให้ทุกเครื่องเดสก์ท็อปและโทรศัพท์ เมื่อ AgentsRoom เพิ่มโมเดลที่ CLI หนึ่งเพิ่งเปิดตัว โมเดลนั้นจะปรากฏที่นี่ทันทีในระดับของมัน และเวอร์ชันที่ถูกแทนที่จะถูกระบุว่าเป็นเวอร์ชันเก่า ไอคอนเปลวไฟแสดงความนิยมรีเฟรชทุกสิบนาทีจากการเปิดใช้ใน 30 วันล่าสุด
ได้ ด้วยสองวิธี และทั้งสองวิธีทำแค่แนะนำ AI Suggestion ประเมินขนาดของงานก่อนเปิดเซสชัน (ง่าย, มาตรฐาน, ซับซ้อน หรือ ยากที่สุด) แล้วเปิดเอเจนต์บนโมเดลที่ถูกที่สุดของ CLI นั้นที่ยังทำงานนี้ได้ Adaptive Mode อ่านร่างของคุณเมื่อ CLI ทำงานแล้ว และแนะนำโมเดลที่เบากว่าเมื่องานไม่จำเป็นต้องใช้โมเดลเรือธง หรือบอกคุณว่าโมเดลปัจจุบันเหมาะสมแล้ว
ใน AgentsRoom
AgentsRoom คือศูนย์บัญชาการบนเดสก์ท็อปสำหรับเอเจนต์เขียนโค้ด AI ที่ให้ Claude, Codex, GitHub Copilot CLI, Cursor และ CLI เอเจนต์อีก 10 ตัวทำงานเคียงข้างกัน แต่ละเอเจนต์ใช้โมเดลที่คุณเลือก ความเทียบเท่าในหน้านี้คือชุดเดียวกับที่แอปแสดงให้คุณเห็นขณะเลือก และมีฟีเจอร์อัจฉริยะอีกไม่กี่อย่างที่ช่วยให้คุณเลือกขนาดโมเดลให้พอดีกับงาน
ทุกรายการโมเดล (เอเจนต์ใหม่, เปิดใช้ด่วน, ตั๋วใน backlog, แอปมือถือ) จะติดป้ายให้แต่ละโมเดลด้วยตัวเทียบเท่าใน CLI ที่คุณรู้จักดีที่สุด และเรียงตามพลัง ราคา หรือความนิยมได้
โมเดลที่เทียบเท่ากันในแอปAI Suggestion เปลี่ยนคำอธิบายบรรทัดเดียวให้เป็นระดับความซับซ้อน (ง่าย, มาตรฐาน, ซับซ้อน, ยากที่สุด) แล้วเปิดเอเจนต์บนโมเดลที่ถูกที่สุดที่เหมาะกับงาน Adaptive Mode ตรวจร่างของคุณ และแนะนำโมเดลที่เบากว่าเมื่อโมเดลเรือธงเกินความจำเป็น
AI Suggestion และ Adaptive Modeเมื่อบัญชีใกล้ถึงขีดจำกัด กฎโควตาสามารถเริ่มเอเจนต์ใหม่บน CLI อื่นแบบโมเดลต่อโมเดล: Fable, Opus และ Sonnet ต่างไปยังตัวเทียบเท่าในระดับเดียวกัน ซึ่งกรอกไว้ให้ล่วงหน้าจากระดับเหล่านี้
กฎโควตาและการแจ้งเตือนการใช้งานปักหมุดผู้ให้บริการ โมเดล และระดับการให้เหตุผลไว้บนตั๋วใน backlog เพื่อให้เอเจนต์ที่รันตั๋วนั้นใช้ตามนั้นทุกประการ และเก็บโมเดลเรือธงไว้สำหรับตั๋วที่จำเป็นจริง ๆ
กระดานงาน Backlogเอเจนต์นักพัฒนาที่ใช้โมเดลเรือธงส่งงานรันเทสต์ต่อให้เอเจนต์ QA ที่ใช้โมเดลเบากว่าผ่าน MCP โมเดลราคาแพงจึงยังโฟกัสอยู่ที่โค้ด
การมอบหมายเอเจนต์ในทีมเอเจนต์ ทุกขั้นตอนมีบทบาท CLI และโมเดลของตัวเอง: สถาปนิกใช้โมเดลแนวหน้า ขั้นลงมือเขียนโค้ดใช้ระดับ Opus ส่วนการรีวิวใช้ระดับไหนก็ได้ที่คุ้มค่า
ทีมเอเจนต์การเปรียบเทียบที่ตรงไปตรงมาของ Claude Code และ Codex CLI: ราคา, ความเร็ว, MCP, การควบคุม. และทำไมหลังจากไม่กี่สัปดาห์ฉันจึงหยุดเลือกระหว่างพวกเขา.
Ollama ตอนนี้เป็นผู้ให้บริการใน AgentsRoom รันโมเดลโอเพนซอร์สท้องถิ่นเช่น Llama, Qwen, Gemma และ DeepSeek ข้างเอเจนต์คลาวด์ และตั้งค่าการเลือกท้องถิ่นหรือคลาวด์บนแต่ละเอเจนต์ที่สามารถสลับได้ระหว่างการสนทนา