โมเดล AI ที่เทียบเท่ากัน

โมเดล AI ที่เทียบเท่ากัน: Opus, Sonnet และ Haiku ของทุก CLI เขียนโค้ด

คุณจำรุ่นต่าง ๆ ของ Claude ได้ขึ้นใจ แต่พอเปิด Codex, Gemini หรือ Grok ก็ไม่มีชื่อไหนบอกเลยว่าโมเดลตัวไหนทำหน้าที่แบบ Opus หน้านี้จัดวางทุกโมเดลของทุก CLI เอเจนต์เขียนโค้ดที่ AgentsRoom รองรับไว้บนมาตรวัดเดียว เพื่อให้คุณอ่านแต่ละตัวได้ด้วยคำที่คุณรู้จักอยู่แล้ว

อ่านสดจากแคตตาล็อกโมเดลของ AgentsRoom ความนิยม ณ 6 ต.ค. 2569 16:16

CLI ที่นำมาเปรียบเทียบ

12

โมเดลที่จัดระดับแล้ว

94

การเปิดใช้ที่นับ ช่วง 30 วันล่าสุด

51,051

คำตอบสั้น ๆ

Claude ถูกใช้เป็นมาตรวัดเพราะเป็นกลุ่มโมเดลที่นักพัฒนาส่วนใหญ่รู้จัก แต่ละรายการระบุโมเดลจากผู้ผลิตรายอื่นที่ทำหน้าที่เดียวกันในวันนี้

ระดับ Fable

โมเดลที่เทียบเท่าระดับ Fable (แนวหน้า)

โมเดลแนวหน้า สูงกว่า Opus หนึ่งขั้น: GPT-6 Astra ใน Codex Daybreak Blue ใน Codex และGPT-5.6 Sol Max ใน Codex

สำหรับปัญหาที่ยากที่สุด ในราคาที่สูงที่สุด

ระดับ Opus

โมเดลที่เทียบเท่า Opus

โมเดลที่ทำหน้าที่แบบ Claude Opus: GPT-6.1 Sol ใน Codex Gemini 3.1 Pro (High) ใน Antigravity และGrok 4.7 ใน Grok

โมเดลเรือธงที่งานเขียนโค้ดจริงจังส่วนใหญ่ใช้

ระดับ Sonnet

โมเดลที่เทียบเท่า Sonnet

โมเดลที่ทำหน้าที่แบบ Claude Sonnet: GPT-6 Luna ใน Codex GPT-5.6 Terra ใน Codex Gemini 3.8 Flash (High) ใน Antigravity GLM 5.3 ใน OpenCode Qwen3.8 Max ใน OpenCode DeepSeek ใน Aider Medium 3.5 ใน Mistral Vibe และKimi K3 ใน Kimi

สมดุล: แรงพอสำหรับฟีเจอร์ส่วนใหญ่ และถูกกว่าโมเดลเรือธง

ระดับ Haiku

โมเดลที่เทียบเท่า Haiku

โมเดลที่ทำหน้าที่แบบ Claude Haiku: Codex Spark ใน Codex Qwen3 Coder ใน Ollama GLM 4.6 ใน Ollama และDeepSeek V4 Flash ใน oh-my-pi

เบาและเร็ว: เปลี่ยนชื่อ แก้ไขเล็กน้อย สรุปความ

ทุก CLI เขียนโค้ด แยกทีละระดับ

หนึ่งแถวต่อหนึ่ง CLI ที่ AgentsRoom รองรับ หนึ่งคอลัมน์ต่อหนึ่งระดับ โมเดลปัจจุบันแสดงก่อน ส่วนเวอร์ชันเก่าที่รายการยังมีให้เลือกจะนับรวมไว้ด้านล่าง

โมเดล AI ที่เทียบเท่ากัน แยกตาม CLI เอเจนต์เขียนโค้ดและระดับความสามารถ
CLIแนวหน้าระดับ Fableระดับ Opusระดับ Sonnetระดับ Haiku
Claude
Fable
OpusOpus 5.5
+2 เวอร์ชันเก่า

Opus 5, Opus 4.8

SonnetSonnet 5.5
+1 เวอร์ชันเก่า

Sonnet 5

Haiku
Codex
GPT-6 AstraDaybreak BlueDaybreak RedGPT-5.6 Sol Max
GPT-6.1 Sol
+3 เวอร์ชันเก่า

GPT-6 Sol, GPT-5.6 Sol, GPT-5.5

GPT-6 LunaGPT-5.6 Terra
+4 เวอร์ชันเก่า

GPT-5.6 Luna, GPT-5, GPT-5.4, GPT-5.2

Codex Spark
+1 เวอร์ชันเก่า

GPT-5.4 Mini

Antigravityไม่มี
Gemini 3.1 Pro (High)Claude Opus 5.5 (High)Claude Opus 5.5 (Medium)
Gemini 3.8 Flash (High)Gemini 3.8 Flash (Medium)Claude Sonnet 5.5 (High)Claude Sonnet 5.5 (Medium)
+5 เวอร์ชันเก่า

Gemini 3.7 Flash (High), Gemini 3.7 Flash (Medium), Gemini 3.6 Flash (High), Gemini 3.6 Flash (Medium), Gemini 3.5 Flash (Medium)

ไม่มี
OpenCodeไม่มี
Claude Opus
Claude SonnetGPT-5Kimi K3GLM 5.3Qwen3.8 Max
ไม่มี
Aiderไม่มี
Claude Opus
Claude SonnetDeepSeek
GPT-4o
Grokไม่มี
Grok 4.7
ไม่มีไม่มี
Mistral Vibeไม่มีไม่มี
Medium 3.5
ไม่มี
Ollamaไม่มีไม่มี
Qwen3 Coder 480B
Gemma 3Qwen3 CoderGLM 4.6
GitHub Copilot
GPT-6 Astra
GPT-6.1 SolClaude Opus 5.5GPT-5.5
+5 เวอร์ชันเก่า

GPT-6 Sol, Claude Opus 5, GPT-5.6 Sol, Claude Opus 4.8, Claude Opus 4.7

Claude Sonnet 5.5GPT-6 LunaGPT-5.6 TerraGemini 3.7 FlashKimi K3
+4 เวอร์ชันเก่า

Claude Sonnet 5, GPT-5.6 Luna, Claude Sonnet 4.6, Gemini 3.6 Flash

Claude Haiku 4.5MAI-Code-1.1-Flash
Kimiไม่มีไม่มี
Kimi K3Kimi K3-256KKimi K2.8 PreviewK2.7 Code HighSpeed
ไม่มี
oh-my-piไม่มี
Claude Opus 5.5GPT-6 Sol
Claude Sonnet 5Gemini FlashGLM 5.3
+1 เวอร์ชันเก่า

GLM 5.2

DeepSeek V4 Flash
Devinไม่มี
Claude OpusGPTCodexGemini
SWEClaude SonnetGLMKimiDeepSeek
Claude Haiku
Ampเลือกโมเดลให้คุณในทุกคำขอ: ไม่มีระดับตายตัว
Freebuffเลือกโมเดลให้คุณในทุกคำขอ: ไม่มีระดับตายตัว
Cursorเลือกโมเดลให้คุณในทุกคำขอ: ไม่มีระดับตายตัว
  • หนึ่งในสามโมเดลของ CLI นั้นที่ชุมชนเปิดใช้มากที่สุด
  • เวอร์ชันเก่า: มีรุ่นที่ใหม่กว่าของโมเดลเดียวกันอยู่ในรายการเดียวกัน

โมเดลเดียวกัน หลาย CLI

ตระกูลโมเดลไม่ได้ผูกติดกับเครื่องมือของผู้ผลิตที่สร้างมัน นี่คือทุกตระกูลที่มีให้ใช้ในมากกว่าหนึ่ง CLI ในวันนี้ พร้อมชื่อที่แต่ละ CLI ใช้เรียก

Claude Opus

ระดับ Opus

7 CLI

  • ClaudeOpus 5.5
  • AntigravityClaude Opus 5.5 (High)
  • OpenCodeClaude Opus
  • AiderClaude Opus
  • GitHub CopilotClaude Opus 5.5
  • oh-my-piClaude Opus 5.5
  • DevinClaude Opus

Claude Sonnet

ระดับ Sonnet

7 CLI

  • ClaudeSonnet 5.5
  • AntigravityClaude Sonnet 5.5 (High)
  • OpenCodeClaude Sonnet
  • AiderClaude Sonnet
  • GitHub CopilotClaude Sonnet 5.5
  • oh-my-piClaude Sonnet 5
  • DevinClaude Sonnet

Kimi

ระดับ Sonnet

4 CLI

  • KimiKimi K3
  • OpenCodeKimi K3
  • GitHub CopilotKimi K3
  • DevinKimi

GLM

ระดับ Sonnet

4 CLI

  • OpenCodeGLM 5.3
  • OllamaGLM 4.6
  • oh-my-piGLM 5.3
  • DevinGLM

Claude Haiku

ระดับ Haiku

3 CLI

  • ClaudeHaiku
  • GitHub CopilotClaude Haiku 4.5
  • DevinClaude Haiku

GPT Sol

ระดับ Opus

3 CLI

  • CodexGPT-6.1 Sol
  • GitHub CopilotGPT-6.1 Sol
  • oh-my-piGPT-6 Sol

Gemini Flash

ระดับ Sonnet

3 CLI

  • AntigravityGemini 3.8 Flash (High)
  • GitHub CopilotGemini 3.7 Flash
  • oh-my-piGemini Flash

DeepSeek

ระดับ Sonnet

3 CLI

  • AiderDeepSeek
  • oh-my-piDeepSeek V4 Flash
  • DevinDeepSeek

GPT Astra

ระดับ Fable

2 CLI

  • CodexGPT-6 Astra
  • GitHub CopilotGPT-6 Astra

GPT Luna

ระดับ Sonnet

2 CLI

  • CodexGPT-6 Luna
  • GitHub CopilotGPT-6 Luna

GPT Terra

ระดับ Sonnet

2 CLI

  • CodexGPT-5.6 Terra
  • GitHub CopilotGPT-5.6 Terra

Qwen

ระดับ Sonnet

2 CLI

  • OpenCodeQwen3.8 Max
  • OllamaQwen3 Coder

สิ่งที่นักพัฒนาเปิดใช้จริง

โมเดลที่ผู้ใช้ AgentsRoom เปิดใช้มากที่สุดใน 30 วันล่าสุด อ่านในแง่ของระดับ ความเทียบเท่าบอกว่าโมเดลไหนทำหน้าที่เดียวกัน ส่วนการเปิดใช้บอกว่าผู้คนเลือกตัวไหน

  1. 1

    Opusระดับ Opus

    Claudeสมาชิก 439 คน

    22.9% ของการเปิดใช้

  2. 2

    Sonnetระดับ Sonnet

    Claudeสมาชิก 173 คน

    12.8% ของการเปิดใช้

  3. 3

    Opus 5.5ระดับ Opus

    Claudeสมาชิก 103 คน

    9.4% ของการเปิดใช้

  4. 4

    GPT-5.6 Solระดับ Opus

    Codexสมาชิก 119 คน

    5% ของการเปิดใช้

  5. 5

    GPT-6 Lunaระดับ Sonnet

    Codexสมาชิก 47 คน

    4.9% ของการเปิดใช้

สถิติการใช้งานฉบับเต็ม แยกตาม CLI และตามโมเดล

ระดับถูกกำหนดอย่างไร

มาตรวัดเดียวที่มีสี่ระดับ โดยยึด Claude เป็นหลัก: ระดับ Fable (แนวหน้า), ระดับ Opus (เรือธง), ระดับ Sonnet (สมดุล) และระดับ Haiku (เบา) ตระกูลโมเดลแต่ละตระกูลได้ระดับตามบทบาทที่ผู้ผลิตกำหนดให้ในกลุ่มโมเดลของตัวเอง และตระกูลเดียวกันจะอยู่ในระดับเดียวกันในทุก CLI ที่มีให้ใช้

ฝั่ง OpenAI นั้น Astra เป็นโมเดลแนวหน้า Sol เป็นเรือธง Luna และ Terra เป็นโมเดลสมดุล ส่วน Spark และโมเดล mini เป็นโมเดลเบา Gemini Pro อยู่ในระดับ Opus และ Gemini Flash อยู่ในระดับ Sonnet ส่วน Grok Heavy เป็นโมเดลแนวหน้า และ Grok เองอยู่ในระดับ Opus

ตระกูลโมเดลแบบน้ำหนักเปิด (Kimi, GLM, DeepSeek, Qwen และอื่น ๆ) ถูกจัดไว้สูงสุดที่ระดับ Sonnet และรุ่นย่อยแบบเบาของตระกูลเหล่านี้อยู่ในระดับ Haiku เมื่อก้ำกึ่งระหว่างสองระดับ ตารางจะเลือกระดับที่ต่ำกว่าเสมอ: ขอประเมินโมเดลต่ำไว้ก่อน ดีกว่าบอกคุณว่ามันแทน Opus ได้ทั้งที่ยังไม่เคยพิสูจน์ให้เห็น

เราเตอร์ไม่มีระดับ เพราะมันเลือกโมเดลในทุกคำขอ: GitHub Copilot (Auto) Amp (Amp default) Freebuff (Freebuff default) Devin (Adaptive) และCursor (Default) ตระกูลที่ตารางยังไม่รู้จักก็ไม่มีระดับเช่นกัน: ไม่มีความเทียบเท่าเลยยังดีกว่ามีความเทียบเท่าที่ผิด

ระดับไม่ใช่คะแนนเบนช์มาร์ก โมเดลสองตัวในระดับเดียวกันยังต่างกันทั้งราคา ความเร็ว หน้าต่างบริบท ขีดจำกัดการใช้งาน และงานที่ทำได้ดีที่สุด ใช้ตารางเพื่อรู้ว่าควรดูตรงไหน แล้วลองทั้งสองตัวกับงานของคุณเอง

ข้อมูล: แคตตาล็อกโมเดลที่ AgentsRoom ส่งให้แอปเดสก์ท็อปและแอปมือถือ ซึ่งอ่านใหม่ทุกครั้งที่เข้าชม และกฎการจัดระดับที่แอปใช้แสดงป้ายในทุกรายการโมเดล ความนิยม: การเปิดใช้เอเจนต์จริงของผู้ใช้ AgentsRoom ที่แชร์ข้อมูลการใช้งาน ในช่วง 30 วันล่าสุด รีเฟรชทุกสิบนาที

คำถามที่พบบ่อย

โมเดลไหนของ Codex ที่เทียบเท่ากับ Claude Opus?

คำตอบคือ GPT-6.1 Sol โดยในตารางด้านบน Claude Opus และ GPT-6.1 Sol อยู่ในระดับ Opus ทั้งคู่: โมเดลเรือธงที่งานเขียนโค้ดจริงจังส่วนใหญ่ใช้ ต่ำกว่าระดับแนวหน้าหนึ่งขั้น โมเดลแนวหน้าของ Codex ซึ่งเทียบเท่ากับ Fable คือ GPT-6 Astra สำหรับงานระดับ Sonnet โมเดลของ Codex คือ GPT-6 Luna ส่วนโมเดลระดับ Haiku ในรายการคือ Codex Spark

โมเดล Gemini ตัวไหนที่เทียบเท่ากับ Claude Opus?

คำตอบคือ Gemini 3.1 Pro (High) ใน Antigravity โดย Gemini Pro เป็นสายโมเดลเรือธงของ Google จึงอยู่ในระดับ Opus Gemini Flash ทำหน้าที่แบบ Sonnet: ตอนนี้คือ Gemini 3.8 Flash (High)

โมเดล GPT ตัวไหนที่เทียบเท่ากับ Claude Sonnet?

คำตอบคือ GPT-6 Luna ใน Codex โดยสายโมเดลสมดุลของ OpenAI อยู่ในระดับ Sonnet: แรงพอสำหรับฟีเจอร์ส่วนใหญ่ และถูกกว่าโมเดลเรือธง

โมเดลของ OpenAI ตัวไหนที่เทียบเท่ากับ Claude Haiku?

คำตอบคือ Codex Spark ใน Codex: โมเดลที่เบาและเร็วในกลุ่มโมเดลนี้ สำหรับการเปลี่ยนชื่อ การแก้ไขเล็กน้อย และคำถามสั้น ๆ

GPT-6.1 Sol เก่งเท่า Opus 5.5 ไหม?

ระดับเดียวกันไม่ได้แปลว่าผลลัพธ์เดียวกัน GPT-6.1 Sol และ Opus 5.5 ทำหน้าที่เดียวกันในกลุ่มโมเดลของผู้ผลิตแต่ละราย แต่ยังต่างกันทั้งราคา ความเร็ว หน้าต่างบริบท ขีดจำกัดการใช้งาน และงานที่รับมือได้ดีที่สุด อีกทั้งอันดับเบนช์มาร์กระหว่างสองตัวนี้ก็เปลี่ยนไปทุกครั้งที่มีรุ่นใหม่ คำตอบที่เชื่อถือได้คือรันทั้งสองตัวกับงานเดียวกันของคุณ: AgentsRoom เปิดเอเจนต์หนึ่งตัวบนแต่ละโมเดล เคียงข้างกัน ในโปรเจกต์เดียวกัน

ใช้ Claude Opus นอก Claude Code ได้ที่ไหนบ้าง?

ตอนนี้ Opus ยังมีอยู่ในรายการโมเดลของ Antigravity OpenCode Aider GitHub Copilot oh-my-pi และDevin ด้วย ภายใต้ชื่อที่แต่ละ CLI ใช้เรียก ตระกูลเดียวกัน ระดับเดียวกัน: ความเทียบเท่าไม่เปลี่ยนไปตาม CLI ที่ให้บริการ

ทำไมตารางจึงจำกัด Kimi, GLM หรือ Qwen ไว้ที่ระดับ Sonnet?

เพราะมาตรวัดนี้ยึดตามบทบาทที่โมเดลทำหน้าที่ และไม่เคยประเมินเกินจริง ตระกูลโมเดลแบบน้ำหนักเปิดมักคุ้มค่ามาก และหลาย CLI ก็มีให้ใช้ แต่การจัดตัวใดตัวหนึ่งไว้ในระดับ Opus จะเท่ากับบอกคุณว่ามันแทน Opus ได้ในทุกงาน ซึ่งยังไม่มีตัวไหนพิสูจน์ได้ในทุกด้าน ส่วนรุ่นย่อยแบบเบาของตระกูลเหล่านี้อยู่ในระดับ Haiku

ทำไม Auto และ Default จึงไม่มีโมเดลที่เทียบเท่า?

เพราะสิ่งเหล่านี้ไม่ใช่โมเดล: GitHub Copilot (Auto) Amp (Amp default) Freebuff (Freebuff default) Devin (Adaptive) และCursor (Default) ปล่อยให้บริการเป็นผู้เลือกโมเดลในทุกคำขอ จึงไม่มีความสามารถตายตัวให้เปรียบเทียบ ตารางจึงไม่นำมารวมไว้ แทนที่จะเดาเอา

ตารางนี้อัปเดตแค่ไหน?

ตารางถูกคำนวณใหม่ทุกครั้งที่เปิดหน้านี้ จากแคตตาล็อกโมเดลชุดเดียวกับที่แอป AgentsRoom ส่งให้ทุกเครื่องเดสก์ท็อปและโทรศัพท์ เมื่อ AgentsRoom เพิ่มโมเดลที่ CLI หนึ่งเพิ่งเปิดตัว โมเดลนั้นจะปรากฏที่นี่ทันทีในระดับของมัน และเวอร์ชันที่ถูกแทนที่จะถูกระบุว่าเป็นเวอร์ชันเก่า ไอคอนเปลวไฟแสดงความนิยมรีเฟรชทุกสิบนาทีจากการเปิดใช้ใน 30 วันล่าสุด

AgentsRoom เลือกโมเดลที่เหมาะกับงานของฉันให้ได้ไหม?

ได้ ด้วยสองวิธี และทั้งสองวิธีทำแค่แนะนำ AI Suggestion ประเมินขนาดของงานก่อนเปิดเซสชัน (ง่าย, มาตรฐาน, ซับซ้อน หรือ ยากที่สุด) แล้วเปิดเอเจนต์บนโมเดลที่ถูกที่สุดของ CLI นั้นที่ยังทำงานนี้ได้ Adaptive Mode อ่านร่างของคุณเมื่อ CLI ทำงานแล้ว และแนะนำโมเดลที่เบากว่าเมื่องานไม่จำเป็นต้องใช้โมเดลเรือธง หรือบอกคุณว่าโมเดลปัจจุบันเหมาะสมแล้ว

ใน AgentsRoom

AgentsRoom ตอบคำถามนี้ให้ในตัวเลือกโมเดลของคุณ

AgentsRoom คือศูนย์บัญชาการบนเดสก์ท็อปสำหรับเอเจนต์เขียนโค้ด AI ที่ให้ Claude, Codex, GitHub Copilot CLI, Cursor และ CLI เอเจนต์อีก 10 ตัวทำงานเคียงข้างกัน แต่ละเอเจนต์ใช้โมเดลที่คุณเลือก ความเทียบเท่าในหน้านี้คือชุดเดียวกับที่แอปแสดงให้คุณเห็นขณะเลือก และมีฟีเจอร์อัจฉริยะอีกไม่กี่อย่างที่ช่วยให้คุณเลือกขนาดโมเดลให้พอดีกับงาน

≈ Opus ใต้ทุกโมเดล

ทุกรายการโมเดล (เอเจนต์ใหม่, เปิดใช้ด่วน, ตั๋วใน backlog, แอปมือถือ) จะติดป้ายให้แต่ละโมเดลด้วยตัวเทียบเท่าใน CLI ที่คุณรู้จักดีที่สุด และเรียงตามพลัง ราคา หรือความนิยมได้

โมเดลที่เทียบเท่ากันในแอป

ให้งานเป็นตัวเลือกโมเดล

AI Suggestion เปลี่ยนคำอธิบายบรรทัดเดียวให้เป็นระดับความซับซ้อน (ง่าย, มาตรฐาน, ซับซ้อน, ยากที่สุด) แล้วเปิดเอเจนต์บนโมเดลที่ถูกที่สุดที่เหมาะกับงาน Adaptive Mode ตรวจร่างของคุณ และแนะนำโมเดลที่เบากว่าเมื่อโมเดลเรือธงเกินความจำเป็น

AI Suggestion และ Adaptive Mode

ย้ายงานไปยังโมเดลที่เทียบเท่า

เมื่อบัญชีใกล้ถึงขีดจำกัด กฎโควตาสามารถเริ่มเอเจนต์ใหม่บน CLI อื่นแบบโมเดลต่อโมเดล: Fable, Opus และ Sonnet ต่างไปยังตัวเทียบเท่าในระดับเดียวกัน ซึ่งกรอกไว้ให้ล่วงหน้าจากระดับเหล่านี้

กฎโควตาและการแจ้งเตือนการใช้งาน

โมเดลที่ใช่สำหรับแต่ละตั๋ว

ปักหมุดผู้ให้บริการ โมเดล และระดับการให้เหตุผลไว้บนตั๋วใน backlog เพื่อให้เอเจนต์ที่รันตั๋วนั้นใช้ตามนั้นทุกประการ และเก็บโมเดลเรือธงไว้สำหรับตั๋วที่จำเป็นจริง ๆ

กระดานงาน Backlog

ส่งการทดสอบให้โมเดลที่ถูกกว่า

เอเจนต์นักพัฒนาที่ใช้โมเดลเรือธงส่งงานรันเทสต์ต่อให้เอเจนต์ QA ที่ใช้โมเดลเบากว่าผ่าน MCP โมเดลราคาแพงจึงยังโฟกัสอยู่ที่โค้ด

การมอบหมายเอเจนต์

หนึ่งโมเดลต่อหนึ่งขั้นตอน

ในทีมเอเจนต์ ทุกขั้นตอนมีบทบาท CLI และโมเดลของตัวเอง: สถาปนิกใช้โมเดลแนวหน้า ขั้นลงมือเขียนโค้ดใช้ระดับ Opus ส่วนการรีวิวใช้ระดับไหนก็ได้ที่คุ้มค่า

ทีมเอเจนต์
ดาวน์โหลด AgentsRoom

เจาะลึกเพิ่มเติม