Fable급
Fable 동급 모델(프런티어)
Opus보다 한 단계 위인 프런티어 모델: Codex의 GPT-6 Astra, Codex의 Daybreak Blue 및 Codex의 GPT-5.6 Sol Max.
가장 어려운 문제를 위한 모델로, 가격도 가장 높습니다.
동급 AI 모델
Claude 라인업은 줄줄 꿰고 있는데, Codex나 Gemini, Grok을 열면 어떤 이름도 어느 모델이 Opus 역할을 하는지 알려 주지 않습니다. 이 페이지는 AgentsRoom이 실행하는 모든 코딩 에이전트 CLI의 모든 모델을 하나의 척도 위에 놓아, 각 모델을 이미 아는 말로 읽을 수 있게 합니다.
AgentsRoom 모델 카탈로그에서 실시간으로 읽어 옵니다. 인기도는 2026. 10. 6. PM 4:16 기준입니다.
비교한 CLI
12
등급을 매긴 모델
94
집계한 실행 수(최근 30일)
51,051
Claude를 잣대로 삼은 것은 대부분의 개발자가 아는 라인업이기 때문입니다. 각 항목은 현재 같은 역할을 하는 다른 벤더의 모델을 알려 줍니다.
Fable급
Opus보다 한 단계 위인 프런티어 모델: Codex의 GPT-6 Astra, Codex의 Daybreak Blue 및 Codex의 GPT-5.6 Sol Max.
가장 어려운 문제를 위한 모델로, 가격도 가장 높습니다.
Opus급
Claude Opus 역할을 하는 모델: Codex의 GPT-6.1 Sol, Antigravity의 Gemini 3.1 Pro (High) 및 Grok의 Grok 4.7.
본격적인 코딩 작업 대부분이 돌아가는 플래그십입니다.
Sonnet급
Claude Sonnet 역할을 하는 모델: Codex의 GPT-6 Luna, Codex의 GPT-5.6 Terra, Antigravity의 Gemini 3.8 Flash (High), OpenCode의 GLM 5.3, OpenCode의 Qwen3.8 Max, Aider의 DeepSeek, Mistral Vibe의 Medium 3.5 및 Kimi의 Kimi K3.
균형형: 대부분의 기능 개발에 충분히 강하고, 플래그십보다 저렴합니다.
Haiku급
Claude Haiku 역할을 하는 모델: Codex의 Codex Spark, Ollama의 Qwen3 Coder, Ollama의 GLM 4.6 및 oh-my-pi의 DeepSeek V4 Flash.
가볍고 빠름: 이름 변경, 작은 수정, 요약.
AgentsRoom이 실행하는 CLI마다 한 행, 등급마다 한 열입니다. 현재 모델이 먼저 나오고, 목록에 아직 남아 있는 이전 버전은 그 아래에 개수로 표시됩니다.
| CLI | 프런티어Fable급 | Opus급 | Sonnet급 | Haiku급 |
|---|---|---|---|---|
Fable | OpusOpus 5.5 이전 버전 +2개Opus 5, Opus 4.8 | SonnetSonnet 5.5 이전 버전 +1개Sonnet 5 | Haiku | |
GPT-6 AstraDaybreak BlueDaybreak RedGPT-5.6 Sol Max | GPT-6.1 Sol 이전 버전 +3개GPT-6 Sol, GPT-5.6 Sol, GPT-5.5 | GPT-6 LunaGPT-5.6 Terra 이전 버전 +4개GPT-5.6 Luna, GPT-5, GPT-5.4, GPT-5.2 | Codex Spark 이전 버전 +1개GPT-5.4 Mini | |
| 없음 | Gemini 3.1 Pro (High)Claude Opus 5.5 (High)Claude Opus 5.5 (Medium) | Gemini 3.8 Flash (High)Gemini 3.8 Flash (Medium)Claude Sonnet 5.5 (High)Claude Sonnet 5.5 (Medium) 이전 버전 +5개Gemini 3.7 Flash (High), Gemini 3.7 Flash (Medium), Gemini 3.6 Flash (High), Gemini 3.6 Flash (Medium), Gemini 3.5 Flash (Medium) | 없음 | |
| 없음 | Claude Opus | Claude SonnetGPT-5Kimi K3GLM 5.3Qwen3.8 Max | 없음 | |
| 없음 | Claude Opus | Claude SonnetDeepSeek | GPT-4o | |
| 없음 | Grok 4.7 | 없음 | 없음 | |
| 없음 | 없음 | Medium 3.5 | 없음 | |
| 없음 | 없음 | Qwen3 Coder 480B | Gemma 3Qwen3 CoderGLM 4.6 | |
GPT-6 Astra | GPT-6.1 SolClaude Opus 5.5GPT-5.5 이전 버전 +5개GPT-6 Sol, Claude Opus 5, GPT-5.6 Sol, Claude Opus 4.8, Claude Opus 4.7 | Claude Sonnet 5.5GPT-6 LunaGPT-5.6 TerraGemini 3.7 FlashKimi K3 이전 버전 +4개Claude Sonnet 5, GPT-5.6 Luna, Claude Sonnet 4.6, Gemini 3.6 Flash | Claude Haiku 4.5MAI-Code-1.1-Flash | |
| 없음 | 없음 | Kimi K3Kimi K3-256KKimi K2.8 PreviewK2.7 Code HighSpeed | 없음 | |
| 없음 | Claude Opus 5.5GPT-6 Sol | Claude Sonnet 5Gemini FlashGLM 5.3 이전 버전 +1개GLM 5.2 | DeepSeek V4 Flash | |
| 없음 | Claude OpusGPTCodexGemini | SWEClaude SonnetGLMKimiDeepSeek | Claude Haiku | |
| 요청마다 모델을 대신 골라 줍니다: 고정된 등급이 없습니다. | ||||
| 요청마다 모델을 대신 골라 줍니다: 고정된 등급이 없습니다. | ||||
| 요청마다 모델을 대신 골라 줍니다: 고정된 등급이 없습니다. | ||||
모델 계열은 그 벤더의 도구에 묶여 있지 않습니다. 현재 두 개 이상의 CLI가 제공하는 모든 계열을, 각 CLI가 붙인 이름과 함께 보여 줍니다.
CLI 7개
CLI 7개
CLI 4개
CLI 4개
CLI 3개
CLI 3개
CLI 3개
CLI 3개
CLI 2개
CLI 2개
CLI 2개
CLI 2개
최근 30일 동안 AgentsRoom 사용자들이 가장 많이 실행한 모델을 등급 기준으로 읽었습니다. 동급 비교는 어떤 모델이 같은 역할을 하는지, 실행 수는 사람들이 실제로 무엇을 고르는지 알려 줍니다.
OpusOpus급
실행의 22.9%
SonnetSonnet급
실행의 12.8%
Opus 5.5Opus급
실행의 9.4%
GPT-5.6 SolOpus급
실행의 5%
GPT-6 LunaSonnet급
실행의 4.9%
Claude를 기준으로 한, 네 등급으로 된 하나의 척도입니다: Fable급(프런티어), Opus급(플래그십), Sonnet급(균형형), Haiku급(경량). 모든 모델 계열은 벤더가 자사 라인업에서 부여한 역할에 따라 등급을 받고, 같은 계열은 그것을 제공하는 모든 CLI에서 같은 등급을 유지합니다.
OpenAI의 경우 Astra가 프런티어 모델, Sol이 플래그십, Luna와 Terra가 균형형 모델, Spark와 mini 모델들이 경량 모델입니다. Gemini Pro는 Opus급, Gemini Flash는 Sonnet급에 속합니다. Grok Heavy는 프런티어이고 Grok 자체는 Opus급입니다.
오픈 웨이트 계열(Kimi, GLM, DeepSeek, Qwen 등)은 최대 Sonnet급까지만 두고, 그 경량 버전은 Haiku급에 둡니다. 두 등급 사이에서 표는 항상 낮은 쪽을 고릅니다. 입증하지 않은 모델을 두고 Opus를 대신할 수 있다고 말하느니, 차라리 낮게 평가하는 편을 택합니다.
라우터는 요청마다 모델을 고르기 때문에 등급이 없습니다: GitHub Copilot(Auto), Amp(Amp default), Freebuff(Freebuff default), Devin(Adaptive) 및 Cursor(Default). 표가 아직 모르는 계열도 마찬가지입니다. 틀린 동급 표시보다는 동급 표시가 없는 편이 낫습니다.
등급은 벤치마크 점수가 아닙니다. 같은 등급의 두 모델이라도 가격, 속도, 컨텍스트 윈도우, 사용 한도, 가장 잘하는 작업이 다릅니다. 표로 어디를 볼지 정한 다음, 당신의 작업에서 두 모델을 모두 시험해 보세요.
데이터: AgentsRoom이 데스크톱 앱과 모바일 앱에 제공하는 모델 카탈로그(방문할 때마다 읽음)와, 앱이 모든 모델 목록 아래에서 적용하는 등급 규칙. 인기도: 사용 데이터를 공유하는 AgentsRoom 사용자의 최근 30일간 실제 에이전트 실행이며, 10분마다 새로고침됩니다.
GPT-6.1 Sol입니다. 위 표에서 Claude Opus와 GPT-6.1 Sol 모두 Opus급에 속합니다. 본격적인 코딩 작업 대부분이 돌아가는 플래그십이며, 프런티어 등급보다 한 단계 아래입니다. Codex의 프런티어 모델, 즉 Fable에 해당하는 모델은 GPT-6 Astra입니다. Sonnet급 작업이라면 Codex 모델은 GPT-6 Luna입니다. 그리고 목록의 Haiku급 모델은 Codex Spark입니다.
Antigravity의 Gemini 3.1 Pro (High)입니다. Gemini Pro는 Google의 플래그십 라인이므로 Opus급에 속합니다. Sonnet 역할은 Gemini Flash가 맡습니다. 현재는 Gemini 3.8 Flash (High)입니다.
Codex의 GPT-6 Luna입니다. OpenAI의 균형형 라인은 Sonnet급에 속합니다. 대부분의 기능 개발에 충분히 강하고, 플래그십보다 저렴합니다.
Codex의 Codex Spark입니다. 라인업에서 가볍고 빠른 모델로, 이름 변경, 작은 수정, 간단한 질문에 알맞습니다.
같은 등급이라고 해서 결과가 같은 것은 아닙니다. GPT-6.1 Sol, Opus 5.5 두 모델은 각 벤더의 라인업에서 같은 역할을 하지만, 가격, 속도, 컨텍스트 윈도우, 사용 한도, 가장 잘 처리하는 작업은 여전히 다르고, 둘 사이의 벤치마크 순위도 새 버전이 나올 때마다 바뀝니다. 믿을 만한 답은 당신의 같은 작업에 두 모델을 모두 돌려 보는 것입니다. AgentsRoom은 같은 프로젝트에서 각 모델에 에이전트를 하나씩 나란히 실행합니다.
현재 Opus는 Antigravity, OpenCode, Aider, GitHub Copilot, oh-my-pi 및 Devin의 모델 목록에도 각 CLI가 붙인 이름으로 들어 있습니다. 같은 계열이면 같은 등급입니다. 어느 CLI가 제공하든 동급 관계는 바뀌지 않습니다.
척도는 모델이 하는 역할을 따르고, 절대 과대평가하지 않기 때문입니다. 오픈 웨이트 계열은 비용 대비 성능이 뛰어난 경우가 많고 여러 CLI가 제공하지만, 그중 하나를 Opus급에 두면 어떤 작업에서든 Opus를 대신할 수 있다고 말하는 셈입니다. 그것을 전반적으로 입증한 계열은 아직 없습니다. 경량 버전은 Haiku급에 속합니다.
모델이 아니기 때문입니다. GitHub Copilot(Auto), Amp(Amp default), Freebuff(Freebuff default), Devin(Adaptive) 및 Cursor(Default) 모두 요청마다 서비스가 모델을 고르게 하므로, 비교할 고정된 성능이 없습니다. 표는 추측하기보다 이들을 빼 둡니다.
페이지를 열 때마다, AgentsRoom 앱이 모든 데스크톱과 휴대폰에 제공하는 것과 같은 모델 카탈로그로 계산합니다. CLI가 출시한 모델을 AgentsRoom이 추가하면 곧바로 해당 등급으로 여기에 나타나고, 그 모델이 대체하는 버전에는 이전 버전 표시가 붙습니다. 인기를 나타내는 불꽃 아이콘은 최근 30일간의 실행을 바탕으로 10분마다 새로고침됩니다.
네, 두 가지 방법이 있고 둘 다 제안만 합니다. AI Suggestion은 세션이 열리기 전에 작업의 규모를 가늠해(간단, 표준, 복잡, 최고 난도) 그 작업을 아직 해낼 수 있는 해당 CLI의 가장 저렴한 모델로 에이전트를 엽니다. Adaptive Mode는 CLI가 실행된 뒤 초안을 읽고, 작업에 플래그십이 필요 없으면 더 가벼운 모델을 제안하거나 지금 모델이 맞다고 알려 줍니다.
AgentsRoom에서는
AgentsRoom은 AI 코딩 에이전트를 위한 데스크톱 지휘 센터입니다. Claude, Codex, GitHub Copilot CLI, Cursor 및 그 외 에이전트 CLI 10개가 나란히 실행되고, 각 에이전트는 당신이 고른 모델로 돌아갑니다. 이 페이지의 동급 관계는 모델을 고를 때 앱이 보여 주는 것과 같으며, 몇 가지 스마트 기능이 작업에 맞는 모델을 고르도록 돕습니다.
모든 모델 목록(새 에이전트, 퀵 에이전트, 백로그 티켓, 모바일 앱)이 각 모델에 당신이 가장 잘 아는 CLI의 동급 모델을 태그로 붙이고, 성능, 가격, 인기순으로 정렬합니다.
앱 속 동급 모델AI Suggestion은 한 줄 설명을 복잡도 단계(간단, 표준, 복잡, 최고 난도)로 바꾸고, 그에 맞는 가장 저렴한 모델로 에이전트를 엽니다. Adaptive Mode는 초안을 확인하고, 플래그십이 과할 때 더 가벼운 모델을 제안합니다.
AI Suggestion과 Adaptive Mode계정이 한도에 가까워지면, 할당량 규칙이 새 에이전트를 모델별로 다른 CLI에서 시작할 수 있습니다. Fable, Opus, Sonnet은 각각 같은 등급의 동급 모델로 가며, 이 대응은 이 등급을 바탕으로 미리 채워집니다.
할당량 규칙과 사용량 알림백로그 티켓에 프로바이더, 모델, 추론 강도를 고정하면 그 티켓을 실행하는 에이전트가 정확히 그대로 사용합니다. 플래그십은 꼭 필요한 티켓에만 남겨 두세요.
백로그 작업 보드플래그십 모델로 도는 개발 에이전트가 MCP를 통해 테스트 실행을 더 가벼운 모델의 QA 에이전트에 넘기므로, 비싼 모델은 코드에만 집중합니다.
에이전트 위임에이전트 팀에서는 단계마다 고유한 역할, CLI, 모델이 있습니다. 아키텍트는 프런티어 모델, 구현 담당은 Opus급, 리뷰어는 비용 대비 효과가 있는 곳에 둡니다.
에이전트 팀Claude Code와 Codex CLI를 솔직하게 비교한다. 가격, 속도, MCP, 통제권까지. 그리고 몇 주를 써보고 나서 왜 둘 중 하나를 고르길 그만뒀는지 이야기한다.
이제 Ollama가 AgentsRoom의 프로바이더가 되었습니다. Llama, Qwen, Gemma, DeepSeek 같은 로컬 오픈소스 모델을 클라우드 에이전트와 나란히 실행하고, 에이전트마다 로컬-클라우드 다이얼을 설정하세요. 대화 중에도 전환할 수 있습니다.