동급 AI 모델

동급 AI 모델: 모든 코딩 CLI의 Opus, Sonnet, Haiku

Claude 라인업은 줄줄 꿰고 있는데, Codex나 Gemini, Grok을 열면 어떤 이름도 어느 모델이 Opus 역할을 하는지 알려 주지 않습니다. 이 페이지는 AgentsRoom이 실행하는 모든 코딩 에이전트 CLI의 모든 모델을 하나의 척도 위에 놓아, 각 모델을 이미 아는 말로 읽을 수 있게 합니다.

AgentsRoom 모델 카탈로그에서 실시간으로 읽어 옵니다. 인기도는 2026. 10. 6. PM 4:16 기준입니다.

비교한 CLI

12

등급을 매긴 모델

94

집계한 실행 수(최근 30일)

51,051

결론부터

Claude를 잣대로 삼은 것은 대부분의 개발자가 아는 라인업이기 때문입니다. 각 항목은 현재 같은 역할을 하는 다른 벤더의 모델을 알려 줍니다.

Fable급

Fable 동급 모델(프런티어)

Opus보다 한 단계 위인 프런티어 모델: Codex의 GPT-6 Astra, Codex의 Daybreak Blue 및 Codex의 GPT-5.6 Sol Max.

가장 어려운 문제를 위한 모델로, 가격도 가장 높습니다.

Opus급

Opus 동급 모델

Claude Opus 역할을 하는 모델: Codex의 GPT-6.1 Sol, Antigravity의 Gemini 3.1 Pro (High) 및 Grok의 Grok 4.7.

본격적인 코딩 작업 대부분이 돌아가는 플래그십입니다.

Sonnet급

Sonnet 동급 모델

Claude Sonnet 역할을 하는 모델: Codex의 GPT-6 Luna, Codex의 GPT-5.6 Terra, Antigravity의 Gemini 3.8 Flash (High), OpenCode의 GLM 5.3, OpenCode의 Qwen3.8 Max, Aider의 DeepSeek, Mistral Vibe의 Medium 3.5 및 Kimi의 Kimi K3.

균형형: 대부분의 기능 개발에 충분히 강하고, 플래그십보다 저렴합니다.

Haiku급

Haiku 동급 모델

Claude Haiku 역할을 하는 모델: Codex의 Codex Spark, Ollama의 Qwen3 Coder, Ollama의 GLM 4.6 및 oh-my-pi의 DeepSeek V4 Flash.

가볍고 빠름: 이름 변경, 작은 수정, 요약.

모든 코딩 CLI를 등급별로

AgentsRoom이 실행하는 CLI마다 한 행, 등급마다 한 열입니다. 현재 모델이 먼저 나오고, 목록에 아직 남아 있는 이전 버전은 그 아래에 개수로 표시됩니다.

코딩 에이전트 CLI와 성능 등급별 동급 AI 모델
CLI프런티어Fable급Opus급Sonnet급Haiku급
Claude
Fable
OpusOpus 5.5
이전 버전 +2개

Opus 5, Opus 4.8

SonnetSonnet 5.5
이전 버전 +1개

Sonnet 5

Haiku
Codex
GPT-6 AstraDaybreak BlueDaybreak RedGPT-5.6 Sol Max
GPT-6.1 Sol
이전 버전 +3개

GPT-6 Sol, GPT-5.6 Sol, GPT-5.5

GPT-6 LunaGPT-5.6 Terra
이전 버전 +4개

GPT-5.6 Luna, GPT-5, GPT-5.4, GPT-5.2

Codex Spark
이전 버전 +1개

GPT-5.4 Mini

Antigravity없음
Gemini 3.1 Pro (High)Claude Opus 5.5 (High)Claude Opus 5.5 (Medium)
Gemini 3.8 Flash (High)Gemini 3.8 Flash (Medium)Claude Sonnet 5.5 (High)Claude Sonnet 5.5 (Medium)
이전 버전 +5개

Gemini 3.7 Flash (High), Gemini 3.7 Flash (Medium), Gemini 3.6 Flash (High), Gemini 3.6 Flash (Medium), Gemini 3.5 Flash (Medium)

없음
OpenCode없음
Claude Opus
Claude SonnetGPT-5Kimi K3GLM 5.3Qwen3.8 Max
없음
Aider없음
Claude Opus
Claude SonnetDeepSeek
GPT-4o
Grok없음
Grok 4.7
없음없음
Mistral Vibe없음없음
Medium 3.5
없음
Ollama없음없음
Qwen3 Coder 480B
Gemma 3Qwen3 CoderGLM 4.6
GitHub Copilot
GPT-6 Astra
GPT-6.1 SolClaude Opus 5.5GPT-5.5
이전 버전 +5개

GPT-6 Sol, Claude Opus 5, GPT-5.6 Sol, Claude Opus 4.8, Claude Opus 4.7

Claude Sonnet 5.5GPT-6 LunaGPT-5.6 TerraGemini 3.7 FlashKimi K3
이전 버전 +4개

Claude Sonnet 5, GPT-5.6 Luna, Claude Sonnet 4.6, Gemini 3.6 Flash

Claude Haiku 4.5MAI-Code-1.1-Flash
Kimi없음없음
Kimi K3Kimi K3-256KKimi K2.8 PreviewK2.7 Code HighSpeed
없음
oh-my-pi없음
Claude Opus 5.5GPT-6 Sol
Claude Sonnet 5Gemini FlashGLM 5.3
이전 버전 +1개

GLM 5.2

DeepSeek V4 Flash
Devin없음
Claude OpusGPTCodexGemini
SWEClaude SonnetGLMKimiDeepSeek
Claude Haiku
Amp요청마다 모델을 대신 골라 줍니다: 고정된 등급이 없습니다.
Freebuff요청마다 모델을 대신 골라 줍니다: 고정된 등급이 없습니다.
Cursor요청마다 모델을 대신 골라 줍니다: 고정된 등급이 없습니다.
  • 해당 CLI에서 커뮤니티가 가장 많이 실행하는 모델 3개 중 하나
  • 이전 버전: 같은 모델의 새 세대가 같은 목록에 있습니다

같은 모델, 여러 CLI

모델 계열은 그 벤더의 도구에 묶여 있지 않습니다. 현재 두 개 이상의 CLI가 제공하는 모든 계열을, 각 CLI가 붙인 이름과 함께 보여 줍니다.

Claude Opus

Opus급

CLI 7개

  • ClaudeOpus 5.5
  • AntigravityClaude Opus 5.5 (High)
  • OpenCodeClaude Opus
  • AiderClaude Opus
  • GitHub CopilotClaude Opus 5.5
  • oh-my-piClaude Opus 5.5
  • DevinClaude Opus

Claude Sonnet

Sonnet급

CLI 7개

  • ClaudeSonnet 5.5
  • AntigravityClaude Sonnet 5.5 (High)
  • OpenCodeClaude Sonnet
  • AiderClaude Sonnet
  • GitHub CopilotClaude Sonnet 5.5
  • oh-my-piClaude Sonnet 5
  • DevinClaude Sonnet

Kimi

Sonnet급

CLI 4개

  • KimiKimi K3
  • OpenCodeKimi K3
  • GitHub CopilotKimi K3
  • DevinKimi

GLM

Sonnet급

CLI 4개

  • OpenCodeGLM 5.3
  • OllamaGLM 4.6
  • oh-my-piGLM 5.3
  • DevinGLM

Claude Haiku

Haiku급

CLI 3개

  • ClaudeHaiku
  • GitHub CopilotClaude Haiku 4.5
  • DevinClaude Haiku

GPT Sol

Opus급

CLI 3개

  • CodexGPT-6.1 Sol
  • GitHub CopilotGPT-6.1 Sol
  • oh-my-piGPT-6 Sol

Gemini Flash

Sonnet급

CLI 3개

  • AntigravityGemini 3.8 Flash (High)
  • GitHub CopilotGemini 3.7 Flash
  • oh-my-piGemini Flash

DeepSeek

Sonnet급

CLI 3개

  • AiderDeepSeek
  • oh-my-piDeepSeek V4 Flash
  • DevinDeepSeek

GPT Astra

Fable급

CLI 2개

  • CodexGPT-6 Astra
  • GitHub CopilotGPT-6 Astra

GPT Luna

Sonnet급

CLI 2개

  • CodexGPT-6 Luna
  • GitHub CopilotGPT-6 Luna

GPT Terra

Sonnet급

CLI 2개

  • CodexGPT-5.6 Terra
  • GitHub CopilotGPT-5.6 Terra

Qwen

Sonnet급

CLI 2개

  • OpenCodeQwen3.8 Max
  • OllamaQwen3 Coder

개발자들이 실제로 실행하는 모델

최근 30일 동안 AgentsRoom 사용자들이 가장 많이 실행한 모델을 등급 기준으로 읽었습니다. 동급 비교는 어떤 모델이 같은 역할을 하는지, 실행 수는 사람들이 실제로 무엇을 고르는지 알려 줍니다.

  1. 1

    OpusOpus급

    Claude멤버 439명

    실행의 22.9%

  2. 2

    SonnetSonnet급

    Claude멤버 173명

    실행의 12.8%

  3. 3

    Opus 5.5Opus급

    Claude멤버 103명

    실행의 9.4%

  4. 4

    GPT-5.6 SolOpus급

    Codex멤버 119명

    실행의 5%

  5. 5

    GPT-6 LunaSonnet급

    Codex멤버 47명

    실행의 4.9%

CLI별, 모델별 전체 사용 통계

등급을 매기는 방법

Claude를 기준으로 한, 네 등급으로 된 하나의 척도입니다: Fable급(프런티어), Opus급(플래그십), Sonnet급(균형형), Haiku급(경량). 모든 모델 계열은 벤더가 자사 라인업에서 부여한 역할에 따라 등급을 받고, 같은 계열은 그것을 제공하는 모든 CLI에서 같은 등급을 유지합니다.

OpenAI의 경우 Astra가 프런티어 모델, Sol이 플래그십, Luna와 Terra가 균형형 모델, Spark와 mini 모델들이 경량 모델입니다. Gemini Pro는 Opus급, Gemini Flash는 Sonnet급에 속합니다. Grok Heavy는 프런티어이고 Grok 자체는 Opus급입니다.

오픈 웨이트 계열(Kimi, GLM, DeepSeek, Qwen 등)은 최대 Sonnet급까지만 두고, 그 경량 버전은 Haiku급에 둡니다. 두 등급 사이에서 표는 항상 낮은 쪽을 고릅니다. 입증하지 않은 모델을 두고 Opus를 대신할 수 있다고 말하느니, 차라리 낮게 평가하는 편을 택합니다.

라우터는 요청마다 모델을 고르기 때문에 등급이 없습니다: GitHub Copilot(Auto), Amp(Amp default), Freebuff(Freebuff default), Devin(Adaptive) 및 Cursor(Default). 표가 아직 모르는 계열도 마찬가지입니다. 틀린 동급 표시보다는 동급 표시가 없는 편이 낫습니다.

등급은 벤치마크 점수가 아닙니다. 같은 등급의 두 모델이라도 가격, 속도, 컨텍스트 윈도우, 사용 한도, 가장 잘하는 작업이 다릅니다. 표로 어디를 볼지 정한 다음, 당신의 작업에서 두 모델을 모두 시험해 보세요.

데이터: AgentsRoom이 데스크톱 앱과 모바일 앱에 제공하는 모델 카탈로그(방문할 때마다 읽음)와, 앱이 모든 모델 목록 아래에서 적용하는 등급 규칙. 인기도: 사용 데이터를 공유하는 AgentsRoom 사용자의 최근 30일간 실제 에이전트 실행이며, 10분마다 새로고침됩니다.

자주 묻는 질문

Claude Opus에 해당하는 Codex 모델은 무엇인가요?

GPT-6.1 Sol입니다. 위 표에서 Claude Opus와 GPT-6.1 Sol 모두 Opus급에 속합니다. 본격적인 코딩 작업 대부분이 돌아가는 플래그십이며, 프런티어 등급보다 한 단계 아래입니다. Codex의 프런티어 모델, 즉 Fable에 해당하는 모델은 GPT-6 Astra입니다. Sonnet급 작업이라면 Codex 모델은 GPT-6 Luna입니다. 그리고 목록의 Haiku급 모델은 Codex Spark입니다.

Claude Opus에 해당하는 Gemini 모델은 무엇인가요?

Antigravity의 Gemini 3.1 Pro (High)입니다. Gemini Pro는 Google의 플래그십 라인이므로 Opus급에 속합니다. Sonnet 역할은 Gemini Flash가 맡습니다. 현재는 Gemini 3.8 Flash (High)입니다.

Claude Sonnet에 해당하는 GPT 모델은 무엇인가요?

Codex의 GPT-6 Luna입니다. OpenAI의 균형형 라인은 Sonnet급에 속합니다. 대부분의 기능 개발에 충분히 강하고, 플래그십보다 저렴합니다.

Claude Haiku에 해당하는 OpenAI 모델은 무엇인가요?

Codex의 Codex Spark입니다. 라인업에서 가볍고 빠른 모델로, 이름 변경, 작은 수정, 간단한 질문에 알맞습니다.

GPT-6.1 Sol도 Opus 5.5만큼 좋은가요?

같은 등급이라고 해서 결과가 같은 것은 아닙니다. GPT-6.1 Sol, Opus 5.5 두 모델은 각 벤더의 라인업에서 같은 역할을 하지만, 가격, 속도, 컨텍스트 윈도우, 사용 한도, 가장 잘 처리하는 작업은 여전히 다르고, 둘 사이의 벤치마크 순위도 새 버전이 나올 때마다 바뀝니다. 믿을 만한 답은 당신의 같은 작업에 두 모델을 모두 돌려 보는 것입니다. AgentsRoom은 같은 프로젝트에서 각 모델에 에이전트를 하나씩 나란히 실행합니다.

Claude Code 밖에서 Claude Opus를 어디서 쓸 수 있나요?

현재 Opus는 Antigravity, OpenCode, Aider, GitHub Copilot, oh-my-pi 및 Devin의 모델 목록에도 각 CLI가 붙인 이름으로 들어 있습니다. 같은 계열이면 같은 등급입니다. 어느 CLI가 제공하든 동급 관계는 바뀌지 않습니다.

표는 왜 Kimi, GLM, Qwen을 Sonnet급까지만 두나요?

척도는 모델이 하는 역할을 따르고, 절대 과대평가하지 않기 때문입니다. 오픈 웨이트 계열은 비용 대비 성능이 뛰어난 경우가 많고 여러 CLI가 제공하지만, 그중 하나를 Opus급에 두면 어떤 작업에서든 Opus를 대신할 수 있다고 말하는 셈입니다. 그것을 전반적으로 입증한 계열은 아직 없습니다. 경량 버전은 Haiku급에 속합니다.

Auto와 Default에는 왜 동급 모델이 없나요?

모델이 아니기 때문입니다. GitHub Copilot(Auto), Amp(Amp default), Freebuff(Freebuff default), Devin(Adaptive) 및 Cursor(Default) 모두 요청마다 서비스가 모델을 고르게 하므로, 비교할 고정된 성능이 없습니다. 표는 추측하기보다 이들을 빼 둡니다.

이 표는 얼마나 최신인가요?

페이지를 열 때마다, AgentsRoom 앱이 모든 데스크톱과 휴대폰에 제공하는 것과 같은 모델 카탈로그로 계산합니다. CLI가 출시한 모델을 AgentsRoom이 추가하면 곧바로 해당 등급으로 여기에 나타나고, 그 모델이 대체하는 버전에는 이전 버전 표시가 붙습니다. 인기를 나타내는 불꽃 아이콘은 최근 30일간의 실행을 바탕으로 10분마다 새로고침됩니다.

AgentsRoom이 내 작업에 맞는 모델을 골라 줄 수 있나요?

네, 두 가지 방법이 있고 둘 다 제안만 합니다. AI Suggestion은 세션이 열리기 전에 작업의 규모를 가늠해(간단, 표준, 복잡, 최고 난도) 그 작업을 아직 해낼 수 있는 해당 CLI의 가장 저렴한 모델로 에이전트를 엽니다. Adaptive Mode는 CLI가 실행된 뒤 초안을 읽고, 작업에 플래그십이 필요 없으면 더 가벼운 모델을 제안하거나 지금 모델이 맞다고 알려 줍니다.

AgentsRoom에서는

AgentsRoom은 모델 선택기 안에서 바로 답합니다

AgentsRoom은 AI 코딩 에이전트를 위한 데스크톱 지휘 센터입니다. Claude, Codex, GitHub Copilot CLI, Cursor 및 그 외 에이전트 CLI 10개가 나란히 실행되고, 각 에이전트는 당신이 고른 모델로 돌아갑니다. 이 페이지의 동급 관계는 모델을 고를 때 앱이 보여 주는 것과 같으며, 몇 가지 스마트 기능이 작업에 맞는 모델을 고르도록 돕습니다.

모든 모델 아래에 ≈ Opus

모든 모델 목록(새 에이전트, 퀵 에이전트, 백로그 티켓, 모바일 앱)이 각 모델에 당신이 가장 잘 아는 CLI의 동급 모델을 태그로 붙이고, 성능, 가격, 인기순으로 정렬합니다.

앱 속 동급 모델

작업이 모델을 고르게 하세요

AI Suggestion은 한 줄 설명을 복잡도 단계(간단, 표준, 복잡, 최고 난도)로 바꾸고, 그에 맞는 가장 저렴한 모델로 에이전트를 엽니다. Adaptive Mode는 초안을 확인하고, 플래그십이 과할 때 더 가벼운 모델을 제안합니다.

AI Suggestion과 Adaptive Mode

동급 모델로 넘기기

계정이 한도에 가까워지면, 할당량 규칙이 새 에이전트를 모델별로 다른 CLI에서 시작할 수 있습니다. Fable, Opus, Sonnet은 각각 같은 등급의 동급 모델로 가며, 이 대응은 이 등급을 바탕으로 미리 채워집니다.

할당량 규칙과 사용량 알림

티켓마다 알맞은 모델

백로그 티켓에 프로바이더, 모델, 추론 강도를 고정하면 그 티켓을 실행하는 에이전트가 정확히 그대로 사용합니다. 플래그십은 꼭 필요한 티켓에만 남겨 두세요.

백로그 작업 보드

테스트는 더 저렴한 모델에 맡기세요

플래그십 모델로 도는 개발 에이전트가 MCP를 통해 테스트 실행을 더 가벼운 모델의 QA 에이전트에 넘기므로, 비싼 모델은 코드에만 집중합니다.

에이전트 위임

단계마다 다른 모델

에이전트 팀에서는 단계마다 고유한 역할, CLI, 모델이 있습니다. 아키텍트는 프런티어 모델, 구현 담당은 Opus급, 리뷰어는 비용 대비 효과가 있는 곳에 둡니다.

에이전트 팀
AgentsRoom 다운로드

더 알아보기