Adaptive Mode: умная маршрутизация моделей

Нужная модель ИИ под каждую задачу,
выбранная автоматически, ещё до отправки

Adaptive Mode читает промпт, который вы собираетесь отправить, и подсказывает самую экономичную модель под задачу. Исправление опечатки или перевод уходят на лёгкую дешёвую модель. Крупный рефакторинг или проектирование архитектуры уходят на флагман. Вы платите только за ту мощность, которая вам действительно нужна.

Маленькие модели стоят малую долю от флагмана. Подбирая модель под каждую задачу, вы расходуете на задачу куда меньше бюджета тарифа, поэтому успеваете больше задач в день, не упираясь в лимит использования. Один клик применяет подсказку, и вы продолжаете работать.

Adaptive Mode
Анализ задачи
Перевести строку интерфейса
Оптимально
Haiku
Sonnet
Opus
Стоимость задачиБольше задач в день

Adaptive Mode сопоставляет каждую задачу с самой дешёвой моделью, которая сделает её хорошо: Haiku для лёгкой работы, Sonnet для сбалансированной, Opus для тяжёлой. Меньше затрат на задачу, больше задач в день.

Экран намерения AI Suggestion в AgentsRoom: агенты-кандидаты, поле описания задачи, provider, задействованные папки и пятиуровневая шкала сложности задачи с Haiku, Sonnet, Opus и Fable и их стоимостью
Одна фраза определяет агента, модель и имя сессии, ещё до запуска CLI.

Вот в чём денежная проблема при работе с ИИ-агентами кодинга. У каждой модели своя цена, и разрыв между дешёвой и флагманом огромен. Claude Opus самая способная и самая дорогая модель. Claude Haiku самая дешёвая. Claude Sonnet посередине. Большинство выбирают одну модель и оставляют её, поэтому либо недодают мощности сложным задачам, либо, что гораздо чаще, переплачивают за лёгкие.

Подумайте, о чём вы на самом деле просите агента за день. Исправить опечатку. Переименовать переменную. Перевести строку интерфейса. Написать короткий юнит-тест. Сделать краткое содержание документа. Ничему из этого не нужен флагман. Если запускать всё это на Opus, вы сжигаете бюджет тарифа в разы быстрее, чем нужно, ради того же результата. Эти потери незаметны, и именно поэтому они накапливаются.

Adaptive Mode закрывает этот разрыв. Перед отправкой первого сообщения он читает ваш черновик, оценивает, насколько задача на самом деле сложна, и подсказывает самую дешёвую модель из линейки вашего provider, которая всё ещё сделает работу хорошо. Тяжёлые модели остаются зарезервированными под работу, которая их заслуживает: архитектуру, аудиты безопасности, крупные рефакторинги. Всё остальное уходит на модель, которая стоит малую долю от этого.

Зачем подбирать модель под задачу

Перестаньте переплачивать за лёгкие задачи. Флагман на исправлении опечатки это деньги на ветер. Adaptive Mode направляет лёгкую работу на лёгкую модель, поэтому каждая мелкая задача стоит малую долю от того, во что обошлась бы на верхнем уровне.

Берегите мощную модель для сложных задач. Подбор не означает всегда брать подешевле. Когда задача это проектирование системы или аудит безопасности, Adaptive Mode говорит подняться выше, чтобы работа, требующая глубины, действительно её получила.

Больше задач в день на том же тарифе. Меньше бюджета на задачу значит, что лимит использования наступит позже. За целый день и на флоте агентов в параллель экономия складывается в реальную дополнительную пропускную способность.

Ноль трения в рабочем процессе. Подсказка появляется маленьким чипом над полем ввода ещё до отправки. Один клик её применяет. Не нужно рыться в меню, вручную гадать, какая модель подходит, и терять в скорости.

Экономика: потреблять меньше, делать больше

Те же агенты, тот же тариф. Разница в том, сколько бюджета съедает каждая задача.

Одна модель на всё

  • : Каждая задача идёт на той модели, которую вы оставили выбранной.
  • : Флагман на опечатке или переводе стоит в разы больше, чем должен.
  • : Бюджет использования вашего тарифа быстро утекает на работу, которой эта мощность была не нужна.
  • : Вы упираетесь в лимит использования раньше в течение дня, и агенты встают.
  • : Менять модель вручную муторно, поэтому никто этого не делает.

Adaptive Mode включён

  • : Каждая задача сопоставлена с самой дешёвой моделью, которая сделает её хорошо.
  • : Лёгкая работа уходит на лёгкую модель и стоит малую долю от прежнего.
  • : Флагман приберегается для рефакторингов, аудитов и архитектуры.
  • : Меньше бюджета на задачу значит больше задач до любого лимита использования.
  • : Один клик применяет нужную модель, поэтому подбор действительно происходит.

Сама маршрутизация почти бесплатна: маленькая быстрая модель делает анализ за сильно меньше цента, а затем уходит в сторону.

AI Suggestion

Скажите, в чём задача.
Агент откроется на нужной модели.

AI Suggestion переносит то же самое решение раньше, в единственный момент, когда оно ничего не стоит: до того, как сессия появилась. Вы открываете агента и вместо терминала видите одно поле с вопросом, что этот агент сейчас будет делать. Вы отвечаете одной фразой. Один запрос читает её и возвращает модель, имя сессии и, если агента вы не выбирали, того, кто должен взять задачу.

Затем сессия открывается уже настроенной, а ваша фраза уходит первым сообщением. Вы ничего не вставляли, не ждали загрузки CLI, чтобы всё поправить, и не платили по тарифу флагмана за опечатку.

AI Suggestion
До открытия сессии
Исправить опечатку на кнопке входа
Сложность задачи
Быстрая
Стандартная
Сложная
Экстремальная
МодельHaikuвместо Opus, вашей модели по умолчанию
СессияОпечатка на кнопке входа

Входит одна фраза. Загорается один уровень сложности. Агент открывается на модели, которой этот уровень соответствует, а сессия уже названа.

Настоящая сессия, от пустого поля до работающего агента: одна фраза описывает задачу, шкала сложности останавливается на Sonnet, агент и имя сессии приходят вместе с ней, а сессия открывается с уже отправленной фразой.

Почему решение должно приниматься до открытия сессии

Та же подсказка, та же модель, два совершенно разных исхода. Единственная переменная: момент, когда вас спрашивают.

Спросили после того, как терминал открылся

  • : CLI уже стартовал на той модели, которая была настроена.
  • : Ваш промпт написан, и вы в одном нажатии от отправки.
  • : Сменить модель сейчас означает выбросить только что начатую сессию.
  • : Подсказка воспринимается как помеха, поэтому её закрывают.
  • : Флагман всё равно берёт тривиальную задачу, и никто ничему не научился.

Спросили до того, как сессия появилась

  • : Ничего ещё не запущено, значит, и отменять нечего.
  • : Вы и так описываете задачу, а это ровно тот ввод, который нужен решению.
  • : Модель, имя сессии и агент определяются за один запрос.
  • : Сессия открывается настроенной, а ваше описание уходит первым сообщением.
  • : Выбрать дешёвую модель вам ничего не стоит, поэтому это действительно происходит.

В этом вся идея. Не более умная подсказка, а та же самая, просто заданная в момент, когда сказать «да» ничего не стоит.

Четыре уровня, привязанные к реальным моделям вашего провайдера

Шкала сложности: видимая часть решения. Оставьте её на «Авто», и анализ подсветит один уровень. Нажмите уровень сами, и он станет вашим решением: ничего не отправляется, сессия открывается сразу.

Быстрая

01

Правка текста или конфигурации, без всякой логики за ней. Опечатка, подпись, строка перевода, номер версии. Это тот уровень, который флагманская модель не должна видеть никогда, и именно он достаётся ей чаще всего.

Стандартная

02

Небольшое изменение, решение для которого уже известно. Добавить состояние кнопке, подключить готовый компонент, написать короткий тест. Расследовать нечего, есть только работа.

Сложная

03

Функция, которую надо построить, баг, который надо расследовать, рефакторинг, который надо провести. Путь неочевиден с самого начала, поэтому модели нужен запас, чтобы осмотреться, прежде чем выбрать подход.

Экстремальная

04

Архитектура, аудит, проблема без известной причины. Ради этого флагманская модель и существует, и именно потому, что вы бережёте её для таких задач, её здесь можно себе позволить.

В коде функции не записан ни один идентификатор модели. Четыре уровня разрешаются из каталога того провайдера, на котором работает агент, отсортированного от самой мощной модели к самой слабой. Если у провайдера меньше четырёх моделей, таблица складывается вверх: при трёх моделях «Сложная» и «Экстремальная» обе попадают на флагман, но никогда наоборот. Недобор мощности губит весь прогон, перебор стоит разницы в цене одного запроса.

AI Suggestion, шаг за шагом

Шесть шагов, четыре из них необязательные, и один запрос на всё.

01

Вы открываете агента

Вместо терминала перед вами экран намерения: лицо агента на анимированном фоне, стрелка, указывающая на единственное поле, и ссылка в правом верхнем углу, чтобы открыть сессию сразу, если сейчас не до этого.

02

Вы описываете задачу одной фразой

Обычными словами, на вашем языке. Это не промпт и не спецификация: это то, что агент сейчас будет делать. Эта фраза остаётся единственным обязательным вводом и становится первым сообщением сессии.

03

Необязательно: указать затронутые папки

Папки проекта показаны небольшими значками в форме папки. Клик по одному задаёт агенту рабочую область и уточняет оценку сложности, потому что один и тот же баг в мобильном приложении и на сайте не одна и та же задача.

04

Необязательно: открыть дополнительные параметры

Свёрнуты под полем: тип работы, для кого она, ожидаемый результат, ограничения вроде «без коммитов» или «тесты обязательны», и свободный контекст, например вставленная ошибка или номер тикета. Всё уходит в том же запросе и добавляется в начало первого промпта агента.

05

Один запрос решает, или не уходит ни одного

Если уровень остался на «Авто», отправка запускает единственный запрос, который возвращает уровень, модель, имя сессии и, если агент не задан, самого агента. Нажмите уровень сами, и запроса не будет вовсе: сессия откроется сразу на соответствующей модели.

06

Сессия открывается уже настроенной

Агент стартует на выбранной модели, под сгенерированным именем сессии, а ваше описание приходит первым сообщением через штатный аргумент запуска CLI, а не вставкой в терминал после загрузки.

Агент не выбран

Вам даже не придётся выбирать агента

Если открыть экран, не назначив агента, вопрос расширяется. В сфере появляется знак вопроса в окружении трёх лиц, и набранная вами фраза решает, кто возьмёт задачу: один из агентов, уже живущих в вашей комнате, одна из четырнадцати встроенных ролей или один из примерно 260 экспертов каталога.

То же самое теперь получает и совершенно новый проект. Он больше не создаёт молча full-stack агента только потому, что что-то создать было надо. Он спрашивает, над чем вы работаете, и подбирает агента под ответ.

Агент, модель и имя сессии приходят из одного и того же запроса, потому что три запроса подряд утроили бы задержку экрана, вся ценность которого в том, что он быстрее, чем открыть терминал и править модель постфактум.

Один вопрос после открытия сессии

Когда агент уже работает, тонкая полоса спрашивает один раз: предложенная модель оказалась подходящей? Три ответа: помогло, слишком слабая, слишком тяжёлая.

Три, а не два, потому что из ответа «это было неверно» ничего не следует. А из направления ошибки следует. Слишком слабая и слишком тяжёлая: это противоположные поправки, и только направление подсказывает политике подбора мощности, в какую сторону двигаться.

Полоса никогда ничего не блокирует, вопрос задаётся один раз за сессию, а ответ отправляется только при включённом обмене данными об использовании.

Решаете вы, на трёх уровнях

Проигнорируйте, пропустите или отключите там, где мешает

Экран, который встаёт между вами и вашим терминалом, должно быть тривиально убрать. Выходов четыре, и ни один не закопан в меню.

Открыть сразу

Ссылка в правом верхнем углу экрана открывает сессию ровно так, как она открылась бы до появления этой функции. Ни запроса, ни анализа, ни задержки.

Определить уровень самому

Клик по уровню на шкале превращает его в ваше решение. Ни одного запроса не уходит, и сессия открывается сразу на соответствующей модели.

Отключено для этого агента, этого проекта или везде

Настройка разрешается сначала на уровне агента, затем проекта, затем приложения, так что экран можно оставить там, где он окупается, и убрать у тех агентов, которых вы всегда открываете одинаково.

Отключено прямо оттуда, где вы находитесь

Все три выключателя есть и в поповере «Зачем этот экран?» на самом экране. Вы отключаете функцию в тот момент, когда она вас раздражает, а не тремя меню позже.

Автоматические агенты этого экрана не видят вовсе: QA-боты, тикеты бэклога, задачи по расписанию, макеты, шаги команд и временные агенты уже несут свой бриф, и перед ними никто не сидит.

Как работает Adaptive Mode, шаг за шагом

Он срабатывает один раз, перед вашим первым сообщением, и никогда не мешает.

01

Вы начинаете печатать промпт

Откройте свежий чат с любым агентом и напишите, что нужно сделать. Adaptive Mode смотрит только на совершенно новые чаты, поэтому никогда не прерывает уже идущую сессию.

02

Он читает задачу и анализирует её

Когда ваш черновик достаточно содержателен и вы делаете паузу, Adaptive Mode отправляет начало черновика маленькой быстрой модели маршрутизации, которая определяет, насколько требовательна задача.

03

Появляется подсказка по модели

Над полем ввода всплывает чип: «Перейти на Haiku», «Перейти на Sonnet» или «Перейти на Opus», смотря что экономичнее. Если ваша текущая модель уже лучший выбор, он вместо этого так и скажет.

04

Вы применяете в один клик

Нажмите на чип, и модель применится. Если сессия уже идёт, Adaptive Mode переключает её на лету. Выбор также сохраняется в агенте, поэтому следующий запуск стартует на нужной модели.

05

Или пересчитать, или закрыть

Переформулировали промпт? Нажмите обновить, чтобы пересчитать рекомендацию для нового черновика. Довольны текущей моделью? Закройте чип и отправляйте. Контроль над каждым решением остаётся за вами.

06

Дальше он молчит

Adaptive Mode подсказывает один раз за чат, поэтому никогда не докучает вам и не тратит втихую ваш месячный лимит, пока вы продолжаете править. Делает своё дело и исчезает.

Маршрутизация моделей, не зависящая от provider

Adaptive Mode читает линейку моделей того provider, которым вы пользуетесь, и рекомендует из этого каталога. Он не привязан к одному вендору.

Claude

Маршрутизирует между Haiku, Sonnet и Opus. Haiku для быстрых правок, переименований, переводов, коротких тестов и кратких содержаний. Sonnet для ревью пул-реквестов, новых эндпоинтов, сложной отладки и рефакторингов. Opus для системной архитектуры, аудитов безопасности, крупных легаси-рефакторингов и глубокой работы над производительностью.

Codex

Маршрутизирует по линейке Codex: от быстрой дешёвой mini-модели для мелких багов и быстрых вопросов, к сбалансированной модели по умолчанию для сквозных фич и тестов, вплоть до флагманской рассуждающей модели для сложного проектирования систем и глубокого ревью кода.

Antigravity

Маршрутизирует между быстрой моделью Antigravity для мелких правок, переводов и кратких содержаний и мощной моделью Antigravity для реализации фич, отладки и более глубокого анализа.

Другие providers

Для любого provider Adaptive Mode опирается на простое правило: самая дешёвая модель для лёгкой работы, сбалансированная для обычной, самая мощная для трудной. Добавьте provider, и он маршрутизирует внутри собственных моделей этого provider.

Работает с вашим provider
Claude, Codex, Antigravity и другие. Подсказки сверяются с моделями, которые этот provider действительно предлагает, поэтому вы никогда не получите рекомендацию, которую нельзя применить.
Только ваш черновик, только когда нужно
Чтобы рассчитать подсказку, начало вашего черновика отправляется на серверы AgentsRoom. Это происходит один раз за чат, в новом чате и только когда Adaptive Mode включён.
Выключен по умолчанию, включается одним кликом
Adaptive Mode поставляется выключенным. Чтобы рассчитать подсказку, нужно отправить начало вашего черновика на серверы AgentsRoom, поэтому решать вам: включите его в настройках AgentsRoom, в разделе Композер, и там же выключите в любой момент.

FAQ

Что такое Adaptive Mode в AgentsRoom?

Adaptive Mode это умная маршрутизация моделей для ваших ИИ-агентов кодинга. Перед отправкой первого сообщения он читает ваш промпт и подсказывает самую экономичную модель из линейки вашего provider, которая всё ещё сделает задачу хорошо. Лёгкая задача получает лёгкую дешёвую модель; тяжёлая получает флагман. Цель проста: перестать переплачивать мощной моделью за работу, которой это не нужно.

Как Adaptive Mode выбирает модель?

Он отправляет начало вашего черновика маленькой быстрой модели маршрутизации, которой даны примеры того, какие типы задач подходят какому уровню модели. Затем он возвращает самую дешёвую модель, подходящую под задачу, сверенную с моделями, которые ваш текущий provider действительно предлагает. Если ваша текущая модель уже лучший выбор, он сообщает, что модель оптимальна, а не навязывает смену.

Как именно это экономит мне деньги?

Более дешёвые модели стоят малую долю от флагмана за ту же простую задачу. Если вы гоняете исправления опечаток, переименования, переводы и короткие тесты на топовой модели, вы сжигаете бюджет использования тарифа в разы быстрее, чем нужно. Adaptive Mode направляет эту лёгкую работу на лёгкую модель, поэтому каждая задача стоит меньше и вы успеваете больше задач до лимита использования. За день и на множестве параллельных агентов эта экономия складывается.

Какие модели он может предложить?

Те, что предлагает ваш provider. На Claude это Haiku, Sonnet и Opus. На Codex это охватывает быструю mini-модель, сбалансированную по умолчанию и флагманскую рассуждающую модель. На Antigravity это охватывает быструю и мощную модели. Для других providers он опирается на самую дешёвую, сбалансированную и самую мощную. Adaptive Mode читает живой список моделей, поэтому всегда рекомендует модель, которую вы действительно можете запустить.

Он переключает модель автоматически?

Нет. Adaptive Mode только подсказывает. Вы применяете смену одним кликом по чипу. Если сессия уже идёт, он переключает модель на лету; в любом случае выбор сохраняется в агенте, чтобы следующий запуск стартовал на нужной модели. Вы также можете закрыть подсказку и оставить текущую модель.

Когда появляется подсказка?

В совершенно новом чате, после того как вы напечатали содержательный промпт и сделали паузу. Она срабатывает один раз за чат, поэтому никогда не прерывает идущую сессию и не тратит втихую ваш месячный лимит, пока вы продолжаете править.

Можно ли пересчитать подсказку?

Да. Если вы переписали промпт, нажмите кнопку обновления на чипе, чтобы пересчитать рекомендацию для нового черновика. Ручной пересчёт расходует одну из ваших месячных подсказок, поэтому он под рукой, когда нужен, и не запускается на каждое нажатие клавиши.

Мой промпт остаётся приватным?

Чтобы рассчитать подсказку, на серверы AgentsRoom отправляется только начало вашего черновика, один раз за чат и только когда Adaptive Mode включён. Вы можете полностью отключить функцию в настройках, если предпочитаете выбирать модели сами.

Работает ли Adaptive Mode с Codex и Antigravity, а не только с Claude?

Да. Adaptive Mode не зависит от provider. Он читает каталог моделей того provider, которым пользуется агент, и рекомендует из этого каталога, будь то Claude, Codex, Antigravity или другой поддерживаемый provider. Команда смены модели строится под тот provider, на котором вы находитесь.

Как включить или выключить Adaptive Mode?

Он выключен по умолчанию. Откройте настройки AgentsRoom, перейдите в раздел Композер и поставьте галочку Adaptive Mode, чтобы включить его: она же его и выключает. Пока он выключен, ничто не анализирует ваш черновик и ничего из него не покидает ваш компьютер.

Что такое AI Suggestion в AgentsRoom?

AI Suggestion: короткий экран, который показывается до старта сессии агента. Вы описываете задачу одной фразой, а один запрос возвращает самую дешёвую модель из каталога вашего провайдера, способную сделать работу, имя сессии и, если агента вы не выбирали, того, кто должен её взять. Затем сессия открывается уже настроенной, а ваша фраза становится её первым сообщением.

А если я и так знаю, насколько задача сложная?

Нажмите уровень на шкале. Он станет вашим решением, запрос будет полностью пропущен, а сессия откроется сразу на соответствующей модели. Экран работает быстрее всего именно тогда, когда ответ вы уже знаете.

Что будет, если запрос не пройдёт или я офлайн?

Агент всё равно откроется, на той модели, которую он использовал бы без этой функции. Мёртвая сеть, достигнутый лимит и непригодный ответ заканчиваются одинаково, потому что экран, способный помешать вам открыть агента, был бы хуже, чем отсутствие экрана. Когда машина заведомо офлайн, экран вообще не показывается.

Может ли он выбрать не только модель, но и агента?

Да, если открыть экран, не назначив агента. Задача сопоставляется с агентами, уже живущими в вашей комнате, с четырнадцатью встроенными ролями и с каталогом экспертов. То же самое теперь делает и совершенно новый проект вместо того, чтобы молча создать full-stack агента, потому что что-то создать было надо.

Хорошо сочетается с

CLI Doctor

Когда Claude Code, Codex или любой другой CLI агента умирает на запуске, AgentsRoom читает ошибку, точную запущенную команду и происхождение каждого флага запуска, а затем объясняет, что сломалось и как это починить.

Предложения агентов

Не уверены, какого AI агента использовать? Опишите свою задачу простым языком, и AgentsRoom предложит подходящего агента: из вашей комнаты, 14 встроенных ролей или 260+ экспертов из каталога, с одной строкой причины. Один клик назначает задачу.

Расход токенов Claude Code

Смотрите расход токенов и стоимость по сессиям в реальном времени. Идёт в паре с Adaptive Mode: маршрутизируйте с умом и наблюдайте, как набегает экономия.

Делегирование агентам

Агент-разработчик передаёт тест более дешёвому QA-агенту через MCP. Та же идея, что у Adaptive Mode, применённая к целым агентам.

Мульти-provider

Запускайте Claude, Codex и Antigravity бок о бок. Adaptive Mode маршрутизирует внутри того provider, на котором находится каждый агент.

Статистика проекта

Время, промпты, токены и стоимость по проектам и по агентам. Дашборд того бюджета, защищать который помогает Adaptive Mode.

Отслеживание статуса агентов

Статус в реальном времени по каждому агенту во всех проектах, чтобы вы всегда знали, кто работает, а кому нужны вы.

Восстановление сессии

Выйдите и вернитесь с каждым агентом, терминалом и выбором модели ровно там, где вы их оставили.

Полезные материалы

Как сократить расходы на токены Claude Code, не замедляя работу

Claude Code взимает плату за каждый токен, и большая часть расходов невидима: раздутое контекстное окно, неправильная модель, сырые PDF, агенты повторно читают одни и те же файлы. Вот куда на самом деле уходят деньги и как их сократить, с привычками и инструментами, которые держат ваш счет низким, не замедляя вас.

Как проверить использование токенов Claude Code: 4 способа увидеть, что тратят ваши агенты

Четыре способа проверить использование токенов Claude Code: команда /cost, стенограммы сессий, ccusage CLI и живой счетчик на сессию. Узнайте точно, что тратит каждый агент.

Какого ИИ агента выбрать для ваших проектов?

Frontend агент, пишущий ваш маркетинговый текст, это тихий провал. Как сопоставить каждую задачу с правильным ИИ агентом: роли, каталог экспертов, кастомные агенты и что делать, когда у вас нет идеи, кто должен взять на себя эту работу.

Перестаньте переплачивать за мощность модели ИИ, которая вам не нужна

Скачайте AgentsRoom и дайте Adaptive Mode выбрать самую экономичную модель под каждую задачу. Лёгкие модели для лёгкой работы, флагманы для сложных задач, меньше сожжённого бюджета на задачу, больше задач сдано в день.

БесплатноСкачать AgentsRoom

Приложение-компаньон: следите за агентами на ходу

Используйте Claude, Codex, Antigravity CLI или другого поставщика AI.

Установить расширение
Chrome Web Store

Отправляйте баги и запросы прямо в ваш публичный бэклог.

Мульти-проекты
Мульти-провайдер
Мульти-агенты
Статус онлайн
Diff и коммиты
Мобильное приложение
Live-превью
Команды агентов
Тесты в браузере
Разработка от backlog
Библиотека промптов
Библиотека навыков
Все функции