Сколько токенов у меня осталось в Claude? Такого числа не существует.

Ваша подписка Claude измеряется не в токенах, поэтому ни один экран не показывает остаток токенов. Вот что тарифицируется на самом деле, где это прочитать и почему расход растёт, пока вы ничего не печатаете.

Это один из самых частых поисковых вопросов о Claude, и его задают почти на всех языках. Ответ у него неудобный: такого числа не существует, потому что ваша подписка продаётся не в токенах.

Это не придирка к формулировке. Именно этим объясняется, почему вы не находите тот счётчик, который ищете, почему каждая страница, обещающая его показать, на самом деле гадает, и почему то, что реально останавливает вас посреди задачи, не совпадает с тем, за чем следит большинство.

Ваша подписка тарифицируется окнами, а не токенами

Anthropic не описывает подписку Claude как запас токенов. Она тарифицирует её окнами использования: скользящее окно сессии и недельное окно поверх него. Оба окна общие для всех поверхностей, в которые вы входите под своей учётной записью, поэтому долгий день в чате Claude оставляет вам меньше места для Claude Code вечером. Оба окна общие и для моделей, и именно поэтому переключение на более дешёвую модель через /model не возвращает лимит, если вы в него уже упёрлись.

Прочитать поэтому можно долю окна и время, когда оно вернётся, а не остаток. Когда квота действительно заканчивается, сообщение, которое вас останавливает, говорит, какой потолок вы задели и когда он сбросится, и только эта цифра авторитетна для вашей учётной записи.

Единственное место, где количество токенов означает ровно то, что написано, это API, который тарифицируется по токенам. Всё, что ниже, про подписку, а именно о ней спрашивает большинство.

Число, которое действительно можно прочитать, и где оно живёт

Два экрана, и они отвечают на разные вопросы.

Внутри Claude Code команда /usage та самая, которую стоит выучить. На подписке Pro, Max, Team или Enterprise она показывает полосы использования по лимитам вашей подписки, а клавиши d и w переключают между последними 24 часами и последними 7 днями. Под полосами она делает кое-что полезнее любого сырого числа: она распределяет недавний расход по навыкам, субагентам, плагинам и отдельным серверам MCP, каждый в процентах, и поднимает флаг поведения, когда один шаблон отвечает за 10% и более вашего недавнего потребления, например длинный контекст или промахи кэша.

Одна оговорка тут важна, и её легко упустить: эти цифры считаются из вашей локальной истории сессий на этой машине. Работа с другого ноутбука или на claude.ai в них не входит.

В вебе раздел Settings, затем Usage на claude.ai это вид на уровне учётной записи: ваша подписка, где вы сейчас находитесь и когда сбрасывается недельное окно. Если вы работаете с двух машин, полным будет именно он.

Чтобы понять по конкретной сессии, во сколько реально обошёлся кусок работы, верхний блок /usage печатает сырые счётчики:

Usage by model:
   claude-sonnet-4-6:  1.2k input, 5.3k output, 940.0k cache read, 50.0k cache write

Эти четыре числа и есть вся история сессии кодинга, и самое большое из них почти всегда cache read. Если вы хотите видеть эту картину постоянно, а не по запросу, AgentsRoom держит живой счётчик токенов на каждой сессии рядом с терминалом, с тем же разделением на ввод, вывод и кэш и с красным значком, когда сессия начинает греться. Пошаговый разбор того, как читать собственный счётчик CLI, есть в статье как проверить расход токенов в Claude Code.

Что такое токен на самом деле, когда в дело вступает агент

Токен это фрагмент текста: примерно три четверти слова в английском и заметно меньше в коде, где пунктуация и идентификаторы дробятся особенно легко.

Больше всего людей удивляет то, что разговор пересылается целиком при каждом запросе. Задайте однострочный вопрос в сессии, открытой с самого утра, и вы платите не за эту строку, а за всю историю, которая едет вместе с ней. Каждый раз, когда агент использует инструмент, он отправляет ещё один запрос, унося с собой предыдущие результаты инструментов, и поэтому одно «почини этот тест» превращается в десяток обращений туда и обратно.

Кэширование промптов это то, что делает такую схему выносимой. Повторяющаяся история тарифицируется по гораздо более низкой кэшированной ставке, поэтому цифра cache read огромна, а счёт нет. Оно же порождает самую дорогую привычку в работе с агентами, и об этом следующий раздел.

Почему полоса растёт, пока вы ничего не печатаете

Если расход растёт на простаивающей сессии, это одна из следующих причин, и ни одна из них не баг:

  • Истечение кэша. Кэшированный контекст живёт около часа на подписке и падает до пяти минут, как только вы начинаете расходовать кредиты использования или работаете по ключу API. Вернитесь с обеда, и первое же сообщение промахивается мимо кэша: весь ваш разговор обрабатывается заново по полной цене. Одна пауза, одна полная переобработка.
  • Всё, что само начинает ход. Сработавшая задача по расписанию, сообщение, пришедшее из другой вашей сессии, сверка по цели, пока идёт фоновая работа. Каждое такое событие пересылает полный контекст, ровно как сообщение, напечатанное вами.
  • Агенты-напарники. Каждый активный напарник ведёт собственное окно контекста и продолжает потреблять, пока не завершится. Собственные рекомендации Anthropic оценивают команду в режиме планирования примерно в семь раз дороже обычной сессии.
  • Уплотнение. /compact вынужден прочитать разговор, который сжимает, поэтому уплотнение большого контекста само по себе крупный запрос. /clear не стоит ничего, и когда преемственность вам не нужна, это ход получше.
  • Фоновая работа. Сводки для --resume и подобные мелкие хлопоты тянут понемногу даже тогда, когда вы простаиваете, обычно меньше четырёх центов за сессию.

Здесь же расходятся два предупреждения, которые люди путают. Предупреждение о контексте или об автоуплотнении говорит, что один разговор подходит к контекстному окну модели, и очистка этой сессии его снимает. Лимит использования говорит, что квота вашей подписки израсходована по всем сессиям сразу, и очистка не вернёт из неё ничего. Надёжный признак: лимит использования называет время сброса, предупреждение о контексте нет.

Что делать, когда полоса почти заполнена

Примерно в порядке того, сколько это возвращает за потраченные усилия:

  1. Очищайте контекст между несвязанными задачами. Устаревший контекст пересылается с каждым сообщением до конца сессии. /rename перед /clear, если вы хотите потом найти эту сессию через /resume.
  2. Подбирайте модель под задачу. Sonnet справляется с большей частью работы по коду, а оставленный по умолчанию Opus самая частая причина квоты, которая испаряется к четвергу.
  3. Читайте распределение в /usage. Если один сервер MCP или один субагент занимает 30% вашей недели, вот вам и починка, причём вы бы никогда не угадали, который именно.
  4. Сначала снижайте рассуждение, а не выключайте его. Токены рассуждения тарифицируются как выходные. Обычно достаточно понизить уровень усилий.
  5. Выносите многословную работу в субагентов. Вывод тестов и файлы логов остаются в контексте субагента, а обратно приходит только сводка.
  6. Держите файл контекста коротким. Всё, что лежит в CLAUDE.md или AGENTS.md, загружается при старте сессии и оплачивается на каждом ходе, в том числе когда оно совсем не к месту. Длинным инструкциям по рабочему процессу место в навыке, который подгружается только при вызове. Подробнее об этом в руководстве по файлу контекста AGENTS.md.

Если вам нужна более длинная версия именно про сокращение расходов, снижение расходов на токены в Claude Code разбирает это в деталях.

Если совсем коротко

Перестаньте искать остаток токенов: у вашей подписки его нет. Выучите два окна, читайте /usage ради распределения, а не ради итоговой цифры, и относитесь к кэшу как к тому, что решает вашу неделю. Разработчики, которые никогда не упираются в лимит, редко оказываются теми, кто печатает меньше. Они те, кто начинает свежую сессию, когда меняется тема.

Запуск нескольких агентов сразу делает всё это одновременно и хуже, и заметнее, потому что потребление перестаёт быть одним числом и становится одним числом на каждого агента. Именно вокруг такого вида построен AgentsRoom.

Часто задаваемые вопросы

Сколько токенов у меня осталось в Claude?

Такого числа просто негде посмотреть. Подписка Claude продаётся не как бюджет токенов: она тарифицируется как доля скользящего окна сессии плюс недельное окно, и прочитать можно процент этих окон и время их сброса, а не остаток токенов. Смотреть это нужно в команде /usage внутри Claude Code либо в разделе Settings, затем Usage на claude.ai. Только на API, где счёт идёт по токенам, цифра в токенах вообще что-то значит.

Как работают токены в Claude?

Токен это фрагмент текста, примерно три четверти слова в английском и меньше в коде. Каждый запрос отправляет весь ваш разговор заново, поэтому сессия кодинга платит за накопленную историю на каждом ходе, а не только за напечатанную вами фразу. Именно поэтому расход считается четырьмя отдельными цифрами: входные токены, выходные токены, запись кэша и чтение кэша. Кэшированная история тарифицируется по гораздо более низкой ставке, чем свежий ввод, и ровно поэтому сессия, оставленная открытой на весь день, всё равно тянет из вашей подписки.

Когда сбрасывается мой расход в Claude?

Часов двое, и они независимы. Окно сессии скользит, то есть истекает через фиксированное число часов после открытия, а не в выбранный вами момент. Недельное окно стоит поверх него и сбрасывается в фиксированный момент, закреплённый за вашей учётной записью. Само сообщение о лимите говорит, когда вернётся окно, которое вас остановило, и этот ответ авторитетен именно для вашей учётной записи. Оба счётчика общие для чата Claude и Claude Code, поэтому активная переписка в чате укорачивает ваш бюджет на код.

Вернёт ли переключение на более дешёвую модель мой лимит?

Нет. Окно сессии и недельное окно общие для всех моделей, поэтому переключение через /model не восстанавливает доступ, если вы уже упёрлись в лимит. Оно помогает в одном конкретном случае: когда сообщение относится к конкретной модели, например вы исчерпали лимит Opus, и переход на Sonnet позволяет продолжать работу. Оно помогает и заранее, до исчерпания, потому что более дешёвая модель съедает меньшую часть той же квоты за ту же работу.

Почему расход растёт, когда я ничего не делаю?

Потому что простой в агентской сессии не бесплатен. Всё, что начинает ход, пересылает ваш контекст целиком: сработавшая задача по расписанию, сообщение из другой сессии, всё ещё работающий агент-напарник, сверка по цели. Ещё две вещи стоят токенов вообще без хода: уплотнение, которому приходится прочитать сжимаемый разговор, и первое сообщение после долгой паузы, которое промахивается мимо кэша промптов и обрабатывает всю вашу историю заново по полной цене.

Предупреждение о контексте это то же самое, что лимит использования?

Нет, и путаница между ними ведёт людей к неверному решению. Предупреждение о контексте или об автоуплотнении говорит, что один разговор подошёл близко к контекстному окну модели, и лечится очисткой или уплотнением этой сессии. Лимит использования говорит о квоте вашей подписки по всем сессиям сразу, и очистка не вернёт из неё ничего. Признак виден в формулировке: сообщение о лимите называет время сброса, предупреждение о контексте нет.

Скачать AgentsRoom

Запускай ИИ-агентов (Claude, Codex, Antigravity CLI, OpenCode, Aider, Grok Build, Mistral Vibe, Kimi Code) на всех проектах из одного окна.

БесплатноСкачать AgentsRoom

Приложение-компаньон: следите за агентами на ходу

Используйте Claude, Codex, Antigravity CLI или другого поставщика AI.

Установить расширение
Chrome Web Store

Отправляйте баги и запросы прямо в ваш публичный бэклог.

Взгляд на AgentsRoom в действии.

Мульти-проекты
Мульти-провайдер
Мульти-агенты
Статус онлайн
Diff и коммиты
Мобильное приложение
Live-превью
Команды агентов
Тесты в браузере
Разработка от backlog
Библиотека промптов
Библиотека навыков
Все функции

Читать далее