Скільки токенів у мене залишилося в Claude? Такого числа не існує.
Ваша підписка Claude вимірюється не в токенах, тому жоден екран не показує балансу токенів. Ось що насправді обліковується, де це подивитися і чому воно витрачається, поки ви нічого не пишете.
Це одне з найпопулярніших пошукових запитань про Claude, і його ставлять майже всіма мовами. Відповідь на нього незручна: такого числа не існує, бо вашу підписку продають не в токенах.
Це не формальна дрібниця. Саме цим пояснюється, чому ви не можете знайти лічильник, який шукаєте, чому кожна сторінка, що обіцяє його показати, насправді вгадує, і чому те, що реально зупиняє вас посеред завдання, не є тим, за чим стежить більшість.
Вашу підписку вимірюють у вікнах, а не в токенах
Anthropic не описує підписку Claude як ліміт токенів. Вона обліковує її як вікна використання: рухоме вікно сесії та тижневе вікно поверх нього. Обидва спільні для всіх сервісів, до яких ви входите, тож ціле пообіддя в чаті Claude залишає вам менше простору для Claude Code того ж вечора. Обидва також спільні для всіх моделей, і саме тому перехід на дешевшу модель через /model не повертає вам ліміт, коли ви його вже вичерпали.
Тому побачити ви можете частку вікна і час, коли воно поновиться, а не залишок. Коли ліміт таки закінчується, повідомлення, що зупиняє роботу, називає, якої стелі ви досягли і коли вона поновиться, і саме це повідомлення є єдиним авторитетним показником для вашого облікового запису.
Єдине місце, де кількість токенів має буквальний сенс, це API, який тарифікується потокенно. Усе, що нижче, стосується підписки, а саме про неї насправді й запитує більшість.
Число, яке справді можна побачити, і де воно живе
Екранів два, і вони відповідають на різні запитання.
У Claude Code це /usage, і саме її варто освоїти. На підписці Pro, Max, Team чи Enterprise вона показує смуги використання для лімітів вашої підписки, а клавіші d та w перемикають між останніми 24 годинами й останніми 7 днями. Під смугами вона робить дещо корисніше за будь-яке сире число: розподіляє нещодавнє використання між навичками, субагентами, плагінами та окремими серверами MCP, кожне у відсотках, і піднімає позначку поведінки, коли один патерн дає 10% або більше вашого недавнього споживання, наприклад довгий контекст або промахи кешу.
Одне застереження важливе, і його легко проґавити: ці цифри рахуються з локальної історії сесій на цій машині. Роботи, зробленої з іншого ноутбука або на claude.ai, у них немає.
У вебі, Settings, далі Usage на claude.ai, це подання на рівні облікового запису: ваша підписка, ваше поточне становище і час поновлення тижневого вікна. Якщо ви працюєте на двох машинах, повну картину дає саме воно.
Щоб отримати розбивку по сесіях і дізнатися, скільки насправді коштувала конкретна робота, верхній блок /usage виводить сирі значення:
Usage by model:
claude-sonnet-4-6: 1.2k input, 5.3k output, 940.0k cache read, 50.0k cache write
Ці чотири числа і є вся історія сесії програмування, і найбільше з них майже завжди cache read. Якщо ви хочете бачити це постійно, а не за запитом, AgentsRoom тримає живий лічильник токенів на кожній сесії поруч із терміналом, з тим самим поділом на введення, виведення й кеш і червоною позначкою, коли сесія починає розігріватися. Покрокова версія читання власного лічильника CLI описана в статті як перевірити використання токенів Claude Code.
Чим насправді є токен, коли до справи береться агент
Токен це фрагмент тексту: приблизно три чверті слова в англійській і помітно менше в коді, де розділові знаки та ідентифікатори легко дробляться.
Найбільше людей дивує те, що розмова надсилається повністю з кожним запитом. Поставте однорядкове запитання в сесії, відкритій ще зранку, і ви платите не за цей рядок, а за всю історію, яка їде разом із ним. Щоразу, коли агент користується інструментом, він надсилає ще один запит і несе з собою попередні результати інструментів, тому одне «виправ цей тест» може перетворитися на десяток обмінів із моделлю.
Кешування промптів робить це стерпним. Повторювана історія тарифікується за значно нижчим кешованим тарифом, і саме тому показник cache read величезний, а рахунок ні. Воно ж закладає найдорожчу звичку в роботі з агентами, і про неї йдеться в наступному розділі.
Чому смуга рухається, поки ви нічого не пишете
Якщо ваше використання зростає на простійній сесії, причина одна з цих, і жодна з них не є багом:
- Термін дії кешу спливає. Кешований контекст живе близько години на підписці й скорочується до п'яти хвилин, щойно ви починаєте витрачати кредити використання або працюєте за ключем API. Поверніться з обіду, і ваше перше повідомлення промахується повз кеш: уся розмова обробляється заново за повною ціною. Одна пауза, одна повна переобробка.
- Будь-що, що самостійно починає хід. Спрацювало заплановане завдання, надійшло повідомлення з іншої вашої сесії, відбулася звірка цілі, поки виконується фонова робота. Кожна така подія надсилає весь контекст заново, точно як повідомлення, яке набрали ви.
- Агенти-напарники. Кожен активний напарник тримає власне контекстне вікно і споживає ресурси, доки не завершиться. За власними рекомендаціями Anthropic, команда в режимі планування витрачає приблизно всемеро більше за звичайну сесію.
- Ущільнення.
/compactмусить прочитати розмову, яку підсумовує, тож ущільнення великого контексту саме по собі є великим запитом./clearне коштує нічого, і коли безперервність вам не потрібна, це кращий хід. - Фонова робота. Підсумки для
--resumeта подібні дрібні операції витрачають потроху навіть тоді, коли ви нічого не робите, зазвичай менш ніж чотири центи на сесію.
Саме тут розходяться два попередження, які часто плутають. Попередження про контекст або про автоущільнення каже, що одна розмова наближається до контекстного вікна моделі, і очищення цієї сесії це виправляє. Ліміт використання каже, що ліміт вашої підписки витрачено по всіх сесіях, і очищення не повертає з нього нічого. Надійна ознака: ліміт використання називає час поновлення, попередження про контекст ні.
Що робити, коли смуга майже заповнена
Приблизно в порядку віддачі на витрачені зусилля:
- Очищайте контекст між непов'язаними завданнями. Застарілий контекст надсилається заново з кожним повідомленням до самого кінця сесії. Виконайте
/renameперед/clear, якщо хочете потім знайти сесію через/resume. - Підбирайте модель під завдання. Sonnet справляється з більшістю роботи з кодом, а залишений за замовчуванням Opus є найчастішою причиною ліміту, який зникає вже до четверга.
- Читайте розподіл у
/usage. Якщо один сервер MCP або один субагент з'їдає 30% вашого тижня, то саме там і виправлення, а вгадати, який саме, ви б ніколи не змогли. - Спершу зменште міркування, а не вимикайте його. Токени міркування тарифікуються як виведення. Зазвичай достатньо знизити рівень зусиль.
- Виносьте багатослівну роботу в субагентів. Вивід тестів і файли журналів залишаються в контексті субагента, а назад повертається лише підсумок.
- Тримайте файл контексту коротким. Усе, що є в
CLAUDE.mdчиAGENTS.md, завантажується на старті сесії й оплачується на кожному ході, зокрема й тоді, коли воно недоречне. Довгим інструкціям робочого процесу місце в навичці, яка завантажується лише за викликом. Докладніше про це в посібнику з файлу контексту AGENTS.md.
Якщо вам потрібна довша версія саме про скорочення витрат, стаття як зменшити витрати на токени Claude Code розбирає це в деталях.
Коротка версія
Перестаньте шукати баланс токенів: у вашої підписки його немає. Вивчіть два вікна, читайте /usage заради розподілу, а не заради підсумкового числа, і сприймайте кеш як те, що вирішує ваш тиждень. Розробники, які ніколи не впираються в ліміт, рідко бувають тими, хто менше пише. Це ті, хто починає нову сесію, коли змінюється тема.
Запуск кількох агентів одночасно робить усе це і гіршим, і помітнішим, бо споживання перестає бути одним числом і стає одним числом на агента. Саме навколо такого подання побудований AgentsRoom.
Поширені запитання
Скільки токенів у мене залишилося в Claude?
Такого числа просто не існує. Підписку Claude продають не як бюджет токенів: вона обліковується як частка рухомого вікна сесії плюс тижневого вікна, і побачити ви можете відсоток цих вікон та час їхнього поновлення, а не залишок токенів. Дивитися це слід командою /usage всередині Claude Code або в Settings, далі Usage на claude.ai. Лише в API, який тарифікується потокенно, число токенів справді щось означає.
Як працюють токени Claude?
Токен це фрагмент тексту, приблизно три чверті слова в англійській і менше в коді. Кожен запит надсилає всю вашу розмову заново, тож сесія програмування платить за накопичену історію на кожному ході, а не лише за речення, яке ви набрали. Саме тому використання рахують чотирма окремими показниками: введення, виведення, запис кешу і читання кешу. Кешована історія тарифікується за значно нижчою ставкою, ніж свіже введення, і саме тому сесія, залишена відкритою на цілий день, усе одно витрачає вашу підписку.
Коли поновлюється моє використання Claude?
Годинників два, і вони незалежні. Вікно сесії рухоме, тож воно спливає через фіксовану кількість годин після відкриття, а не в обраний вами час. Тижневе вікно стоїть поверх нього і поновлюється у фіксований момент, призначений вашому обліковому запису. Саме повідомлення про ліміт каже, коли повернеться вікно, яке вас зупинило, і це повідомлення є авторитетною відповіддю для вашого облікового запису. Обидва годинники спільні для чату Claude і Claude Code, тож інтенсивне користування чатом скорочує ваш бюджет на програмування.
Чи поверне мені ліміт перехід на дешевшу модель?
Ні. Вікно сесії й тижневе вікно спільні для всіх моделей, тож перемикання через /model не повертає доступ, коли ви їх уже вичерпали. Це допомагає в одному конкретному випадку: коли повідомлення стосується конкретної моделі, наприклад ви досягли ліміту Opus, і перехід на Sonnet дає змогу працювати далі. Це також допомагає ще до того, як ліміт скінчиться, бо дешевша модель витрачає менше того самого ліміту на ту саму роботу.
Чому моє використання зростає, коли я нічого не роблю?
Бо простій в агентній сесії не безкоштовний. Будь-що, що починає хід, надсилає весь ваш контекст заново: спрацювання запланованого завдання, повідомлення з іншої сесії, агент-напарник, який досі працює, звірка цілі. Ще дві речі коштують токенів без жодного ходу: ущільнення, яке мусить прочитати розмову, що її підсумовує, і перше повідомлення після довгої паузи, яке промахується повз кеш промптів і обробляє всю вашу історію заново за повною ціною.
Чи попередження про контекст це те саме, що ліміт використання?
Ні, і плутанина між ними веде людей до хибного розв'язання. Попередження про контекст або про автоущільнення стосується однієї розмови, яка наближається до контекстного вікна моделі, і вирішується очищенням або ущільненням цієї сесії. Ліміт використання стосується ліміту вашої підписки по всіх сесіях, і очищення не повертає з нього нічого. Ознака в формулюванні: повідомлення про ліміт називає час поновлення, попередження про контекст ні.
Завантажити AgentsRoom
Запускайте свої AI-агенти (Claude, Codex, Antigravity CLI, OpenCode, Aider, Grok Build, Mistral Vibe, Kimi Code) на всіх ваших проєктах з одного вікна.
Додаток-компаньйон: контролюйте своїх агентів на ходу
Використовуйте свого: Claude, Codex, Antigravity CLI або іншого AI-провайдера.
Надсилайте баги та запити прямо у свій публічний беклог.
Погляд на AgentsRoom в дії.
Читати далі
Claude тепер ставить водяний знак на все, що пише. Вашого коду це майже не стосується.
Anthropic ставить водяний знак на відповіді Claude. Що саме позначається, чому згенерований код цього майже уникає, хто це бачить і чому ваше SEO не змінюється.
Читати статтюClaude Code тримає лише один вхід за раз. Ось як запустити кілька.
Практичний посібник із запуску робочого й особистого облікових записів на одній машині: одна змінна середовища, яка вирішує, який вхід активний, чому підхід через shell ламається, щойно у вас більше двох терміналів, і як закріпити обліковий запис за проєктом.
Читати статтюТепер код пишуть агенти. Ось чим стала робота розробника.
Писати код було лише однією ланкою з шести, і саме її забрали агенти. Решта п'ять поважчали. Розбір роботи, яка лишилася: почути запит, вирішити, скласти бриф, вести виконання, переглянути, випустити.
Читати статтю