Скільки токенів у мене залишилося в Claude? Два екрани, куди треба дивитися.
Ваша підписка Claude вимірюється не в токенах, тому жоден екран не показує балансу токенів. Ось що насправді обліковується, два екрани, де це справді видно, чому воно витрачається, поки ви нічого не пишете, і що робить з вашим тижнем зміна тижневого вікна у вересні 2026 року.
Це одне з найпопулярніших пошукових запитань про Claude, і його ставлять майже всіма мовами. Відповідь на нього незручна: такого числа не існує, бо вашу підписку продають не в токенах.
Це не формальна дрібниця. Саме цим пояснюється, чому ви не можете знайти лічильник, який шукаєте, чому кожна сторінка, що обіцяє його показати, насправді вгадує, і чому те, що реально зупиняє вас посеред завдання, не є тим, за чим стежить більшість.
Вашу підписку вимірюють у вікнах, а не в токенах
Anthropic не описує підписку Claude як ліміт токенів. Вона обліковує її як вікна використання: рухоме вікно сесії та тижневе вікно поверх нього. Обидва спільні для всіх сервісів, до яких ви входите, тож ціле пообіддя в чаті Claude залишає вам менше простору для Claude Code того ж вечора. Обидва також спільні для всіх моделей, і саме тому перехід на дешевшу модель через /model не повертає вам ліміт, коли ви його вже вичерпали.
Тому побачити ви можете частку вікна і час, коли воно поновиться, а не залишок. Коли ліміт таки закінчується, повідомлення, що зупиняє роботу, називає, якої стелі ви досягли і коли вона поновиться, і саме це повідомлення є єдиним авторитетним показником для вашого облікового запису.
Єдине місце, де кількість токенів має буквальний сенс, це API, який тарифікується потокенно. Усе, що нижче, стосується підписки, а саме про неї насправді й запитує більшість.
Тижневе вікно не є сталою величиною
Чого ніхто не закладає в свої розрахунки, так це того, що тижневе вікно можна змінити в розмірі, і що воно не лишається тим самим надовго.
Від травня 2026 року тижневий ліміт має тимчасову надбавку в 50%, яку продовжували тричі. Вона діє до 14 вересня 2026 року, і від цієї дати її місце посідає постійна надбавка в 25% понад рівень, що був до неї. Щодо того початкового рівня це зростання. Щодо того, що насправді лежить у вашому обліковому записі цього тижня, це зменшення на 17%: тиждень, який вартував 150, вартує 125. Рухоме вікно сесії не змінюється, тож різниця виявляється лише на тижнях, достатньо навантажених, щоб дійти до тижневої стелі, тобто саме тоді, коли її й відчувають.
Одиниця цієї стелі теж не токен. Її рахують в активних годинах обчислень, які спливають, поки обробляється хід, а не поки ви сидите й читаєте відповідь, і Claude Code, claude.ai та Cowork черпають з одного спільного запасу. Півдня з трьома запущеними субагентами спалюють тиждень значно швидше, ніж дає підстави думати кількість надісланих вами повідомлень.
Яку частину цього тижня насправді витрачає одна повна 5-годинна сесія, теж ніхто не публікує. Робін Гуд вимірює це на реальних підписках, окремо для кожного провайдера і плану, і позначає день, коли провайдер змінює свої ліміти.
Число, яке справді можна побачити, і де воно живе
Екранів два, і вони відповідають на різні запитання.
У Claude Code це /usage, і саме її варто освоїти. На підписці Pro, Max, Team чи Enterprise вона показує смуги використання для лімітів вашої підписки, а клавіші d та w перемикають між останніми 24 годинами й останніми 7 днями. Під смугами вона робить дещо корисніше за будь-яке сире число: розподіляє нещодавнє використання між навичками, субагентами, плагінами та окремими серверами MCP, кожне у відсотках, і піднімає позначку поведінки, коли один патерн дає 10% або більше вашого недавнього споживання, наприклад довгий контекст або промахи кешу.
Одне застереження важливе, і його легко проґавити: ці цифри рахуються з локальної історії сесій на цій машині. Роботи, зробленої з іншого ноутбука або на claude.ai, у них немає.
У вебі, Settings, далі Usage на claude.ai, це подання на рівні облікового запису: ваша підписка, ваше поточне становище і час поновлення тижневого вікна. Якщо ви працюєте на двох машинах, повну картину дає саме воно.
Щоб отримати розбивку по сесіях і дізнатися, скільки насправді коштувала конкретна робота, верхній блок /usage виводить сирі значення:
Usage by model:
claude-sonnet-4-6: 1.2k input, 5.3k output, 940.0k cache read, 50.0k cache write
Ці чотири числа і є вся історія сесії програмування, і найбільше з них майже завжди cache read. Якщо ви хочете бачити це постійно, а не за запитом, AgentsRoom тримає живий лічильник токенів на кожній сесії поруч із терміналом, з тим самим поділом на введення, виведення й кеш і червоною позначкою, коли сесія починає розігріватися. Покрокова версія читання власного лічильника CLI описана в статті як перевірити використання токенів Claude Code.
/usage розподіляє ваші витрати між навичками, субагентами, плагінами та серверами MCP, але ніколи між проектами і ніколи між агентами, які пишуть код. AgentsRoom додає саме цей розподіл: він бере той самий відсоток, який публікує ваш провайдер, і ділить його між вашими проектами і вашими агентами, зважуючи кожну сесію за тим, скільки вона коштувала б за тарифами API.

Читайте це як оцінку, а не як рахунок. У знаменник потрапляє лише та робота, яку бачить ця машина, тому все, що ви зробили з іншого ноутбука або у вебі, відсутнє, і кожна частка виходить трохи завищеною.
Чим насправді є токен, коли до справи береться агент
Токен це фрагмент тексту: приблизно три чверті слова в англійській і помітно менше в коді, де розділові знаки та ідентифікатори легко дробляться.
Найбільше людей дивує те, що розмова надсилається повністю з кожним запитом. Поставте однорядкове запитання в сесії, відкритій ще зранку, і ви платите не за цей рядок, а за всю історію, яка їде разом із ним. Щоразу, коли агент користується інструментом, він надсилає ще один запит і несе з собою попередні результати інструментів, тому одне «виправ цей тест» може перетворитися на десяток обмінів із моделлю.
Кешування промптів робить це стерпним. Повторювана історія тарифікується за значно нижчим кешованим тарифом, і саме тому показник cache read величезний, а рахунок ні. Воно ж закладає найдорожчу звичку в роботі з агентами, і про неї йдеться в наступному розділі.
Чому смуга рухається, поки ви нічого не пишете
Якщо ваше використання зростає на простійній сесії, причина одна з цих, і жодна з них не є багом:
- Термін дії кешу спливає. Кешований контекст живе близько години на підписці й скорочується до п'яти хвилин, щойно ви починаєте витрачати кредити використання або працюєте за ключем API. Поверніться з обіду, і ваше перше повідомлення промахується повз кеш: уся розмова обробляється заново за повною ціною. Одна пауза, одна повна переобробка.
- Будь-що, що самостійно починає хід. Спрацювало заплановане завдання, надійшло повідомлення з іншої вашої сесії, відбулася звірка цілі, поки виконується фонова робота. Кожна така подія надсилає весь контекст заново, точно як повідомлення, яке набрали ви.
- Агенти-напарники. Кожен активний напарник тримає власне контекстне вікно і споживає ресурси, доки не завершиться. За власними рекомендаціями Anthropic, команда в режимі планування витрачає приблизно всемеро більше за звичайну сесію.
- Ущільнення.
/compactмусить прочитати розмову, яку підсумовує, тож ущільнення великого контексту саме по собі є великим запитом./clearне коштує нічого, і коли безперервність вам не потрібна, це кращий хід. - Фонова робота. Підсумки для
--resumeта подібні дрібні операції витрачають потроху навіть тоді, коли ви нічого не робите, зазвичай менш ніж чотири центи на сесію.
Саме тут розходяться два попередження, які часто плутають. Попередження про контекст або про автоущільнення каже, що одна розмова наближається до контекстного вікна моделі, і очищення цієї сесії це виправляє. Ліміт використання каже, що ліміт вашої підписки витрачено по всіх сесіях, і очищення не повертає з нього нічого. Надійна ознака: ліміт використання називає час поновлення, попередження про контекст ні.
Що робити, коли смуга майже заповнена
Приблизно в порядку віддачі на витрачені зусилля:
- Очищайте контекст між непов'язаними завданнями. Застарілий контекст надсилається заново з кожним повідомленням до самого кінця сесії. Виконайте
/renameперед/clear, якщо хочете потім знайти сесію через/resume. - Підбирайте модель під завдання. Sonnet справляється з більшістю роботи з кодом, а залишений за замовчуванням Opus є найчастішою причиною ліміту, який зникає вже до четверга.
- Читайте розподіл у
/usage. Якщо один сервер MCP або один субагент з'їдає 30% вашого тижня, то саме там і виправлення, а вгадати, який саме, ви б ніколи не змогли. - Спершу зменште міркування, а не вимикайте його. Токени міркування тарифікуються як виведення. Зазвичай достатньо знизити рівень зусиль.
- Виносьте багатослівну роботу в субагентів. Вивід тестів і файли журналів залишаються в контексті субагента, а назад повертається лише підсумок.
- Тримайте файл контексту коротким. Усе, що є в
CLAUDE.mdчиAGENTS.md, завантажується на старті сесії й оплачується на кожному ході, зокрема й тоді, коли воно недоречне. Довгим інструкціям робочого процесу місце в навичці, яка завантажується лише за викликом. Докладніше про це в посібнику з файлу контексту AGENTS.md.
Якщо вам потрібна довша версія саме про скорочення витрат, стаття як зменшити витрати на токени Claude Code розбирає це в деталях.
Усі шість цих прийомів припускають, що ви помітили вчасно, а смуга показується лише тоді, коли ви її запитуєте. Якщо ви волієте, щоб вам повідомили, AgentsRoom надсилає сповіщення про використання на комп'ютер або на телефон, коли смуга перетинає 50%, а потім 75% за замовчуванням, або поріг, який ви задаєте для кожної смуги, один раз на вікно. Список вище щось змінює лише доти, доки від тижня ще є що рятувати.
Що ще працює, коли вікно вже вичерпано
Усі важелі з попереднього розділу профілактичні: вони змінюють швидкість, з якою ви наближаєтеся до стелі, і жоден з них нічого не повертає, коли ви її вже перетнули. Чекати на поновлення це варіант за замовчуванням, і повідомлення про ліміт це єдине місце, яке каже, коли воно настане. Очікування скорочують три речі.
Другий обліковий запис. Вікно належить обліковому запису, а не машині, тож у того запису, який ви ще не витратили, лишається власне. Складність у тому, що Claude Code тримає один вхід за раз; як користуватися кількома обліковими записами Claude Code на одній машині розбирає цю механіку. AgentsRoom автоматизує передавання: коли обліковий запис досягає своєї стелі, поточна розмова переходить на інший обліковий запис, у який ви ввійшли, і продовжується з того місця, де зупинилася, замість починатися заново деінде.
Інший провайдер. Тижневе вікно належить Anthropic, а не всій галузі. Якщо у вас є ще й доступ до Codex, Antigravity чи Copilot, робота, якій не потрібен саме Claude, може піти туди до кінця тижня, а запуск кількох провайдерів пліч-о-пліч це той варіант такого переходу, який не коштує вам накопиченого контексту.
Дешевша модель, до стелі, а не після. Перемикання через /model нічого не повертає, коли вікно вже вичерпано, але воно розтягує те, у якому ви зараз. Це єдиний з трьох варіантів, який не потребує жодного налаштування, і саме тому залишений за замовчуванням Opus є найпоширенішим способом втратити четвер.
Коротка версія
Перестаньте шукати баланс токенів: у вашої підписки його немає. Вивчіть два вікна, читайте /usage заради розподілу, а не заради підсумкового числа, і сприймайте кеш як те, що вирішує ваш тиждень. Розробники, які ніколи не впираються в ліміт, рідко бувають тими, хто менше пише. Це ті, хто починає нову сесію, коли змінюється тема.
Запуск кількох агентів одночасно робить усе це і гіршим, і помітнішим, бо споживання перестає бути одним числом і стає одним числом на агента. Саме навколо такого подання побудований AgentsRoom.
Поширені запитання
Скільки токенів у мене залишилося в Claude?
Такого числа просто не існує. Підписку Claude продають не як бюджет токенів: вона обліковується як частка рухомого вікна сесії плюс тижневого вікна, і побачити ви можете відсоток цих вікон та час їхнього поновлення, а не залишок токенів. Дивитися це слід командою /usage всередині Claude Code або в Settings, далі Usage на claude.ai. Лише в API, який тарифікується потокенно, число токенів справді щось означає.
Як працюють токени Claude?
Токен це фрагмент тексту, приблизно три чверті слова в англійській і менше в коді. Кожен запит надсилає всю вашу розмову заново, тож сесія програмування платить за накопичену історію на кожному ході, а не лише за речення, яке ви набрали. Саме тому використання рахують чотирма окремими показниками: введення, виведення, запис кешу і читання кешу. Кешована історія тарифікується за значно нижчою ставкою, ніж свіже введення, і саме тому сесія, залишена відкритою на цілий день, усе одно витрачає вашу підписку.
Коли поновлюється моє використання Claude?
Годинників два, і вони незалежні. Вікно сесії рухоме, тож воно спливає через фіксовану кількість годин після відкриття, а не в обраний вами час. Тижневе вікно стоїть поверх нього і поновлюється у фіксований момент, призначений вашому обліковому запису. Саме повідомлення про ліміт каже, коли повернеться вікно, яке вас зупинило, і це повідомлення є авторитетною відповіддю для вашого облікового запису. Обидва годинники спільні для чату Claude і Claude Code, тож інтенсивне користування чатом скорочує ваш бюджет на програмування.
Чи поверне мені ліміт перехід на дешевшу модель?
Ні. Вікно сесії й тижневе вікно спільні для всіх моделей, тож перемикання через /model не повертає доступ, коли ви їх уже вичерпали. Це допомагає в одному конкретному випадку: коли повідомлення стосується конкретної моделі, наприклад ви досягли ліміту Opus, і перехід на Sonnet дає змогу працювати далі. Це також допомагає ще до того, як ліміт скінчиться, бо дешевша модель витрачає менше того самого ліміту на ту саму роботу.
Чому моє використання зростає, коли я нічого не роблю?
Бо простій в агентній сесії не безкоштовний. Будь-що, що починає хід, надсилає весь ваш контекст заново: спрацювання запланованого завдання, повідомлення з іншої сесії, агент-напарник, який досі працює, звірка цілі. Ще дві речі коштують токенів без жодного ходу: ущільнення, яке мусить прочитати розмову, що її підсумовує, і перше повідомлення після довгої паузи, яке промахується повз кеш промптів і обробляє всю вашу історію заново за повною ціною.
Чи скорочує Claude Code свої тижневі ліміти у вересні 2026 року?
Тимчасова надбавка, яка додавала 50% до тижневого вікна, діє до 14 вересня 2026 року, і від цієї дати її місце посідає постійна надбавка в 25% понад рівень, що був до неї. Виміряне щодо того початкового рівня, це зростання, але виміряне щодо того, що має користувач Claude Code сьогодні, це зменшення на 17%: тиждень, який вартував 150, вартує 125. Рухоме вікно сесії не змінюється, тож різниця помітна лише на тижнях, достатньо навантажених, щоб дійти до тижневої стелі.
Чи попередження про контекст це те саме, що ліміт використання?
Ні, і плутанина між ними веде людей до хибного розв'язання. Попередження про контекст або про автоущільнення стосується однієї розмови, яка наближається до контекстного вікна моделі, і вирішується очищенням або ущільненням цієї сесії. Ліміт використання стосується ліміту вашої підписки по всіх сесіях, і очищення не повертає з нього нічого. Ознака в формулюванні: повідомлення про ліміт називає час поновлення, попередження про контекст ні.
Завантажити AgentsRoom
Запускайте всіх своїх AI-агентів на всіх своїх проєктах з одного вікна.
Додаток-компаньйон: контролюйте своїх агентів на ходу
Використовуйте свого: Claude, Codex, Antigravity CLI або іншого AI-провайдера.
Надсилайте баги та запити прямо у свій публічний беклог.
Читати далі
Routines у Claude Code: що працює в хмарі, що залишається на вашій машині і як вибрати
Routines дають Claude Code змогу запускати збережений промпт без вашої участі: за розкладом, за викликом API або за подією GitHub, у хмарній сесії на свіжому клоні вашого репозиторію. Вони перебувають у research preview. Claude Code також має два локальні способи планувати роботу, заплановані завдання десктопного застосунку і /loop, і всі три поводяться по-різному: мінімальний інтервал, доступ до ваших локальних файлів, запити дозволів, що відбувається, коли ноутбук спить. Цей посібник розкладає всі три варіанти з обмеженнями з документації, а потім пояснює, чому наші власні сім нічних агентів працюють на локальній машині.
Читати статтюСім AI-агентів працюють у нас ночами: агенти за розкладом не лише для коду, з промптами
Користувач запитав, як ми використовуємо AI-агентів для чогось, окрім написання коду. З 28 серпня щовечора на Mac mini запускаються сім агентів за розкладом: черговий CEO, SEO-команда, продакт-менеджер, фіксер багів, команда соцмереж, хранитель документації і репортер, який надсилає лист на 25 рядків. 33 ночі, 31 ранковий лист, 51 виправлений баг із посиланням на коміт, 7 статей у блозі 20 мовами. Що робить кожен, як вони передають одне одному роботу, не розмовляючи, яка модель виконує яку роботу, чотири правила, які довелося вивчити їхнім промптам, і самі промпти, готові до копіювання.
Читати статтюТепер код пишуть агенти. Ось чим стала робота розробника.
Писати код було лише однією ланкою з шести, і саме її забрали агенти. Решта п'ять поважчали. Розбір роботи, яка лишилася: почути запит, вирішити, скласти бриф, вести виконання, переглянути, випустити.
Читати статтю