Hoeveel tokens heb ik nog in Claude? Dat getal bestaat niet.
Je abonnement op Claude wordt niet in tokens uitgedrukt, dus geen enkel scherm toont een tokensaldo. Hier lees je wat er werkelijk gemeten wordt, waar je het afleest, en waarom het doorloopt terwijl je niet zit te typen.
Het is een van de meest gezochte vragen over Claude, en ze wordt in bijna elke taal gesteld. Ze heeft ook een ongemakkelijk antwoord: dat getal bestaat niet, want je abonnement wordt niet in tokens verkocht.
Dat is geen spitsvondigheid. Het verklaart waarom je de teller die je zoekt nergens vindt, waarom elke pagina die beweert er een te tonen zit te gokken, en waarom datgene wat je midden in een taak werkelijk stilzet niet is waar de meeste mensen naar zitten te kijken.
Je abonnement wordt gemeten in vensters, niet in tokens
Anthropic drukt een abonnement op Claude niet uit als een tokentegoed. Het meet het als gebruiksvensters: een sessievenster dat meeschuift, en daarbovenop een wekelijks venster. Beide worden gedeeld over elke omgeving waarop je inlogt, dus een lange middag in de chat van Claude laat je die avond minder ruimte over voor Claude Code. Beide worden ook over alle modellen gedeeld, en daarom geeft overstappen op een goedkoper model met /model je je limiet niet terug zodra je die hebt bereikt.
Wat je kunt aflezen is dus een aandeel van een venster en het tijdstip waarop het terugkomt, geen saldo. Wanneer je er echt doorheen bent, zegt het bericht dat je tegenhoudt welk plafond je hebt geraakt en wanneer het reset, en dat bericht is het enige gezaghebbende cijfer voor jouw account.
De enige plek waar een tokenaantal letterlijk iets betekent, is de API, die per token wordt gefactureerd. Alles hieronder gaat over het abonnement, en dat is waar de meeste mensen eigenlijk naar vragen.
Het getal dat je wel kunt aflezen, en waar het staat
Twee schermen, en ze beantwoorden verschillende vragen.
In Claude Code is /usage het commando dat de moeite van het leren waard is. Op een Pro-, Max-, Team- of Enterprise-abonnement toont het gebruiksbalken voor de limieten van je abonnement, en met d of w wissel je tussen de laatste 24 uur en de laatste 7 dagen. Onder de balken doet het iets nuttigers dan welk ruw getal ook: het wijst recent gebruik toe aan skills, subagents, plugins en afzonderlijke MCP-servers, elk als een percentage, en het geeft een gedragswaarschuwing wanneer een enkel patroon 10% of meer van je recente verbruik voor zijn rekening neemt, zoals lange context of cachemissers.
Een kanttekening telt hier, en die wordt makkelijk over het hoofd gezien: die cijfers worden berekend uit je lokale sessiegeschiedenis op die machine. Werk dat je vanaf een andere laptop hebt gedaan, of op claude.ai, zit er niet in.
Op het web is Settings en dan Usage op claude.ai het beeld op accountniveau: je abonnement, waar je staat, en wanneer het wekelijkse venster reset. Werk je op twee machines, dan is dit het beeld dat volledig is.
Voor een uitsplitsing per sessie van wat een stuk werk werkelijk heeft gekost, drukt het bovenste blok van /usage de ruwe aantallen af:
Usage by model:
claude-sonnet-4-6: 1.2k input, 5.3k output, 940.0k cache read, 50.0k cache write
Die vier getallen vormen het hele verhaal van een codeersessie, en het grootste is bijna altijd cache read. Wil je dat beeld doorlopend in plaats van op aanvraag, dan houdt AgentsRoom een live tokenmeter bij op elke sessie naast de terminal, met dezelfde opsplitsing in input, output en cache en een rode badge zodra een sessie warm begint te lopen. De stap-voor-stapversie van het aflezen van de teller van de CLI zelf staat in hoe je het tokengebruik van Claude Code controleert.
Wat een token eigenlijk is zodra er een agent bij komt kijken
Een token is een fragment tekst: ruwweg driekwart van een woord in het Engels, en merkbaar minder in code, waar leestekens en identifiers gemakkelijk uiteenvallen.
Wat mensen verrast, is dat een gesprek bij elk verzoek volledig opnieuw wordt verstuurd. Stel een vraag van een regel in een sessie die al sinds vanochtend openstaat en je betaalt niet voor die regel, je betaalt voor de hele geschiedenis die ermee meereist. Elke keer dat de agent een tool gebruikt, stuurt hij weer een verzoek dat de vorige toolresultaten meedraagt, en daarom kan een enkele "los deze test op" uitgroeien tot een stuk of twaalf keer heen en weer.
Prompt caching is wat dit draaglijk maakt. Herhaalde geschiedenis wordt tegen een veel lager cachetarief gerekend, en daarom is het cijfer cache read enorm en de rekening niet. Het legt ook de basis voor de duurste gewoonte in werken met agents, en dat is het onderwerp van de volgende sectie.
Waarom de balk oploopt terwijl je niet zit te typen
Als je gebruik oploopt in een sessie die stilligt, is het een van deze oorzaken, en geen ervan is een bug:
- De cache die verloopt. Gecachete context leeft ongeveer een uur op een abonnement, en zakt naar vijf minuten zodra je gebruikstegoeden aanspreekt, of op een API-sleutel. Kom terug van de lunch en je eerste bericht mist de cache: je hele gesprek wordt opnieuw verwerkt tegen het volle tarief. Een pauze, een volledige herverwerking.
- Alles wat uit zichzelf een beurt start. Een geplande taak die afgaat, een bericht dat binnenkomt uit een van je andere sessies, een controle op een doel terwijl er achtergrondwerk loopt. Elk daarvan stuurt de volledige context opnieuw, precies zoals een bericht dat je zelf typt.
- Agents als teamgenoot. Elke actieve teamgenoot draait zijn eigen contextvenster en blijft verbruiken tot hij stopt. Anthropic geeft zelf als richtlijn dat een team in plan mode ongeveer zeven keer een standaardsessie kost.
- Compactie.
/compactmoet het gesprek lezen dat het samenvat, dus een grote context compacteren is zelf een groot verzoek./clearkost niets, en wanneer je geen continuïteit nodig hebt is dat de betere zet. - Achtergrondwerk. Samenvattingen voor
--resumeen soortgelijke klusjes trekken een kleine hoeveelheid, zelfs wanneer je niets doet, doorgaans minder dan vier dollarcent per sessie.
Hier lopen ook de twee waarschuwingen uiteen die mensen door elkaar halen. Een context- of auto-compactwaarschuwing zegt dat een gesprek het contextvenster van het model nadert, en die sessie leegmaken lost het op. Een gebruikslimiet zegt dat het tegoed van je abonnement over alle sessies heen op is, en leegmaken geeft daar niets van terug. Het betrouwbare kenmerk: een gebruikslimiet noemt een resettijdstip, een contextwaarschuwing niet.
Wat te doen wanneer de balk bijna vol is
Ruwweg op volgorde van wat ze opleveren voor de moeite:
- Maak leeg tussen taken die niets met elkaar te maken hebben. Verouderde context wordt de rest van de sessie bij elk bericht opnieuw verstuurd. Gebruik
/renamevóór/clearals je hem later met/resumewilt terugvinden. - Kies het model dat bij de klus past. Sonnet handelt het meeste codeerwerk af; Opus als standaard aanhouden is de meest voorkomende oorzaak van een tegoed dat op donderdag verdwenen is.
- Lees de toewijzing in
/usage. Als een enkele MCP-server of een enkele subagent 30% van je week beslaat, dan is dat de oplossing, en je had nooit geraden welke. - Zet het denken lager voordat je het uitzet. Denktokens worden als output gefactureerd. Het redeneerniveau verlagen is meestal genoeg.
- Duw breedsprakig werk naar subagents. Testuitvoer en logbestanden blijven in de context van de subagent en er komt alleen een samenvatting terug.
- Houd het contextbestand kort. Alles in
CLAUDE.mdofAGENTS.mdwordt bij de start van de sessie geladen en bij elke beurt betaald, ook wanneer het niet ter zake doet. Lange werkinstructies horen in een skill, die alleen laadt wanneer je hem aanroept. Meer daarover staat in de gids over het contextbestand AGENTS.md.
Wil je specifiek de langere versie van de kant van het kostenbesparen, dan behandelt de tokenkosten van Claude Code verlagen dat in detail.
De korte versie
Stop met zoeken naar een tokensaldo: je abonnement heeft er geen. Leer de twee vensters kennen, lees /usage voor de toewijzing en niet voor een totaal, en behandel de cache als datgene wat over je week beslist. De ontwikkelaars die nooit tegen een limiet aanlopen, zijn zelden degenen die minder typen. Het zijn degenen die een verse sessie starten wanneer het onderwerp verandert.
Meerdere agents tegelijk draaien maakt dit alles zowel erger als beter zichtbaar, want het verbruik houdt op een enkel getal te zijn en wordt een getal per agent. Dat is het beeld waar AgentsRoom omheen is gebouwd.
Veelgestelde vragen
Hoeveel tokens heb ik nog in Claude?
Zo'n getal bestaat niet om op te zoeken. Een abonnement op Claude wordt niet verkocht als een tokenbudget: het wordt gemeten als een aandeel van een voortschrijdend sessievenster plus een wekelijks venster, en wat je kunt aflezen is een percentage van die vensters en het tijdstip waarop ze resetten, geen saldo aan tokens. Je leest het af met het commando /usage in Claude Code, of via Settings en dan Usage op claude.ai. Alleen op de API, die per token wordt gefactureerd, betekent een tokengetal werkelijk iets.
Hoe werken de tokens van Claude?
Een token is een fragment tekst, ruwweg driekwart van een woord in het Engels en minder in code. Elk verzoek stuurt je hele gesprek opnieuw mee, dus een codeersessie betaalt bij elke beurt voor haar opgebouwde geschiedenis, niet alleen voor de zin die je hebt getypt. Daarom wordt gebruik in vier aparte cijfers geteld: input, output, cacheschrijving en cachelezing. Gecachete geschiedenis wordt tegen een veel lager tarief gerekend dan verse input, en precies daarom trekt een sessie die de hele dag openstaat nog steeds aan je abonnement.
Wanneer reset mijn gebruik van Claude?
Er zijn twee klokken en ze staan los van elkaar. Een sessievenster schuift mee, dus het verloopt een vast aantal uren nadat het is geopend en niet op een tijdstip dat jij hebt gekozen. Daarbovenop ligt een wekelijks venster dat reset op een vast moment dat aan jouw account is toegewezen. Het limietbericht zelf vertelt je wanneer het venster dat je heeft tegengehouden terugkomt, en dat bericht is het gezaghebbende antwoord voor jouw account. De twee klokken worden gedeeld tussen de chat van Claude en Claude Code, dus zwaar chatgebruik verkort het budget dat je overhoudt om te coderen.
Krijg ik mijn limiet terug door naar een goedkoper model over te stappen?
Nee. Het sessievenster en het wekelijkse venster worden over alle modellen gedeeld, dus wisselen met /model geeft je geen toegang terug zodra je ze hebt bereikt. Het helpt in een specifiek geval: een modelspecifiek bericht, zoals het bereiken van je limiet op Opus, waarbij overstappen naar Sonnet je laat doorwerken. Het helpt ook voordat je erdoorheen bent, omdat een goedkoper model minder van hetzelfde tegoed verbruikt voor hetzelfde werk.
Waarom loopt mijn gebruik op terwijl ik niets doe?
Omdat nietsdoen niet gratis is in een sessie met agents. Alles wat een beurt start, stuurt je volledige context opnieuw mee: een geplande taak die afgaat, een bericht dat binnenkomt uit een andere sessie, een agent als teamgenoot die nog draait, een controle op een doel. Twee dingen kosten tokens zonder dat er een beurt aan te pas komt: compactie, die het gesprek moet lezen dat ze samenvat, en het eerste bericht na een lange pauze, dat de promptcache misloopt en je volledige geschiedenis opnieuw verwerkt tegen het volle tarief.
Is een contextwaarschuwing hetzelfde als een gebruikslimiet?
Nee, en die twee door elkaar halen stuurt mensen naar de verkeerde oplossing. Een context- of auto-compactwaarschuwing gaat over een gesprek dat het contextvenster van het model nadert, en je lost hem op door die sessie leeg te maken of te compacteren. Een gebruikslimiet gaat over het tegoed van je abonnement over al je sessies heen, en leegmaken geeft daar niets van terug. Het verschil zit in de bewoording: een limietbericht noemt een resettijdstip, een contextwaarschuwing niet.
Download AgentsRoom
Voer je AI-agenten (Claude, Codex, Antigravity CLI, OpenCode, Aider, Grok Build, Mistral Vibe, Kimi Code) uit op al je projecten, vanuit één enkel venster.
Companion-app: houd je agents onderweg in de gaten
Breng je eigen: Claude, Codex, Antigravity CLI of andere AI-provider.
Stuur bugs en verzoeken direct naar je openbare backlog.
Een glimp van AgentsRoom in actie.
Verder lezen
Hoe Claude Code tokengebruik te controleren: 4 manieren om te zien wat je agents uitgeven
Vier manieren om Claude Code tokengebruik te controleren: het /cost commando, de sessietranscripten, de ccusage CLI en een live per-sessie meter. Zie precies wat elke agent uitgeeft.
Lees het artikelConverteer PDF naar Markdown om LLM Tokens te Besparen: De MarkItDown Gids
PDF's direct naar Claude of een andere LLM voeren verbruikt stilletjes tokens: elke pagina wordt ook omgezet in een afbeelding. Converteer het bestand eerst naar Markdown met MarkItDown, Microsoft's gratis open-source tool, en verlaag je tokenrekening met tot wel 80%. Volledige gids met CLI, Python en MCP setup.
Lees het artikelAgents schrijven nu de code. Dit is wat het vak van de ontwikkelaar is geworden.
Code schrijven was één schakel van de zes, en dat is precies de schakel die de agents hebben overgenomen. De andere vijf zijn zwaarder geworden. Een rondgang langs het vak dat overblijft: horen, beslissen, briefen, aansturen, beoordelen, opleveren.
Lees het artikel