Tokengebruik: per sessie: live

Claude Code tokengebruik,
bijgehouden per sessie, in realtime

AgentsRoom houdt je Claude Code tokengebruik in de gaten in elke agent terminal. Een kleine tokenmeter zit in de composer en werkt live bij. Wanneer je tokenverbruik zwaar wordt in een enkele Claude sessie, wordt de badge rood en waarschuwt je voordat je door het contextvenster heen gaat.

Klik op de badge en de sessiemonitor opent: inputtokens, outputtokens, cache-lezen, cache-schrijven, cache-hitpercentage, aantal berichten, gerouteerde modellen, sessieduur en toolgebruik. Eén paneel, één Claude sessie, alle cijfers die je Claude Code tokengebruik bepalen.

Gratis · macOS · 100% lokaal, geen proxy

Live demo van de Claude Code tokengebruik badge in AgentsRoom: het zit in elke agent composer, wordt rood bij zwaar tokenverbruik, en opent een volledige sessiemonitor met inputtokens, outputtokens, cache-lezen en cache-schrijven.

Claude Code tokengebruik is de nummer één variabele kost van het draaien van AI-coderingsagenten. Elke prompt, elke tooloproep, elke CLAUDE.md herinjectie verbruikt tokens. Zonder zichtbaarheid ontdek je dat je door je budget heen bent wanneer de API vertraagt of de rekening arriveert. AgentsRoom plaatst een live Claude Code tokengebruik meter op elke agent sessie zodat je het verbruik ziet terwijl het gebeurt, niet achteraf.

De tokenmeter bevindt zich in de terminal composer, direct naast de verzendknop. Het werkt een paar seconden na elke Claude beurt bij. Tokens stapelen zich op gedurende de hele sessie: inputtokens, outputtokens, cache-schrijven en cache-lezen, allemaal opgeteld en kleurgecodeerd zodat je ze in één oogopslag kunt lezen. Wanneer het Claude Code tokengebruik per sessie een zware consumptiedrempel overschrijdt, wordt de badge rood met een waarschuwingspictogram, net zoals een brandstofmeter je waarschuwt voordat de tank leeg is.

Klik erop en de sessiemonitor opent. Je krijgt een live momentopname van de actieve Claude sessie: duur sinds het eerste bericht, aantal gebruikersprompts versus assistentbeurten, toolgebruik, modellen die het gesprek hebben afgehandeld, de Claude sessie-id (kopieerbaar voor --resume), en de volledige tokenanalyse. Cache-hitpercentage wordt ter plekke berekend, kleurgecodeerd groen / amber / rood, met een eenregelige herinnering dat cache-lezen ongeveer tien keer minder kost dan verse input. Dat ene paneel verandert Claude Code tokengebruik van een black box in een realtime meter.

Close-up van de AgentsRoom agent composer met de Claude Code tokengebruik badge die rood is geworden, waarschuwend voor zwaar verbruik bij 58M tokens

De tokenbadge bevindt zich naast de verzendknop en wordt rood wanneer het verbruik van een sessie zwaar wordt.

Waarom Claude Code tokengebruik per sessie belangrijk is

De meeste Claude wrappers rapporteren tokengebruik op accountniveau, één keer per dag, in een dashboard dat je moet onthouden te openen. Tegen die tijd is de schade al aangericht. AgentsRoom brengt Claude Code tokengebruik naar de oppervlakte, op elke enkele agent terminal, zodat je het niet kunt negeren. De tokenmeter is twee centimeter van de verzendknop. Je kijkt ernaar zoals je naar de ongelezen badge op je telefoon kijkt.

Per sessie is de juiste granulariteit. Een team van agenten dat parallel draait vertelt je niet wie tokens verbruikt. Eén agent kan vastlopen op een vastgelopen prompt terwijl vier anderen stil zijn. Met een Claude Code tokengebruik meter per sessie valt de luidruchtige agent meteen op: zijn badge is rood, zijn cache-hitpercentage is laag, zijn aantal berichten stijgt snel. Je springt erin, lost de prompt op, bespaart het budget.

De hele functie is lokaal. AgentsRoom leest je Claude Code tokengebruik rechtstreeks uit de JSONL-transcripten die Claude schrijft naar ~/.claude/projects/. Niets verlaat je machine. Geen gebruikstracker van derden. Geen proxy voor de API. De tokenmeter in AgentsRoom is gewoon een snellere, beter zichtbare lezing van de gegevens die Anthropic al op je schijf opslaat.

Claude Code tokengebruik modal in AgentsRoom: duur, status, aantal berichten, toolgebruik, modellen, sessie-id, plus tokenanalyse met input, output, cache-schrijven, cache-lezen en cache-hitpercentage

Het Claude Code tokengebruik paneel in AgentsRoom. Klik op de tokenbadge per sessie in een agent composer, krijg elk belangrijk cijfer, plus tips om je tokenverbruik te verlagen.

Wat het Claude Code tokengebruik paneel laat zien

Eén klik op de tokenbadge opent een live sessiemonitor. Hier is elk nummer dat je krijgt over de actieve Claude sessie.

Sessieduur

Verstreken tijd tussen het eerste en het laatste bericht van de actieve Claude sessie, live ververst. Handig om agenten te spotten die al uren context aan het kauwen zijn.

Live agentstatus

Inactief, aan het werk, klaar, of heeft input nodig. De status wordt gekoppeld aan de tokenmeter zodat je in één oogopslag ziet welke Claude sessie verbruikt en welke gewoon daar zit.

Berichten en assistentbeurten

Aantal gebruikersvragen versus assistentbeurten in de actieve Claude-sessie. Een scheve verhouding is een sterk signaal dat een agent in een lus zit of dat je prompt te vaag is.

Gereedschapsgebruik

Totaal aantal uitgevoerde Read-, Edit-, Bash-, Grep-, Glob- en andere gereedschapsoproepen door Claude in de sessie. Gereedschapsoproepen zorgen voor een groot deel van de invoertokens, dus dit aantal volgt het Claude Code-tokenverbruik nauwgezet.

Gebruikte modellen

Elk Claude-model dat een beurt in de sessie heeft afgehandeld: Sonnet, Opus, Haiku, gedateerde varianten. AgentsRoom dedupliceert en verkort namen zodat je meteen ziet of je sessie automatisch over modellen is gerouteerd.

Claude sessie-id

De interne Claude sessie-identificatie, met één klik te kopiëren. Gebruik het om met claude --resume exact hetzelfde gesprek vanuit de CLI voort te zetten zonder context te verliezen.

Invoertokens

Nieuwe invoertokens die tijdens de sessie naar Claude zijn gestuurd, voordat er hergebruik van de cache plaatsvindt. Dit is de duurste categorie van je Claude Code-tokenverbruik.

Uitvoertokens

Tokens gegenereerd door Claude in de sessie. Uitvoertokens worden tegen een hoger tarief gefactureerd dan invoer, dus hoge waarden zonder vooruitgang betekenen dat een agent vastloopt.

Cache-schrijvingen

Tokens die Claude tijdens de sessie naar de promptcache schrijft. Cache-schrijvingen worden tegen een kleine premie in rekening gebracht, maar ze ontgrendelen goedkope cache-lezingen bij de volgende beurten.

Cache-lezingen

Tokens die uit de promptcache worden bediend in plaats van opnieuw als nieuwe invoer te worden geprijsd. Cache-lezingen kosten ongeveer 10x minder dan invoertokens, daarom is de cache-hitratio de belangrijkste maatstaf van je Claude Code-tokenverbruik.

Cache-hitratio

Percentage invoerzijde-tokens die uit de cache worden bediend, groen gecodeerd boven 70 procent, amber tussen 30 en 70, rood onder 30. Hoger is goedkoper. De beste hefboom op Claude Code-tokenverbruik.

Totale tokens

Cumulatieve som van invoer, uitvoer, cache-schrijvingen en cache-lezingen voor de actieve sessie. Handig als een enkel hoofdnummer wanneer je het tokenverbruik tussen agents vergelijkt.

Waarom de tokenmeter rood wordt

AgentsRoom controleert je Claude Code-tokenverbruik per sessie bij elke peiling. Wanneer het lopende totaal een drempel voor hoog verbruik overschrijdt, wordt de badge rood met een waarschuwingspictogram. Dat is het signaal om de sessiemonitor te openen en te beslissen wat te doen: comprimeren, een nieuwe agent forken, model wisselen, of simpelweg de taak afronden en afsluiten.

Rood is geen harde limiet. AgentsRoom beperkt je agent niet en onderbreekt de uitvoering niet. Het is een visuele hint, op een enkele agent, zodat een ongecontroleerde lus niet stilletjes je Anthropic-budget leegtrekt terwijl je je op een ander venster concentreert. Lange sessies met gezonde cache-hitratio's zijn prima en blijven groen.

Hoe AgentsRoom het Claude Code-tokenverbruik bijhoudt

Drie lagen: een verbruikspoller, een JSONL-parser en een live UI.

01

Poller leest token-totalen elke 15 seconden

Een achtergrondtaak leest het tokenverbruik per sessie uit je lokale Claude-status en duwt het naar de renderer store. Geen proxy op de API, geen extra netwerkoproep. Gewoon een snellere, zichtbare lezing van de cijfers die Claude al naar de schijf schrijft.

02

JSONL-parser ververst elke 10 seconden terwijl de modal open is

De sessiemonitor voegt een eenmalige IPC-oproep toe die het JSONL-transcript van de actieve Claude-sessie doorloopt om berichtentellingen, assistentbeurten, gereedschapsgebruik, gerouteerde modellen en eerste/laatste tijdstempels te berekenen. Verversen gebeurt elke 10 seconden terwijl het paneel op het scherm staat, zodat de cijfers live blijven zonder de parser bij elke renderer-poll te belasten.

03

Live UI: badge plus sessiemonitor

De badge in de terminalcomponist leest de token-totalen en beslist groen of rood. Klik erop en de sessiemonitor opent, in een portaal zodat het het hele venster overlayt. Cijfers zijn geformatteerd met duizend-separatoren, cache-hitratio is gekleurd, en een tipsectie geeft je een duwtje om minder te verbruiken.

Tips om je Claude Code tokengebruik te verlagen

De sessiemonitor toont deze tips contextueel, gebaseerd op je live cache-hitpercentage. Stuur ze met één klik direct naar de agentterminal.

Laag cache-hitpercentage: stabiliseer het promptvoorvoegsel

Onder de 30 procent betaalt Claude elke beurt de volledige invoerprijs. Het bewerken van CLAUDE.md tijdens de sessie, het wisselen van model of het herschikken van vroege systeemberichten verbreekt de cache. Vergrendel de bovenkant van de prompt en zie het cache-hitpercentage stijgen.

Gebruik /compact in plaats van /clear

Slash clear wist het gesprek en dwingt volledige invoerprijzen af bij de volgende beurt. Slash compact behoudt de taak en verkleint de geschiedenis tot een samenvatting, zodat het cachevoorvoegsel behouden blijft. Zelfde frisse gevoel, veel lager Claude Code tokengebruik.

Lees gedeeltelijk, niet volledig

Bij bestanden groter dan 100 regels, vraag de agent om Read met offset en limiet te gebruiken, of grep eerst naar het symbool. Het elke beurt laden van een bestand van 4000 regels is de stille nummer één oorzaak van Claude Code tokengebruik.

Bewerk in plaats van Schrijf

De Edit-tool stuurt alleen het verschil terug naar Claude. Schrijven zendt het hele bestand opnieuw uit. Bij een component van 600 regels verdubbelt dat de outputtokens en vergroot het de invoer van de volgende beurt.

Start sub-agents voor brede zoekopdrachten

Glob en Grep over honderden bestanden dumpen veel ruis in je hoofdcontext. De Agent-tool draait in zijn eigen contextvenster en geeft alleen een samenvatting terug, waardoor de hoofdprompt klein blijft.

Verklein je CLAUDE.md

CLAUDE.md wordt aan elke beurt voorafgegaan. Elke nutteloze paragraaf daar kost gecachte invoertokens keer elk bericht. Verplaats lange context naar context/ en verwijs ernaar op aanvraag.

AgentsRoom sessiemonitor met toolgebruikstatistieken, gelezen bestanden en contextuele tips om Claude Code tokengebruik te verlagen, elk met een Fix this-knop met één klik

De sessiemonitor leest je live cache-hitratio en toont kant-en-klare oplossingen. Eén klik op Fix this stuurt de prompt direct naar de agent.

AgentsRoom tokenmeter versus standaard Claude Code

Standaard Claude Code toont tokentotalen aan het einde van een sessie, in een kleine voettekstregel die je omhoog moet scrollen om te vinden. Er is geen live meter. Geen per-sessie uitsplitsing. Geen cache-hitpercentage in één oogopslag. Geen waarschuwing wanneer het verbruik piekt. Je ontdekt overmatig gebruik achteraf, wanneer de API limieten oplegt of de maandelijkse factuur te hoog is.

AgentsRoom maakt Claude Code tokengebruik tot een eersteklas signaal. Elke agent krijgt zijn eigen tokenteller. Rood bij overmatig gebruik. Klik voor de volledige uitsplitsing. Cache-hitpercentage in real-time berekend. Tips die je live cijfers lezen en kant-en-klare prompts voorstellen om het lek te dichten. Dezelfde Claude-sessie, dezelfde JSONL-transcripten, maar met de zichtbaarheid die een vloot van parallelle agents echt nodig heeft.

Wanneer de Claude Code tokengebruikmeter je redt

Drie echte situaties waarin de per-sessie tokentracker zichzelf terugverdient.

Een agent zit vast in een lus

Een agent blijft hetzelfde bestand opnieuw lezen en dezelfde oplossing opnieuw proberen. Zijn tokenbadge wordt binnen enkele minuten rood, zijn cache-hitpercentage daalt, zijn berichtverhouding is scheef. Je ziet het op het dashboard, springt in, herschrijft de prompt, bespaart het budget.

Een lange taak gaat geweldig

Drie uur in een refactor vraag je je af of de agent nog op schema ligt. Open de sessiemonitor: 700 berichten, 180 toolgebruik, 78 procent cache-hitpercentage, alles groen. Tokenverbruik is hoog in absolute zin, normaal in efficiëntie. Laat het doorgaan.

Nachtelijke run op een vloot

Vijf agents werken een achterstand weg terwijl je slaapt. In de ochtend vertelt het per-sessie tokengebruik je welke efficiënt was, welke in een lus zat, welke buiten context raakte. Triage in twee minuten in plaats van elk transcript te lezen.

De Claude Code tokengebruiksmeter is een onderdeel van een groter monitoroppervlak. Live agentstatus, dockbadges en mobiele pushmeldingen maken het plaatje compleet.

Zie hoe AgentsRoom AI-agenten monitort

Het zien van het aantal is stap één. Onze volledige gids legt precies uit waar Claude Code tokens naartoe gaan en hoe je de rekening kunt verlagen zonder te vertragen: strakkere context, het juiste model, delegatie en meer.

Lees: verlaag je Claude Code tokenkosten

FAQ

Is de Claude Code tokentracker nauwkeurig?

Ja. AgentsRoom leest dezelfde JSONL-transcripten die Claude zelf schrijft naar ~/.claude/projects/. Invoertokens, outputtokens, cache-schrijvingen en cache-lezingen worden direct gehaald uit de per-bericht gebruikspayload die Anthropic uitzendt. Er is geen schatting, geen proxy, geen afronding. De cijfers in de sessiemonitor komen overeen met wat Anthropic in rekening brengt.

Vertraagt de tokenteller mijn agent?

Nee. De poller leest elke 15 seconden lokale bestanden. De JSONL-parse draait alleen wanneer de sessiemonitor open is, elke 10 seconden. Er is geen extra netwerkoproep naar Anthropic, geen instrumentatie geïnjecteerd in Claude, geen overhead op tooloproepen. Je agent draait op volle snelheid.

Wanneer wordt de badge rood?

Wanneer het cumulatieve Claude Code tokengebruik per sessie een drempel voor zwaar verbruik overschrijdt, die is afgestemd op normale lange coderingssessies. De drempel is conservatief genoeg dat een inactieve sessie deze nooit bereikt, en strak genoeg dat een ongecontroleerde lus binnen een paar beurten rood wordt. Rood is een waarschuwing, geen beperking.

Waarom is de cache-hitratio zo belangrijk?

Cache-lezen kost ongeveer 10x minder dan nieuwe invoertokens. Een sessie met een cache-hitratio van 80 procent is ongeveer vijf keer goedkoper dan dezelfde sessie met 0 procent. De cache-hitratio is de beste hefboom voor je Claude Code tokengebruik. AgentsRoom toont het live zodat je halverwege de sessie kunt bijsturen in plaats van er pas aan het einde achter te komen.

Ondersteunt het ook Codex, Antigravity, OpenCode, Aider, Grok Build, Mistral Vibe en Kimi Code?

De sessiemonitor in zijn huidige vorm is Claude-specifiek omdat het Claude's JSONL-transcripten leest en de prompt-cache verdeling een Claude-only factureringsfunctie is. Status, rol en meldingen werken voor elke provider. We volgen provider-onafhankelijk gebruik in de roadmap.

Stuurt AgentsRoom mijn Claude Code tokengebruik naar een server?

Nee. De tokenteller, de sessiemonitor en de cache-hitratio worden volledig op je Mac berekend, vanuit lokale bestanden. Niets verlaat je machine. Als je de optionele versleutelde synchronisatie met de mobiele compagnon inschakelt, wordt alleen de data die je expliciet kiest om te spiegelen verzonden, en het is end-to-end versleuteld via de AgentsRoom relay.

Kan ik de tips opslaan als herbruikbare prompts?

Ja. Elke tip in de sessiemonitor heeft een Fix this-knop die een bewerkbare, kant-en-klare prompt opent. Stuur het direct naar de agentterminal, kopieer het naar het klembord, of sla het op in je globale promptbibliotheek zodat dezelfde oplossing met één klik beschikbaar is in elk project.

Hoe controleer ik mijn Claude Code tokengebruik?

Claude Code zelf biedt je twee ingebouwde functies: /cost toont de uitgaven van de huidige sessie, en /context laat zien hoeveel van het contextvenster momenteel gevuld is. Geen van beide is live, en geen van beide overleeft een herstart. Claude schrijft ook elk bericht naar een JSONL-transcript in ~/.claude/projects/, met de exacte invoer-, uitvoer-, cache-schrijf- en cache-leestellingen waarvoor Anthropic je factureert. AgentsRoom leest diezelfde bestanden en toont het lopende totaal van elke sessie, bijgewerkt elke 15 seconden, zodat je het aantal ziet stijgen terwijl de agent werkt in plaats van er achteraf naar te vragen.

Hoe werken Claude Code tokens eigenlijk?

Elke uitwisseling wordt gefactureerd op vier afzonderlijke tellers, niet één. Invoertokens zijn wat je verstuurt: prompt, gelezen bestanden, toolresultaten en het hele gesprek tot nu toe, opnieuw verzonden bij elke beurt. Uitvoertokens zijn wat Claude terugschrijft. Cache-schrijfopdrachten slaan een deel van die context op zodat de volgende beurt er niet de volle prijs voor betaalt. Cache-leesopdrachten spelen het opnieuw af, tegen ongeveer een tiende van de invoerprijs. Dit is waarom een lange sessie duur wordt: het gesprek wordt bij elke beurt volledig opnieuw verzonden, dus invoertokens groeien met elk bericht tenzij de cache ze absorbeert.

Hoe weet ik hoeveel tokens ik nog over heb?

Bij een Claude Pro of Max-abonnement is er geen tokenbalans om te lezen: Anthropic meet je op rollende gebruiksvensters, en de CLI vertelt je alleen wanneer je de limiet bereikt. Wat je kunt volgen is het verbruik, en dat is het getal dat de limiet voorspelt. AgentsRoom houdt een totaal per sessie bij voor elke actieve agent en kleurt de badge rood wanneer een sessie een drempel voor zwaar verbruik overschrijdt, wat het signaal is dat een sessie je venster sneller opeet dan normaal, ruim voordat Claude Code stopt met antwoorden.

Stop met gokken op je Claude Code tokengebruik

Download AgentsRoom en krijg een live per-sessie tokenmeter op elke Claude-agent. Rood bij overmatig gebruik, cache-hitratio in één oogopslag, tips om minder te verbruiken. Alles lokaal, alles van jou.

GratisDownload AgentsRoom

Companion-app: houd je agents onderweg in de gaten

Breng je eigen: Claude, Codex, Antigravity CLI of andere AI-provider.

Download de extensie
Chrome Web Store

Stuur bugs en verzoeken direct naar je openbare backlog.

Een glimp van AgentsRoom in actie.

Meerdere projecten
Multi-provider
Meerdere agenten
Live status
Bestandsverschil & commit
Mobiele metgezel
Live voorbeeld
Agententeams
Browserautomatisering
Backlog-gedreven ontwikkeling
Promptbibliotheek
Vaardighedenbibliotheek
Bekijk alle functies