Claude Code Token-Nutzung,
pro Sitzung in Echtzeit verfolgt
AgentsRoom überwacht Ihre Claude Code Token-Nutzung in jedem Agenten-Terminal. Ein kleiner Token-Zähler befindet sich im Composer und wird live aktualisiert. Wenn Ihr Tokenverbrauch in einer einzelnen Claude-Sitzung hoch wird, wird das Abzeichen rot und warnt Sie, bevor Sie das Kontextfenster überschreiten.
Klicken Sie auf das Abzeichen und der Sitzungsmonitor öffnet sich: Eingabetokens, Ausgabetokens, Cache-Lesungen, Cache-Schreibvorgänge, Cache-Trefferquote, Nachrichtenanzahl, geroutete Modelle, Sitzungsdauer und Tool-Nutzungen. Ein Panel, eine Claude-Sitzung, alle Zahlen, die Ihren Claude Code Tokenverbrauch antreiben.
Kostenlos · macOS · 100 % lokal, kein Proxy
Live-Demo des Claude Code Token-Nutzungsabzeichens in AgentsRoom: Es befindet sich in jedem Agenten-Composers, wird rot bei hohem Tokenverbrauch und öffnet einen vollständigen Sitzungsmonitor mit Eingabetokens, Ausgabetokens, Cache-Lesungen und Cache-Schreibvorgängen.
Die Claude Code Token-Nutzung ist die Nummer eins der variablen Kosten für den Betrieb von KI-Coding-Agenten. Jede Eingabeaufforderung, jeder Toolaufruf, jede CLAUDE.md-Reinjektion verbraucht Tokens. Ohne Sichtbarkeit stellen Sie fest, dass Sie Ihr Budget überschritten haben, wenn die API drosselt oder die Rechnung eintrifft. AgentsRoom platziert einen Live-Token-Zähler für die Claude Code Token-Nutzung in jeder Agentensitzung, sodass Sie den Verbrauch in Echtzeit sehen können, nicht danach.
Der Token-Zähler befindet sich im Terminal-Composer, direkt neben der Senden-Schaltfläche. Er wird ein paar Sekunden nach jeder Claude-Drehung aktualisiert. Tokens summieren sich über die gesamte Sitzung: Eingabetokens, Ausgabetokens, Cache-Schreibvorgänge und Cache-Lesungen, alle summiert und farblich codiert, sodass Sie sie auf einen Blick lesen können. Wenn die Token-Nutzung pro Sitzung einen hohen Verbrauch überschreitet, wird das Abzeichen rot mit einem Warnsymbol, so wie eine Tankanzeige Sie warnt, bevor der Tank leer ist.
Klicken Sie darauf und der Sitzungsmonitor öffnet sich. Sie erhalten einen Live-Snapshot der aktiven Claude-Sitzung: Dauer seit der ersten Nachricht, Anzahl der Benutzeraufforderungen im Vergleich zu den Assistenten-Drehungen, Tool-Nutzungen, Modelle, die das Gespräch geführt haben, die Claude-Sitzungs-ID (kopierbar für --resume) und die vollständige Token-Aufschlüsselung. Die Cache-Trefferquote wird in Echtzeit berechnet, farblich codiert in grün/bernstein/rot, mit einer einzeiligen Erinnerung, dass Cache-Lesungen ungefähr zehnmal weniger kosten als frische Eingaben. Dieses einzelne Panel verwandelt die Claude Code Token-Nutzung von einer Black Box in ein Echtzeit-Messgerät.

Das Token-Abzeichen sitzt direkt neben der Senden-Schaltfläche und wird rot, sobald der Verbrauch einer Sitzung stark ansteigt.
Warum die Token-Nutzung pro Sitzung wichtig ist
Die meisten Claude-Wrapper berichten über die Token-Nutzung auf Kontoebene, einmal täglich, in einem Dashboard, das Sie sich merken müssen zu öffnen. Bis dahin ist der Schaden bereits angerichtet. AgentsRoom bringt die Claude Code Token-Nutzung an die Oberfläche, in jedem einzelnen Agenten-Terminal, sodass Sie sie nicht ignorieren können. Der Token-Zähler ist zwei Zentimeter von der Senden-Schaltfläche entfernt. Sie werfen einen Blick darauf, wie Sie auf das ungelesene Abzeichen auf Ihrem Telefon schauen.
Pro Sitzung ist die richtige Granularität. Ein Team von Agenten, das parallel arbeitet, sagt Ihnen nicht, wer Tokens verbraucht. Ein Agent könnte in einer festgefahrenen Eingabeaufforderung feststecken, während vier andere still sind. Mit einem Token-Zähler für die Claude Code-Nutzung pro Sitzung sticht der laute Agent sofort hervor: sein Abzeichen ist rot, seine Cache-Trefferquote ist niedrig, seine Nachrichtenanzahl steigt schnell. Sie springen ein, beheben die Eingabeaufforderung und sparen das Budget.
Die gesamte Funktion ist lokal. AgentsRoom liest Ihre Claude Code Token-Nutzung direkt aus den JSONL-Transkripten, die Claude in ~/.claude/projects/ schreibt. Nichts verlässt Ihren Computer. Kein Drittanbieter-Nutzungsverfolger. Kein Proxy vor der API. Der Token-Zähler in AgentsRoom ist lediglich eine schnellere, sichtbarere Ablesung der Daten, die Anthropic bereits auf Ihrer Festplatte speichert.

Das Panel zur Claude Code Token-Nutzung in AgentsRoom. Klicken Sie auf das Token-Abzeichen pro Sitzung in jedem Agenten-Composers, erhalten Sie jede wichtige Zahl sowie Tipps zur Senkung Ihres Tokenverbrauchs.
Was das Panel zur Claude Code Token-Nutzung zeigt
Ein Klick auf das Token-Abzeichen öffnet einen Live-Sitzungsmonitor. Hier sind alle Zahlen, die Sie in der aktiven Claude-Sitzung erhalten.
Sitzungsdauer
Verstrichene Zeit zwischen der ersten und der letzten Nachricht der aktiven Claude-Sitzung, live aktualisiert. Nützlich, um Agenten zu erkennen, die stundenlang den Kontext verarbeiten.
Live-Agentenstatus
Inaktiv, arbeitend, fertig oder benötigt Eingabe. Der Status passt zum Token-Zähler, sodass Sie auf einen Blick sehen, welche Claude-Sitzung konsumiert und welche einfach nur dasteht.
Nachrichten und Assistenten-Drehungen
Anzahl der Benutzeraufforderungen im Vergleich zu den Assistenten-Drehungen in der aktiven Claude-Sitzung. Ein unausgewogenes Verhältnis ist ein starkes Signal dafür, dass ein Agent in einer Schleife feststeckt oder dass Ihre Eingabeaufforderung zu vage ist.
Tool-Nutzungen
Gesamtanzahl der von Claude in der Sitzung ausgeführten Lese-, Bearbeitungs-, Bash-, Grep-, Glob- und anderen Toolaufrufe. Toolaufrufe treiben einen großen Teil der Eingabetokens an, sodass diese Zahl die Claude Code Token-Nutzung genau verfolgt.
Verwendete Modelle
Jedes Claude-Modell, das eine Drehung in der Sitzung bearbeitet hat: Sonnet, Opus, Haiku, datierte Varianten. AgentsRoom entfernt Duplikate und verkürzt die Namen, sodass Sie sofort sehen, ob Ihre Sitzung automatisch über Modelle geroutet wurde.
Claude-Sitzungs-ID
Die interne Claude-Sitzungskennung, die mit einem Klick kopierbar ist. Verwenden Sie sie, um die gleiche Konversation von der CLI ohne Verlust des Kontexts fortzusetzen.
Eingabetokens
Frische Eingabetokens, die während der Sitzung an Claude gesendet werden, bevor Cache-Wiederverwendung erfolgt. Dies ist der teuerste Bereich Ihrer Claude Code Token-Nutzung.
Ausgabetokens
Tokens, die von Claude in der Sitzung generiert werden. Ausgabetokens werden zu einem höheren Satz als Eingabetokens berechnet, sodass hohe Werte ohne Fortschritt bedeuten, dass ein Agent feststeckt.
Cache-Schreibvorgänge
Tokens, die Claude während der Sitzung in den Eingabeaufforderungs-Cache schreibt. Cache-Schreibvorgänge werden zu einem kleinen Aufpreis berechnet, aber sie ermöglichen günstige Cache-Lesungen bei den nächsten Drehungen.
Cache-Lesungen
Tokens, die aus dem Eingabeaufforderungs-Cache bereitgestellt werden, anstatt als frische Eingabe neu berechnet zu werden. Cache-Lesungen kosten ungefähr 10x weniger als Eingabetokens, weshalb die Cache-Trefferquote die führende Kennzahl Ihrer Claude Code Token-Nutzung ist.
Cache-Trefferquote
Prozentsatz der Eingabetokens, die aus dem Cache bereitgestellt werden, farblich codiert: grün über 70 Prozent, bernsteinfarben zwischen 30 und 70, rot unter 30. Höher ist günstiger. Der beste Hebel für die Claude Code Token-Nutzung.
Gesamtanzahl der Tokens
Kumulative Summe aus Eingabe-, Ausgabe-, Cache-Schreibvorgängen und Cache-Lesungen für die aktive Sitzung. Nützlich als einzelne Überschrift, wenn Sie den Tokenverbrauch über Agenten hinweg vergleichen.
Warum der Token-Zähler rot wird
AgentsRoom überprüft Ihre Claude Code Token-Nutzung pro Sitzung bei jeder Abfrage. Wenn die laufende Gesamtsumme einen hohen Verbrauch überschreitet, wird das Abzeichen rot mit einem Warnsymbol. Das ist das Signal, den Sitzungsmonitor zu öffnen und zu entscheiden, was zu tun ist: komprimieren, einen neuen Agenten starten, Modell wechseln oder einfach die Aufgabe beenden und abschließen.
Rot ist kein harter Grenzwert. AgentsRoom drosselt Ihren Agenten nicht und unterbricht den Lauf nicht. Es ist ein visueller Hinweis, bei einem einzelnen Agenten, sodass eine unkontrollierte Schleife Ihr Anthropic-Budget nicht stillschweigend entleert, während Sie sich auf ein anderes Fenster konzentrieren. Lange Sitzungen mit gesunden Cache-Trefferquoten sind völlig in Ordnung und bleiben grün.
Wie AgentsRoom die Claude Code Token-Nutzung verfolgt
Drei Ebenen: ein Nutzungsabfrager, ein JSONL-Parser und eine Live-Benutzeroberfläche.
Abfrager liest Token-Gesamtwerte alle 15 Sekunden
Eine Hintergrundaufgabe liest die Token-Nutzung pro Sitzung aus Ihrem lokalen Claude-Zustand und schiebt sie in den Renderer-Speicher. Kein Proxy auf der API, kein zusätzlicher Netzwerkaufruf. Nur eine schnellere, sichtbare Ablesung der Zahlen, die Claude bereits auf die Festplatte schreibt.
JSONL-Parser aktualisiert sich alle 10 Sekunden, während das Modal geöffnet ist
Der Sitzungsmonitor fügt einen einmaligen IPC-Aufruf hinzu, der das JSONL-Transkript der aktiven Claude-Sitzung durchläuft, um die Nachrichtenanzahl, Assistenten-Drehungen, Tool-Nutzungen, geroutete Modelle und erste/letzte Zeitstempel zu berechnen. Die Aktualisierung erfolgt alle 10 Sekunden, während das Panel auf dem Bildschirm ist, sodass die Zahlen live bleiben, ohne den Parser bei jeder Renderer-Abfrage zu belasten.
Live-Benutzeroberfläche: Abzeichen plus Sitzungsmonitor
Das Abzeichen im Terminal-Composer liest die Token-Gesamtwerte und entscheidet, ob es grün oder rot ist. Klicken Sie darauf und der Sitzungsmonitor öffnet sich in einem Portal, sodass er das gesamte Fenster überlagert. Zahlen sind mit Tausendertrennzeichen formatiert, die Cache-Trefferquote ist farblich codiert, und ein Tipps-Bereich fordert Sie auf, weniger zu konsumieren.
Tipps zur Senkung Ihrer Claude Code Token-Nutzung
Der Sitzungsmonitor bietet diese Tipps kontextuell an, basierend auf Ihrer aktuellen Cache-Trefferquote. Senden Sie jeden von ihnen mit einem Klick direkt an das Agenten-Terminal.
Niedrige Cache-Trefferquote: stabilisieren Sie das Eingabeaufforderungs-Präfix
Unter 30 Prozent zahlt Claude bei jeder Drehung den vollen Eingabepreis. Das Bearbeiten von CLAUDE.md während der Sitzung, das Wechseln des Modells oder das Umstellen früherer Systemnachrichten zerstört den Cache. Sperren Sie den oberen Teil der Eingabeaufforderung und beobachten Sie, wie die Cache-Trefferquote steigt.
Verwenden Sie /compact anstelle von /clear
Slash clear löscht die Konversation und zwingt die volle Eingabepreisberechnung bei der nächsten Drehung. Slash compact behält die Aufgabe bei und komprimiert die Historie in eine Zusammenfassung, sodass das Cache-Präfix erhalten bleibt. Das gleiche frische Gefühl, aber viel geringere Claude Code Token-Nutzung.
Teilweise lesen, nicht ganz
Bei Dateien, die größer als 100 Zeilen sind, bitten Sie den Agenten, Read mit Offset und Limit zu verwenden oder zuerst nach dem Symbol zu suchen. Das Laden einer 4000-Zeilen-Datei bei jeder Drehung ist der stille Hauptverbraucher von Claude Code Tokens.
Bearbeiten statt Schreiben
Das Bearbeitungstool sendet nur die Differenz zurück an Claude. Schreiben überträgt die gesamte Datei erneut. Bei einer 600-Zeilen-Komponente verdoppelt das die Ausgabetokens und erhöht die Eingabe bei der nächsten Drehung.
Unteragenten für breite Suchen erstellen
Glob und Grep über Hunderte von Dateien bringen viel Lärm in Ihren Hauptkontext. Das Agenten-Tool läuft in seinem eigenen Kontextfenster und gibt nur eine Zusammenfassung zurück, wodurch die übergeordnete Eingabeaufforderung klein bleibt.
Verkleinern Sie Ihr CLAUDE.md
CLAUDE.md wird jeder Drehung vorangestellt. Jeder nutzlose Absatz dort kostet gecachte Eingabetokens multipliziert mit jeder Nachricht. Verschieben Sie langen Kontext in context/ und verweisen Sie bei Bedarf darauf.

Der Sitzungsmonitor liest Ihre Cache-Trefferquote live und schlägt fertige Korrekturen vor. Ein Klick auf Fix this sendet die Eingabeaufforderung direkt an den Agenten.
AgentsRoom Token-Zähler vs. Vanilla Claude Code
Vanilla Claude Code zeigt die Token-Gesamtwerte am Ende einer Sitzung in einer kleinen Fußzeile an, die Sie nach oben scrollen müssen, um sie zu finden. Es gibt keinen Live-Zähler. Keine Aufschlüsselung pro Sitzung. Keine Cache-Trefferquote auf einen Blick. Keine Warnung, wenn der Verbrauch ansteigt. Sie entdecken die Übernutzung erst im Nachhinein, wenn die API die Rate begrenzt oder die monatliche Rechnung zu hoch ist.
AgentsRoom verwandelt die Claude Code Token-Nutzung in ein erstklassiges Signal. Jeder Agent erhält seinen eigenen Token-Zähler. Rot bei Übernutzung. Klicken Sie für die vollständige Aufschlüsselung. Cache-Trefferquote in Echtzeit berechnet. Tipps, die Ihre aktuellen Zahlen lesen und fertige Eingabeaufforderungen vorschlagen, um das Leck zu beheben. Die gleiche Claude-Sitzung, die gleichen JSONL-Transkripte, aber mit der Sichtbarkeit, die eine Flotte paralleler Agenten tatsächlich benötigt.
Wann der Claude Code Token-Nutzungszähler Ihnen hilft
Drei reale Situationen, in denen der Token-Tracker pro Sitzung sich selbst bezahlt.
Ein Agent steckt in einer Schleife fest
Ein Agent liest immer wieder dieselbe Datei und versucht immer wieder dieselbe Lösung. Sein Token-Abzeichen wird innerhalb von Minuten rot, seine Cache-Trefferquote sinkt, sein Nachrichtenverhältnis ist unausgewogen. Sie erkennen es im Dashboard, springen ein, schreiben die Eingabeaufforderung um und sparen das Budget.
Eine lange Aufgabe läuft großartig
Drei Stunden in eine Umstrukturierung hinein fragen Sie sich, ob der Agent noch auf Kurs ist. Öffnen Sie den Sitzungsmonitor: 700 Nachrichten, 180 Tool-Nutzungen, 78 Prozent Cache-Trefferquote, alles grün. Der Tokenverbrauch ist absolut hoch, aber in der Effizienz normal. Lassen Sie es laufen.
Übernachtlauf auf einer Flotte
Fünf Agenten arbeiten sich durch einen Rückstand, während Sie schlafen. Am Morgen zeigt die Token-Nutzung pro Sitzung, welcher effizient war, welcher in einer Schleife feststeckte und welcher den Kontext verlor. Triage in zwei Minuten, anstatt jedes Transkript zu lesen.
Der Claude Code Token-Nutzungszähler ist ein Teil einer größeren Überwachungsoberfläche. Live-Agentenstatus, Dock-Abzeichen und mobile Push-Benachrichtigungen vervollständigen das Bild.
Sehen Sie, wie AgentsRoom KI-Agenten überwachtDie Zahl zu sehen, ist der erste Schritt. Unser vollständiger Leitfaden erklärt genau, wohin die Claude Code Tokens fließen und wie Sie die Rechnung senken können, ohne die Geschwindigkeit zu verringern: engerer Kontext, das richtige Modell, Delegation und mehr.
Lesen: Senken Sie Ihre Claude Code Token-KostenFAQ
Ist der Tracker für die Claude Code Token-Nutzung genau?
Ja. AgentsRoom liest die gleichen JSONL-Transkripte, die Claude selbst in ~/.claude/projects/ schreibt. Eingabetokens, Ausgabetokens, Cache-Schreibvorgänge und Cache-Lesungen werden direkt aus der Nutzungs-Payload pro Nachricht abgerufen, die Anthropic ausgibt. Es gibt keine Schätzung, keinen Proxy, keine Rundung. Die Zahlen im Sitzungsmonitor stimmen mit dem überein, was Anthropic berechnet.
Verlangsamt der Token-Zähler meinen Agenten?
Nein. Der Abfrager liest lokale Dateien alle 15 Sekunden. Der JSONL-Parser läuft nur, wenn der Sitzungsmonitor geöffnet ist, alle 10 Sekunden. Es gibt keinen zusätzlichen Netzwerkaufruf an Anthropic, keine Instrumentierung, die in Claude eingefügt wird, keine Überlastung bei Toolaufrufen. Ihr Agent läuft mit voller Geschwindigkeit.
Wann wird das Abzeichen rot?
Wenn die kumulierte Token-Nutzung pro Sitzung einen hohen Verbrauch überschreitet, der für normale Langzeit-Coding-Sitzungen abgestimmt ist. Der Grenzwert ist konservativ genug, dass eine inaktive Sitzung ihn nie auslöst, und eng genug, dass eine unkontrollierte Schleife innerhalb weniger Drehungen rot wird. Rot ist eine Warnung, kein Drosselung.
Warum ist die Cache-Trefferquote so wichtig?
Cache-Lesungen kosten ungefähr 10x weniger als frische Eingabetokens. Eine Sitzung mit 80 Prozent Cache-Trefferquote ist ungefähr fünfmal günstiger als dieselbe Sitzung mit 0 Prozent. Die Cache-Trefferquote ist der beste Hebel für Ihre Claude Code Token-Nutzung. AgentsRoom zeigt sie live an, sodass Sie den Kurs während der Sitzung korrigieren können, anstatt am Ende herauszufinden.
Unterstützt es auch Codex, Antigravity, OpenCode, Aider, Grok Build, Mistral Vibe und Kimi Code?
Der Sitzungsmonitor ist in seiner aktuellen Form Claude-spezifisch, da er die JSONL-Transkripte von Claude liest und die Aufschlüsselung des Eingabeaufforderungs-Caches eine Claude-spezifische Abrechnungsfunktion ist. Status, Rolle und Benachrichtigungen funktionieren für jeden Anbieter. Wir verfolgen anbieterunabhängige Nutzungen im Fahrplan.
Sendet AgentsRoom meine Claude Code Token-Nutzung an einen Server?
Nein. Der Token-Zähler, der Sitzungsmonitor und die Cache-Trefferquote werden vollständig auf Ihrem Mac aus lokalen Dateien berechnet. Nichts verlässt Ihren Computer. Wenn Sie die optionale verschlüsselte Synchronisierung mit dem mobilen Begleiter aktivieren, werden nur die Daten, die Sie ausdrücklich auswählen, gespiegelt, und sie sind Ende-zu-Ende-verschlüsselt über das AgentsRoom-Relay.
Kann ich die Tipps als wiederverwendbare Eingabeaufforderungen speichern?
Ja. Jeder Tipp im Sitzungsmonitor hat eine Schaltfläche 'Fix this', die eine bearbeitbare, vorgefertigte Eingabeaufforderung öffnet. Senden Sie sie direkt an das Agenten-Terminal, kopieren Sie sie in die Zwischenablage oder speichern Sie sie in Ihrer globalen Eingabeaufforderungsbibliothek, sodass die gleiche Lösung mit einem Klick in jedem Projekt verfügbar ist.
Hören Sie auf, Ihre Claude Code Token-Nutzung zu schätzen
Laden Sie AgentsRoom herunter und erhalten Sie einen Live-Token-Zähler pro Sitzung für jeden Claude-Agenten. Rot bei Übernutzung, Cache-Trefferquote auf einen Blick, Tipps zur Senkung des Verbrauchs. Alles lokal, alles Ihr.
Companion-App: Agenten auch unterwegs im Blick behalten
Nutzen Sie Claude, Codex, Antigravity CLI oder einen anderen AI-Anbieter.
Bugs und Wünsche direkt in dein öffentliches Backlog schicken.
Ein Blick auf AgentsRoom in Aktion.