Token-Nutzung: pro Sitzung: live

Claude Code Token-Nutzung,
pro Sitzung in Echtzeit verfolgt

AgentsRoom überwacht Ihre Claude Code Token-Nutzung in jedem Agenten-Terminal. Ein kleiner Token-Zähler befindet sich im Composer und wird live aktualisiert. Wenn Ihr Tokenverbrauch in einer einzelnen Claude-Sitzung hoch wird, wird das Badge rot und warnt Sie, bevor Sie das Kontextfenster sprengen.

Klicken Sie auf das Badge und der Sitzungsmonitor öffnet sich: Eingabetokens, Ausgabetokens, Cache-Lesungen, Cache-Schreibvorgänge, Cache-Trefferquote, Nachrichtenanzahl, geroutete Modelle, Sitzungsdauer und Tool-Nutzungen. Ein Panel, eine Claude-Sitzung, alle Zahlen, die Ihren Claude Code Tokenverbrauch antreiben.

Kostenlos · macOS · 100 % lokal, kein Proxy

Live-Demo des Badges für die Claude Code Token-Nutzung in AgentsRoom: Es sitzt in jedem Agenten-Composer, wird bei hohem Tokenverbrauch rot und öffnet einen vollständigen Sitzungsmonitor mit Eingabetokens, Ausgabetokens, Cache-Lesungen und Cache-Schreibvorgängen.

Die Claude Code Token-Nutzung ist die Nummer eins der variablen Kosten für den Betrieb von KI-Coding-Agenten. Jeder Prompt, jeder Toolaufruf, jede CLAUDE.md-Reinjektion verbraucht Tokens. Ohne Sichtbarkeit stellen Sie fest, dass Sie Ihr Budget überschritten haben, wenn die API drosselt oder die Rechnung eintrifft. AgentsRoom platziert einen Live-Token-Zähler für die Claude Code Token-Nutzung in jeder Agentensitzung, sodass Sie den Verbrauch in Echtzeit sehen können, nicht danach.

Der Token-Zähler befindet sich im Terminal-Composer, direkt neben der Senden-Schaltfläche. Er wird ein paar Sekunden nach jeder Claude-Runde aktualisiert. Tokens summieren sich über die gesamte Sitzung: Eingabetokens, Ausgabetokens, Cache-Schreibvorgänge und Cache-Lesungen, alle summiert und farblich codiert, sodass Sie sie auf einen Blick lesen können. Wenn die Token-Nutzung pro Sitzung einen hohen Verbrauch überschreitet, wird das Badge rot und zeigt ein Warnsymbol, so wie eine Tankanzeige Sie warnt, bevor der Tank leer ist.

Klicken Sie darauf und der Sitzungsmonitor öffnet sich. Sie erhalten einen Live-Snapshot der aktiven Claude-Sitzung: Dauer seit der ersten Nachricht, Anzahl der Nutzer-Prompts im Vergleich zu den Assistenten-Runden, Tool-Nutzungen, Modelle, die das Gespräch geführt haben, die Claude-Sitzungs-ID (kopierbar für --resume) und die vollständige Token-Aufschlüsselung. Die Cache-Trefferquote wird in Echtzeit berechnet, farblich codiert in grün/bernstein/rot, mit einer einzeiligen Erinnerung, dass Cache-Lesungen ungefähr zehnmal weniger kosten als frische Eingaben. Dieses einzelne Panel verwandelt die Claude Code Token-Nutzung von einer Black Box in ein Echtzeit-Messgerät.

Nahaufnahme des Agenten-Composers in AgentsRoom mit dem rot gewordenen Badge der Claude Code Token-Nutzung, das bei 58 Millionen Tokens vor hohem Verbrauch warnt

Das Token-Badge sitzt direkt neben der Senden-Schaltfläche und wird rot, sobald der Verbrauch einer Sitzung stark ansteigt.

Warum die Token-Nutzung pro Sitzung wichtig ist

Die meisten Claude-Wrapper berichten über die Token-Nutzung auf Kontoebene, einmal täglich, in einem Dashboard, das Sie sich merken müssen zu öffnen. Bis dahin ist der Schaden bereits angerichtet. AgentsRoom bringt die Claude Code Token-Nutzung an die Oberfläche, in jedem einzelnen Agenten-Terminal, sodass Sie sie nicht ignorieren können. Der Token-Zähler ist zwei Zentimeter von der Senden-Schaltfläche entfernt. Sie werfen einen Blick darauf, so wie Sie auf das Ungelesen-Badge auf Ihrem Telefon schauen.

Pro Sitzung ist die richtige Granularität. Ein Team von Agenten, das parallel arbeitet, sagt Ihnen nicht, wer Tokens verbraucht. Ein Agent dreht sich vielleicht an einem festgefahrenen Prompt im Kreis, während vier andere still sind. Mit einem Token-Zähler für die Claude Code-Nutzung pro Sitzung sticht der laute Agent sofort hervor: sein Badge ist rot, seine Cache-Trefferquote ist niedrig, seine Nachrichtenanzahl steigt schnell. Sie springen ein, korrigieren den Prompt und sparen das Budget.

Die gesamte Funktion ist lokal. AgentsRoom liest Ihre Claude Code Token-Nutzung direkt aus den JSONL-Transkripten, die Claude in ~/.claude/projects/ schreibt. Nichts verlässt Ihren Computer. Kein Usage-Tracker eines Drittanbieters. Kein Proxy vor der API. Der Token-Zähler in AgentsRoom ist lediglich eine schnellere, sichtbarere Ablesung der Daten, die Anthropic bereits auf Ihrer Festplatte speichert.

Modal zur Claude Code Token-Nutzung in AgentsRoom: Dauer, Status, Nachrichtenanzahl, Tool-Nutzungen, Modelle, Sitzungs-ID sowie Token-Aufschlüsselung mit Eingabe, Ausgabe, Cache-Schreibvorgängen, Cache-Lesungen und Cache-Trefferquote

Das Panel zur Claude Code Token-Nutzung in AgentsRoom. Klicken Sie in jedem Agenten-Composer auf das Token-Badge der Sitzung und erhalten Sie jede wichtige Zahl sowie Tipps zur Senkung Ihres Tokenverbrauchs.

Was das Panel zur Claude Code Token-Nutzung zeigt

Ein Klick auf das Token-Badge öffnet einen Live-Sitzungsmonitor. Hier sind alle Zahlen, die Sie in der aktiven Claude-Sitzung erhalten.

Sitzungsdauer

Verstrichene Zeit zwischen der ersten und der letzten Nachricht der aktiven Claude-Sitzung, live aktualisiert. Nützlich, um Agenten zu erkennen, die stundenlang den Kontext verarbeiten.

Live-Agentenstatus

Inaktiv, arbeitend, fertig oder benötigt Eingabe. Der Status passt zum Token-Zähler, sodass Sie auf einen Blick sehen, welche Claude-Sitzung konsumiert und welche einfach nur dasteht.

Nachrichten und Assistenten-Runden

Anzahl der Nutzer-Prompts im Vergleich zu den Assistenten-Runden in der aktiven Claude-Sitzung. Ein unausgewogenes Verhältnis ist ein starkes Signal dafür, dass ein Agent in einer Schleife feststeckt oder dass Ihr Prompt zu vage ist.

Tool-Nutzungen

Gesamtanzahl der von Claude in der Sitzung ausgeführten Lese-, Bearbeitungs-, Bash-, Grep-, Glob- und anderen Toolaufrufe. Toolaufrufe treiben einen großen Teil der Eingabetokens an, sodass diese Zahl die Claude Code Token-Nutzung genau verfolgt.

Verwendete Modelle

Jedes Claude-Modell, das eine Runde in der Sitzung bearbeitet hat: Sonnet, Opus, Haiku, datierte Varianten. AgentsRoom entfernt Duplikate und verkürzt die Namen, sodass Sie sofort sehen, ob Ihre Sitzung automatisch über Modelle geroutet wurde.

Claude-Sitzungs-ID

Die interne Claude-Sitzungskennung, die mit einem Klick kopierbar ist. Verwenden Sie sie, um die gleiche Konversation von der CLI ohne Verlust des Kontexts fortzusetzen.

Eingabetokens

Frische Eingabetokens, die während der Sitzung an Claude gesendet werden, bevor Cache-Wiederverwendung erfolgt. Dies ist der teuerste Bereich Ihrer Claude Code Token-Nutzung.

Ausgabetokens

Tokens, die von Claude in der Sitzung generiert werden. Ausgabetokens werden zu einem höheren Satz als Eingabetokens berechnet, sodass hohe Werte ohne Fortschritt bedeuten, dass ein Agent feststeckt.

Cache-Schreibvorgänge

Tokens, die Claude während der Sitzung in den Prompt-Cache schreibt. Cache-Schreibvorgänge werden zu einem kleinen Aufpreis berechnet, aber sie ermöglichen günstige Cache-Lesungen in den nächsten Runden.

Cache-Lesungen

Tokens, die aus dem Prompt-Cache bereitgestellt werden, anstatt als frische Eingabe neu berechnet zu werden. Cache-Lesungen kosten ungefähr 10x weniger als Eingabetokens, weshalb die Cache-Trefferquote die führende Kennzahl Ihrer Claude Code Token-Nutzung ist.

Cache-Trefferquote

Prozentsatz der Eingabetokens, die aus dem Cache bereitgestellt werden, farblich codiert: grün über 70 Prozent, bernsteinfarben zwischen 30 und 70, rot unter 30. Höher ist günstiger. Der beste Hebel für die Claude Code Token-Nutzung.

Gesamtanzahl der Tokens

Kumulative Summe aus Eingabe-, Ausgabe-, Cache-Schreibvorgängen und Cache-Lesungen für die aktive Sitzung. Nützlich als einzelne Überschrift, wenn Sie den Tokenverbrauch über Agenten hinweg vergleichen.

Welches Projekt und welcher Agent Ihr Abonnement verbrauchen

Ihr Anbieter veröffentlicht eine einzige Zahl: wie viel vom aktuellen Fenster Ihr Konto verbraucht hat. Wohin es geflossen ist, sagt er nie. AgentsRoom teilt diesen Prozentsatz auf Ihre Projekte und Ihre Agenten auf und gewichtet jede Sitzung danach, was sie zu API-Tarifen kosten würde, sodass die Anteile in der Summe immer wieder den Wert ergeben, den der Anbieter meldet.

Sie lesen es im selben Popover wie die Anzeige: Dieses Projekt hat etwa 8 % des aktuellen Sitzungsfensters und 2 % der laufenden Woche beansprucht, dieser Agent etwa 0,6 % der Sitzung. Es ist eine Schätzung, keine Rechnung. Arbeit von einem anderen Rechner oder aus dem Web wird hier nicht gemessen, und in einem Abonnement ist der Dollarwert nur das Gewicht, mit dem das Abonnement aufgeteilt wird.

AgentsRoom Nutzungsaufschlüsselung nach Projekt und Agent: das Projekt AgentsRoom bei etwa 8 % des aktuellen Sitzungsfensters und 2 % der laufenden Woche, und ein Agent bei etwa 0,6 % der Sitzung, jeweils mit den geschätzten Kosten in Dollar
Das Nutzungs-Popover verteilt den Prozentsatz, den Ihr Anbieter veröffentlicht, auf Ihre Projekte und Ihre Agenten, damit eine schwere Sitzung nicht mehr anonym bleibt.

Warum der Token-Zähler rot wird

AgentsRoom überprüft Ihre Claude Code Token-Nutzung pro Sitzung bei jeder Abfrage. Wenn die laufende Gesamtsumme einen hohen Verbrauch überschreitet, wird das Badge rot und zeigt ein Warnsymbol. Das ist das Signal, den Sitzungsmonitor zu öffnen und zu entscheiden, was zu tun ist: komprimieren, einen neuen Agenten starten, Modell wechseln oder einfach die Aufgabe beenden und abschließen.

Rot ist kein harter Grenzwert. AgentsRoom drosselt Ihren Agenten nicht und unterbricht den Lauf nicht. Es ist ein visueller Hinweis, bei einem einzelnen Agenten, sodass eine unkontrollierte Schleife Ihr Anthropic-Budget nicht stillschweigend entleert, während Sie sich auf ein anderes Fenster konzentrieren. Lange Sitzungen mit gesunden Cache-Trefferquoten sind völlig in Ordnung und bleiben grün.

Wie AgentsRoom die Claude Code Token-Nutzung verfolgt

Drei Ebenen: ein Nutzungsabfrager, ein JSONL-Parser und eine Live-Benutzeroberfläche.

01

Abfrager liest Token-Gesamtwerte alle 15 Sekunden

Eine Hintergrundaufgabe liest die Token-Nutzung pro Sitzung aus Ihrem lokalen Claude-Zustand und schiebt sie in den Renderer-Speicher. Kein Proxy auf der API, kein zusätzlicher Netzwerkaufruf. Nur eine schnellere, sichtbare Ablesung der Zahlen, die Claude bereits auf die Festplatte schreibt.

02

JSONL-Parser aktualisiert sich alle 10 Sekunden, während das Modal geöffnet ist

Der Sitzungsmonitor fügt einen einmaligen IPC-Aufruf hinzu, der das JSONL-Transkript der aktiven Claude-Sitzung durchläuft, um die Nachrichtenanzahl, Assistenten-Runden, Tool-Nutzungen, geroutete Modelle und erste/letzte Zeitstempel zu berechnen. Die Aktualisierung erfolgt alle 10 Sekunden, während das Panel auf dem Bildschirm ist, sodass die Zahlen live bleiben, ohne den Parser bei jeder Renderer-Abfrage zu belasten.

03

Live-Benutzeroberfläche: Badge plus Sitzungsmonitor

Das Badge im Terminal-Composer liest die Token-Gesamtwerte und entscheidet, ob es grün oder rot ist. Klicken Sie darauf und der Sitzungsmonitor öffnet sich in einem Portal, sodass er das gesamte Fenster überlagert. Zahlen sind mit Tausendertrennzeichen formatiert, die Cache-Trefferquote ist farblich codiert, und ein Tipps-Bereich fordert Sie auf, weniger zu konsumieren.

Tipps zur Senkung Ihrer Claude Code Token-Nutzung

Der Sitzungsmonitor bietet diese Tipps kontextuell an, basierend auf Ihrer aktuellen Cache-Trefferquote. Senden Sie jeden von ihnen mit einem Klick direkt an das Agenten-Terminal.

Niedrige Cache-Trefferquote: stabilisieren Sie das Prompt-Präfix

Unter 30 Prozent zahlt Claude in jeder Runde den vollen Eingabepreis. Das Bearbeiten von CLAUDE.md während der Sitzung, das Wechseln des Modells oder das Umstellen früherer Systemnachrichten zerstört den Cache. Halten Sie den Anfang des Prompts unverändert und beobachten Sie, wie die Cache-Trefferquote steigt.

Verwenden Sie /compact anstelle von /clear

Slash clear löscht die Konversation und zwingt die volle Eingabepreisberechnung in der nächsten Runde. Slash compact behält die Aufgabe bei und komprimiert die Historie in eine Zusammenfassung, sodass das Cache-Präfix erhalten bleibt. Das gleiche frische Gefühl, aber viel geringere Claude Code Token-Nutzung.

Teilweise lesen, nicht ganz

Bei Dateien, die größer als 100 Zeilen sind, bitten Sie den Agenten, Read mit Offset und Limit zu verwenden oder zuerst nach dem Symbol zu suchen. Das Laden einer 4000-Zeilen-Datei in jeder Runde ist der stille Hauptverbraucher von Claude Code Tokens.

Bearbeiten statt Schreiben

Das Bearbeitungstool sendet nur die Differenz zurück an Claude. Schreiben überträgt die gesamte Datei erneut. Bei einer 600-Zeilen-Komponente verdoppelt das die Ausgabetokens und erhöht die Eingabe in der nächsten Runde.

Subagents für breite Suchen starten

Glob und Grep über Hunderte von Dateien bringen viel Rauschen in Ihren Hauptkontext. Das Agenten-Tool läuft in seinem eigenen Kontextfenster und gibt nur eine Zusammenfassung zurück, wodurch der übergeordnete Prompt klein bleibt.

Verkleinern Sie Ihr CLAUDE.md

CLAUDE.md wird jeder Runde vorangestellt. Jeder nutzlose Absatz dort kostet gecachte Eingabetokens multipliziert mit jeder Nachricht. Verschieben Sie langen Kontext in context/ und verweisen Sie bei Bedarf darauf.

AgentsRoom Sitzungsmonitor mit Statistiken zur Tool-Nutzung, gelesenen Dateien und kontextbezogenen Tipps zur Senkung der Claude Code Token-Nutzung, jeweils mit einer Ein-Klick-Schaltfläche Fix this

Der Sitzungsmonitor liest Ihre Cache-Trefferquote live und schlägt fertige Korrekturen vor. Ein Klick auf Fix this sendet den Prompt direkt an den Agenten.

AgentsRoom Token-Zähler vs. Vanilla Claude Code

Vanilla Claude Code zeigt die Token-Gesamtwerte am Ende einer Sitzung in einer kleinen Fußzeile an, die Sie nach oben scrollen müssen, um sie zu finden. Es gibt keinen Live-Zähler. Keine Aufschlüsselung pro Sitzung. Keine Cache-Trefferquote auf einen Blick. Keine Warnung, wenn der Verbrauch ansteigt. Sie entdecken die Übernutzung erst im Nachhinein, wenn die API die Rate begrenzt oder die monatliche Rechnung zu hoch ist.

AgentsRoom verwandelt die Claude Code Token-Nutzung in ein erstklassiges Signal. Jeder Agent erhält seinen eigenen Token-Zähler. Rot bei Übernutzung. Klicken Sie für die vollständige Aufschlüsselung. Cache-Trefferquote in Echtzeit berechnet. Tipps, die Ihre aktuellen Zahlen lesen und fertige Prompts vorschlagen, um das Leck zu stopfen. Die gleiche Claude-Sitzung, die gleichen JSONL-Transkripte, aber mit der Sichtbarkeit, die eine Flotte paralleler Agenten tatsächlich benötigt.

Wann der Claude Code Token-Nutzungszähler Ihnen hilft

Drei reale Situationen, in denen der Token-Tracker pro Sitzung sich selbst bezahlt.

Ein Agent steckt in einer Schleife fest

Ein Agent liest immer wieder dieselbe Datei und versucht immer wieder dieselbe Lösung. Sein Token-Badge wird innerhalb von Minuten rot, seine Cache-Trefferquote sinkt, sein Nachrichtenverhältnis ist unausgewogen. Sie erkennen es im Dashboard, springen ein, schreiben den Prompt um und sparen das Budget.

Eine lange Aufgabe läuft großartig

Drei Stunden in eine Umstrukturierung hinein fragen Sie sich, ob der Agent noch auf Kurs ist. Öffnen Sie den Sitzungsmonitor: 700 Nachrichten, 180 Tool-Nutzungen, 78 Prozent Cache-Trefferquote, alles grün. Der Tokenverbrauch ist absolut hoch, aber in der Effizienz normal. Lassen Sie es laufen.

Übernachtlauf auf einer Flotte

Fünf Agenten arbeiten sich durch das Backlog, während Sie schlafen. Am Morgen zeigt die Token-Nutzung pro Sitzung, welcher effizient war, welcher in einer Schleife feststeckte und welcher den Kontext verlor. Triage in zwei Minuten, anstatt jedes Transkript zu lesen.

Der Claude Code Token-Nutzungszähler ist ein Teil einer größeren Überwachungsoberfläche. Live-Agentenstatus, Dock-Badges und mobile Push-Benachrichtigungen vervollständigen das Bild.

Sehen Sie, wie AgentsRoom KI-Agenten überwacht

Die Zahl zu sehen, ist der erste Schritt. Unser vollständiger Leitfaden erklärt genau, wohin die Claude Code Tokens fließen und wie Sie die Rechnung senken können, ohne die Geschwindigkeit zu verringern: engerer Kontext, das richtige Modell, Delegation und mehr.

Lesen: Senken Sie Ihre Claude Code Token-Kosten

FAQ

Ist der Tracker für die Claude Code Token-Nutzung genau?

Ja. AgentsRoom liest die gleichen JSONL-Transkripte, die Claude selbst in ~/.claude/projects/ schreibt. Eingabetokens, Ausgabetokens, Cache-Schreibvorgänge und Cache-Lesungen werden direkt aus der Nutzungs-Payload pro Nachricht abgerufen, die Anthropic ausgibt. Es gibt keine Schätzung, keinen Proxy, keine Rundung. Die Zahlen im Sitzungsmonitor stimmen mit dem überein, was Anthropic berechnet.

Verlangsamt der Token-Zähler meinen Agenten?

Nein. Der Abfrager liest lokale Dateien alle 15 Sekunden. Der JSONL-Parser läuft nur, wenn der Sitzungsmonitor geöffnet ist, alle 10 Sekunden. Es gibt keinen zusätzlichen Netzwerkaufruf an Anthropic, keine Instrumentierung, die in Claude eingefügt wird, keine Überlastung bei Toolaufrufen. Ihr Agent läuft mit voller Geschwindigkeit.

Wann wird das Badge rot?

Wenn die kumulierte Token-Nutzung pro Sitzung einen hohen Verbrauch überschreitet, der für normale Langzeit-Coding-Sitzungen abgestimmt ist. Der Grenzwert ist konservativ genug, dass eine inaktive Sitzung ihn nie auslöst, und eng genug, dass eine unkontrollierte Schleife innerhalb weniger Runden rot wird. Rot ist eine Warnung, keine Drosselung.

Warum ist die Cache-Trefferquote so wichtig?

Cache-Lesungen kosten ungefähr 10x weniger als frische Eingabetokens. Eine Sitzung mit 80 Prozent Cache-Trefferquote ist ungefähr fünfmal günstiger als dieselbe Sitzung mit 0 Prozent. Die Cache-Trefferquote ist der beste Hebel für Ihre Claude Code Token-Nutzung. AgentsRoom zeigt sie live an, sodass Sie den Kurs während der Sitzung korrigieren können, anstatt am Ende herauszufinden.

Unterstützt es auch Codex, GitHub Copilot CLI, Cursor und die übrigen Agent-CLIs?

Der Sitzungsmonitor ist in seiner aktuellen Form Claude-spezifisch, da er die JSONL-Transkripte von Claude liest und die Aufschlüsselung des Prompt-Caches eine Claude-spezifische Abrechnungsfunktion ist. Status, Rolle und Benachrichtigungen funktionieren für jeden Anbieter. Anbieterunabhängige Nutzungsdaten stehen auf unserer Roadmap.

Sendet AgentsRoom meine Claude Code Token-Nutzung an einen Server?

Nein. Der Token-Zähler, der Sitzungsmonitor und die Cache-Trefferquote werden vollständig auf Ihrem eigenen Rechner aus lokalen Dateien berechnet. Nichts verlässt Ihren Computer. Wenn Sie die optionale verschlüsselte Synchronisierung mit dem mobilen Begleiter aktivieren, werden nur die Daten, die Sie ausdrücklich auswählen, gespiegelt, und sie sind Ende-zu-Ende-verschlüsselt über das AgentsRoom-Relay.

Kann ich die Tipps als wiederverwendbare Prompts speichern?

Ja. Jeder Tipp im Sitzungsmonitor hat eine Schaltfläche 'Fix this', die einen bearbeitbaren, vorgefertigten Prompt öffnet. Senden Sie ihn direkt an das Agenten-Terminal, kopieren Sie ihn in die Zwischenablage oder speichern Sie ihn in Ihrer globalen Prompt-Bibliothek, sodass die gleiche Lösung mit einem Klick in jedem Projekt verfügbar ist.

Wie überprüfe ich die Nutzung meines Claude Code Tokens?

Claude Code selbst bietet Ihnen zwei integrierte Funktionen: /cost zeigt die Ausgaben der aktuellen Sitzung an, und /context zeigt, wie viel des Kontextfensters derzeit gefüllt ist. Keines von beidem ist live, und keines übersteht einen Neustart. Claude schreibt auch jede Nachricht in ein JSONL-Transkript in ~/.claude/projects/, mit der genauen Eingabe, Ausgabe, Cache-Schreib- und Cache-Leseanzahl, für die Anthropic Ihnen Gebühren berechnet. AgentsRoom liest dieselben Dateien und zeigt die laufende Gesamtsumme in jeder Sitzung an, die alle 15 Sekunden aktualisiert wird, sodass Sie sehen, wie die Zahl steigt, während der Agent arbeitet, anstatt danach zu fragen.

Wie funktionieren die Claude Code Tokens tatsächlich?

Jeder Austausch wird auf vier separaten Zählern abgerechnet, nicht auf einem. Eingabetokens sind das, was Sie senden: der Prompt, gelesene Dateien, Toolergebnisse und das gesamte Gespräch bis jetzt, das bei jedem Schritt erneut gesendet wird. Ausgabetokens sind das, was Claude zurückschreibt. Cache-Schreibvorgänge speichern einen Teil dieses Kontexts, sodass der nächste Schritt nicht den vollen Preis dafür zahlt. Cache-Lesevorgänge spielen es mit etwa einem Zehntel des Eingabepreises ab. Das ist der Grund, warum eine lange Sitzung teuer wird: Das Gespräch wird bei jedem Schritt vollständig erneut gesendet, sodass die Eingabetokens mit jeder Nachricht wachsen, es sei denn, der Cache absorbiert sie.

Wie weiß ich, wie viele Tokens ich noch habe?

Bei einem Claude Pro- oder Max-Abonnement gibt es kein Token-Guthaben zu lesen: Anthropic berechnet Ihnen die Nutzung in rollierenden Zeitfenstern, und die CLI informiert Sie nur, wenn Sie das Limit erreichen. Was Sie verfolgen können, ist der Verbrauch, und das ist die Zahl, die das Limit vorhersagt. AgentsRoom führt eine Gesamtsumme pro Sitzung für jeden laufenden Agenten und färbt das Badge rot, wenn eine Sitzung einen Schwellenwert für hohen Verbrauch überschreitet, was das Signal ist, dass eine Sitzung Ihr Zeitfenster schneller als gewöhnlich aufbraucht, lange bevor Claude Code aufhört zu antworten.

Mehr zum Thema

Hören Sie auf, Ihre Claude Code Token-Nutzung zu schätzen

Laden Sie AgentsRoom herunter und erhalten Sie einen Live-Token-Zähler pro Sitzung für jeden Claude-Agenten. Rot bei Übernutzung, Cache-Trefferquote auf einen Blick, Tipps zur Senkung des Verbrauchs. Alles lokal, alles Ihr.

KostenlosAgentsRoom herunterladen

Companion-App: Agenten auch unterwegs im Blick behalten

Nutzen Sie Claude, Codex, Antigravity CLI oder einen anderen KI-Anbieter.

Erweiterung installieren
Chrome Web Store

Bugs und Wünsche direkt in dein öffentliches Backlog schicken.

Ein Blick auf AgentsRoom in Aktion.

Multi-Projekte
Multi-Provider
Multi-Agenten
Live-Status
Diff & Commit
Mobile App
Live-Vorschau
Agent-Teams
Browser-Tests
Backlog-getriebene Entwicklung
Prompt-Bibliothek
Skills-Bibliothek
Alle Funktionen ansehen