Utilisation des tokens Claude Code,
suivie par session, en temps réel
AgentsRoom surveille votre utilisation des tokens Claude Code dans chaque terminal d'agent. Un petit compteur de tokens se trouve dans le compositeur et se met à jour en direct. Lorsque votre consommation de tokens devient élevée sur une seule session Claude, le badge devient rouge et vous avertit avant que vous ne dépassiez la fenêtre de contexte.
Cliquez sur le badge et le moniteur de session s'ouvre : tokens d'entrée, tokens de sortie, lectures de cache, écritures de cache, taux de réussite du cache, nombre de messages, modèles routés, durée de session et utilisations d'outils. Un panneau, une session Claude, tous les chiffres qui déterminent votre utilisation des tokens Claude Code.
Gratuit · macOS · 100 % local, sans proxy
Démonstration en direct du badge d'utilisation des tokens Claude Code dans AgentsRoom : il se trouve dans chaque compositeur d'agent, devient rouge en cas de forte consommation de tokens, et ouvre un moniteur de session complet avec les tokens d'entrée, les tokens de sortie, les lectures de cache et les écritures de cache.
L'utilisation des tokens Claude Code est le coût variable numéro un de l'exécution des agents de codage AI. Chaque prompt, chaque appel d'outil, chaque réinjection de CLAUDE.md consomme des tokens. Sans visibilité, vous découvrez que vous avez dépassé votre budget lorsque l'API limite ou que la facture arrive. AgentsRoom met un compteur d'utilisation des tokens Claude Code en direct sur chaque session d'agent afin que vous puissiez voir la consommation au fur et à mesure, et non après.
Le compteur de tokens se trouve dans le compositeur de terminal, juste à côté du bouton d'envoi. Il se met à jour quelques secondes après chaque tour de Claude. Les tokens s'accumulent sur toute la session : tokens d'entrée, tokens de sortie, écritures de cache et lectures de cache, tous additionnés et codés par couleur afin que vous puissiez les lire d'un coup d'œil. Lorsque l'utilisation des tokens Claude Code par session dépasse un seuil de forte consommation, le badge devient rouge avec une icône d'avertissement, de la même manière qu'un indicateur de carburant vous avertit avant que le réservoir ne soit vide.
Cliquez dessus et le moniteur de session s'ouvre. Vous obtenez un instantané en direct de la session Claude active : durée depuis le premier message, nombre de prompts utilisateur par rapport aux tours d'assistant, utilisations d'outils, modèles qui ont géré la conversation, l'identifiant de session Claude (copiable pour --resume), et la répartition complète des tokens. Le taux de réussite du cache est calculé à la volée, codé par couleur en vert / ambre / rouge, avec un rappel en une ligne que les lectures de cache coûtent environ dix fois moins que les entrées fraîches. Ce panneau unique transforme l'utilisation des tokens Claude Code d'une boîte noire en un indicateur en temps réel.

Le badge de tokens vit à côté du bouton envoyer et passe au rouge quand la consommation d'une session devient lourde.
Pourquoi l'utilisation des tokens Claude Code par session est importante
La plupart des wrappers Claude rapportent l'utilisation des tokens au niveau du compte, une fois par jour, dans un tableau de bord que vous devez vous rappeler d'ouvrir. D'ici là, les dégâts sont faits. AgentsRoom pousse l'utilisation des tokens Claude Code à la surface, sur chaque terminal d'agent, afin que vous ne puissiez pas l'ignorer. Le compteur de tokens est à deux centimètres du bouton d'envoi. Vous y jetez un coup d'œil comme vous jetez un coup d'œil à l'indicateur de messages non lus sur votre téléphone.
Par session est la bonne granularité. Une équipe d'agents fonctionnant en parallèle ne vous dit pas qui consomme des tokens. Un agent peut être bloqué sur un prompt coincé tandis que quatre autres sont silencieux. Avec un compteur d'utilisation des tokens Claude Code par session, l'agent bruyant se distingue instantanément : son badge est rouge, son taux de réussite du cache est bas, son nombre de messages augmente rapidement. Vous intervenez, corrigez le prompt, économisez le budget.
Toute la fonctionnalité est locale. AgentsRoom lit votre utilisation des tokens Claude Code directement à partir des transcriptions JSONL que Claude écrit dans ~/.claude/projects/. Rien ne quitte votre machine. Aucun tracker d'utilisation tiers. Aucun proxy devant l'API. Le compteur de tokens dans AgentsRoom est juste une lecture plus rapide et plus visible des données qu'Anthropic enregistre déjà sur votre disque.

Le panneau d'utilisation des tokens Claude Code dans AgentsRoom. Cliquez sur le badge de tokens par session dans n'importe quel compositeur d'agent, obtenez chaque chiffre qui compte, plus des conseils pour réduire votre consommation de tokens.
Ce que le panneau d'utilisation des tokens Claude Code montre
Un clic sur le badge de tokens ouvre un moniteur de session en direct. Voici chaque chiffre que vous obtenez sur la session Claude active.
Durée de la session
Temps écoulé entre le premier et le dernier message de la session Claude active, actualisé en direct. Utile pour repérer les agents qui ont mâché le contexte pendant des heures.
Statut de l'agent en direct
Inactif, en cours, terminé, ou nécessite une entrée. Le statut s'associe au compteur de tokens afin que vous puissiez voir d'un coup d'œil quelle session Claude consomme et laquelle est juste là.
Messages et tours d'assistant
Nombre de prompts utilisateur par rapport aux tours d'assistant dans la session Claude active. Un ratio déséquilibré est un signal fort qu'un agent est bloqué ou que votre prompt est trop vague.
Utilisations d'outils
Nombre total de lectures, d'éditions, de bash, de grep, de glob et d'autres appels d'outils exécutés par Claude dans la session. Les appels d'outils représentent une grande part des tokens d'entrée, donc ce chiffre suit de près l'utilisation des tokens Claude Code.
Modèles utilisés
Chaque modèle Claude qui a géré un tour dans la session : Sonnet, Opus, Haiku, variantes datées. AgentsRoom déduplique et raccourcit les noms afin que vous puissiez immédiatement voir si votre session a été auto-routée à travers les modèles.
Identifiant de session Claude
L'identifiant de session interne de Claude, copiable en un clic. Utilisez-le pour claude --resume la même conversation exacte depuis le CLI sans perdre le contexte.
Tokens d'entrée
Tokens d'entrée frais envoyés à Claude pendant la session, avant toute réutilisation de cache. C'est le compartiment le plus coûteux de votre utilisation des tokens Claude Code.
Tokens de sortie
Tokens générés par Claude dans la session. Les tokens de sortie sont facturés à un taux plus élevé que les entrées, donc des valeurs élevées sans progrès signifient qu'un agent est en boucle.
Écritures de cache
Tokens que Claude écrit dans le cache de prompt pendant la session. Les écritures de cache sont facturées à un petit supplément mais elles débloquent des lectures de cache bon marché lors des tours suivants.
Lectures de cache
Tokens servis à partir du cache de prompt au lieu d'être re-prix comme entrée fraîche. Les lectures de cache coûtent environ 10 fois moins que les tokens d'entrée, c'est pourquoi le taux de réussite du cache est la principale métrique de votre utilisation des tokens Claude Code.
Taux de réussite du cache
Pourcentage de tokens côté entrée servis à partir du cache, codé par couleur en vert au-dessus de 70 pour cent, ambre entre 30 et 70, rouge en dessous de 30. Plus c'est élevé, moins c'est cher. Le meilleur levier unique sur l'utilisation des tokens Claude Code.
Total des tokens
Somme cumulative des tokens d'entrée, de sortie, des écritures de cache et des lectures de cache pour la session active. Utile comme chiffre principal lorsque vous comparez la consommation de tokens entre agents.
Pourquoi le compteur de tokens devient rouge
AgentsRoom vérifie votre utilisation des tokens Claude Code par session à chaque sondage. Lorsque le total courant dépasse un seuil de forte consommation, le badge devient rouge avec une icône d'avertissement. C'est le signal pour ouvrir le moniteur de session et décider quoi faire : compacter, créer un nouvel agent, changer de modèle, ou simplement terminer la tâche et conclure.
Le rouge n'est pas une limite stricte. AgentsRoom ne limite pas votre agent ni n'interrompt l'exécution. C'est un coup de pouce visuel, sur un seul agent, afin qu'une boucle incontrôlée ne vide pas silencieusement votre budget Anthropic pendant que vous vous concentrez sur une autre fenêtre. Les longues sessions avec des taux de réussite du cache sains sont parfaitement acceptables et restent vertes.
Comment AgentsRoom suit l'utilisation des tokens Claude Code
Trois couches : un sondeur d'utilisation, un parseur JSONL et une interface utilisateur en direct.
Le sondeur lit les totaux de tokens toutes les 15 secondes
Une tâche en arrière-plan lit l'utilisation des tokens par session à partir de l'état local de Claude et l'envoie dans le magasin du rendu. Aucun proxy sur l'API, aucun appel réseau supplémentaire. Juste une lecture plus rapide et visible des chiffres que Claude écrit déjà sur le disque.
Le parseur JSONL s'actualise toutes les 10 secondes pendant que le modal est ouvert
Le moniteur de session ajoute un appel IPC unique qui parcourt la transcription JSONL de la session Claude active pour calculer les comptes de messages, les tours d'assistant, les utilisations d'outils, les modèles routés et les horodatages de premier/dernier. Les actualisations s'exécutent toutes les 10 secondes pendant que le panneau est à l'écran, donc les chiffres restent en direct sans surcharger le parseur à chaque sondage de rendu.
Interface utilisateur en direct : badge plus moniteur de session
Le badge dans le compositeur de terminal lit les totaux de tokens et décide entre vert ou rouge. Cliquez dessus et le moniteur de session s'ouvre, dans un portail qui superpose toute la fenêtre. Les chiffres sont formatés avec des séparateurs de milliers, le taux de réussite du cache est coloré, et une section de conseils vous incite à consommer moins.
Conseils pour réduire votre utilisation des tokens Claude Code
Le moniteur de session met en avant ces conseils de manière contextuelle, en fonction de votre taux de réussite du cache en direct. Envoyez-en n'importe quel directement au terminal de l'agent en un clic.
Taux de réussite du cache bas : stabilisez le préfixe du prompt
En dessous de 30 pour cent, Claude paie le prix d'entrée complet à chaque tour. Modifier CLAUDE.md en cours de session, changer de modèle, ou réorganiser les messages système initiaux casse le cache. Verrouillez le haut du prompt et regardez le taux de réussite du cache grimper.
Utilisez /compact au lieu de /clear
Slash clear efface la conversation et force un prix d'entrée complet au tour suivant. Slash compact conserve la tâche et réduit l'historique en un résumé, donc le préfixe du cache survit. Même sensation fraîche, utilisation des tokens Claude Code beaucoup plus faible.
Lire partiellement, pas entièrement
Sur des fichiers de plus de 100 lignes, demandez à l'agent d'utiliser Read avec décalage et limite, ou grep pour le symbole d'abord. Charger un fichier de 4000 lignes à chaque tour est le principal gouffre silencieux d'utilisation des tokens Claude Code.
Éditez au lieu d'écrire
L'outil Éditer n'envoie que le diff à Claude. Écrire retransmet l'intégralité du fichier. Sur un composant de 600 lignes, cela double les tokens de sortie et gonfle l'entrée du tour suivant.
Créez des sous-agents pour des recherches larges
Glob et Grep à travers des centaines de fichiers ajoutent beaucoup de bruit dans votre contexte principal. L'outil Agent fonctionne dans sa propre fenêtre de contexte et ne renvoie qu'un résumé, gardant le prompt parent petit.
Réduisez votre CLAUDE.md
CLAUDE.md est préfixé à chaque tour. Chaque paragraphe inutile coûte des tokens d'entrée mis en cache multipliés par chaque message. Déplacez le long contexte dans context/ et référencez-le à la demande.

Le moniteur de session lit votre taux de cache hit en direct et propose des correctifs prêts à envoyer. Un clic sur Fix this envoie le prompt directement à l'agent.
Compteur de tokens AgentsRoom vs Claude Code vanilla
Claude Code vanilla montre les totaux de tokens à la fin d'une session, dans une petite ligne de pied de page que vous devez faire défiler pour trouver. Il n'y a pas de compteur en direct. Pas de répartition par session. Pas de taux de réussite du cache d'un coup d'œil. Pas d'avertissement lorsque la consommation augmente. Vous découvrez la surutilisation après coup, lorsque l'API limite le taux ou que la facture mensuelle est trop élevée.
AgentsRoom transforme l'utilisation des tokens Claude Code en un signal de première classe. Chaque agent a son propre compteur de tokens. Rouge en cas de surutilisation. Cliquez pour la répartition complète. Taux de réussite du cache calculé en temps réel. Conseils qui lisent vos chiffres en direct et proposent des prompts prêts à l'emploi pour réparer la fuite. La même session Claude, les mêmes transcriptions JSONL, mais avec la visibilité dont une flotte d'agents parallèles a réellement besoin.
Quand le compteur d'utilisation des tokens Claude Code vous fait économiser
Trois situations réelles où le suivi des tokens par session se rembourse.
Un agent est bloqué dans une boucle
Un agent continue de relire le même fichier et de réessayer la même solution. Son badge de tokens devient rouge en quelques minutes, son taux de réussite du cache s'effondre, son ratio de messages est déséquilibré. Vous le repérez sur le tableau de bord, intervenez, réécrivez le prompt, économisez le budget.
Une tâche longue se déroule bien
Trois heures dans un refactoring, vous vous demandez si l'agent est toujours sur la bonne voie. Ouvrez le moniteur de session : 700 messages, 180 utilisations d'outils, 78 pour cent de taux de réussite du cache, tout est vert. La consommation de tokens est élevée en absolu, normale en efficacité. Laissez-le cuire.
Exécution nocturne sur une flotte
Cinq agents traitent un arriéré pendant que vous dormez. Le matin, l'utilisation des tokens par session vous indique lequel était efficace, lequel a bouclé, lequel a manqué de contexte. Triage en deux minutes au lieu de lire chaque transcription.
Le compteur d'utilisation des tokens Claude Code est une pièce d'une surface de moniteur plus grande. Le statut des agents en direct, les badges de dock et les notifications push mobiles complètent le tableau.
Découvrez comment AgentsRoom surveille les agents AIVoir le chiffre est la première étape. Notre guide complet décompose exactement où vont les tokens Claude Code et comment réduire la facture sans ralentir : contexte plus serré, le bon modèle, délégation et plus.
Lire : réduisez vos coûts de tokens Claude CodeFAQ
Le suivi de l'utilisation des tokens Claude Code est-il précis ?
Oui. AgentsRoom lit les mêmes transcriptions JSONL que Claude écrit lui-même dans ~/.claude/projects/. Les tokens d'entrée, les tokens de sortie, les écritures de cache et les lectures de cache sont extraits directement de la charge utile d'utilisation par message qu'Anthropic émet. Il n'y a pas d'estimation, pas de proxy, pas d'arrondi. Les chiffres dans le moniteur de session correspondent à ce qu'Anthropic facture.
Le compteur de tokens ralentit-il mon agent ?
Non. Le sondeur lit les fichiers locaux toutes les 15 secondes. Le parseur JSONL ne s'exécute que lorsque le moniteur de session est ouvert, toutes les 10 secondes. Il n'y a pas d'appel réseau supplémentaire à Anthropic, pas d'instrumentation injectée dans Claude, pas de surcharge sur les appels d'outils. Votre agent fonctionne à pleine vitesse.
Quand le badge devient-il rouge ?
Lorsque l'utilisation cumulative des tokens Claude Code par session dépasse un seuil de forte consommation réglé pour des sessions de codage longues normales. Le seuil est suffisamment conservateur pour qu'une session inactive ne le déclenche jamais, et suffisamment serré pour qu'une boucle incontrôlée devienne rouge en quelques tours. Le rouge est un avertissement, pas une limitation.
Pourquoi le taux de réussite du cache est-il si important ?
Les lectures de cache coûtent environ 10 fois moins que les tokens d'entrée frais. Une session avec un taux de réussite du cache de 80 pour cent est environ cinq fois moins chère que la même session à 0 pour cent. Le taux de réussite du cache est le meilleur levier unique sur votre utilisation des tokens Claude Code. AgentsRoom le montre en direct afin que vous puissiez corriger le tir en cours de session au lieu de le découvrir à la fin.
Prend-il également en charge Codex, Antigravity, OpenCode, Aider, Grok Build, Mistral Vibe et Kimi Code ?
Le moniteur de session dans sa forme actuelle est spécifique à Claude car il lit les transcriptions JSONL de Claude et la répartition du cache de prompt est une fonctionnalité de facturation uniquement Claude. Le statut, le rôle et les notifications fonctionnent pour chaque fournisseur. Nous suivons l'utilisation indépendante du fournisseur dans la feuille de route.
AgentsRoom envoie-t-il mon utilisation des tokens Claude Code à un serveur ?
Non. Le compteur de tokens, le moniteur de session et le taux de réussite du cache sont calculés entièrement sur votre Mac, à partir de fichiers locaux. Rien ne quitte votre machine. Si vous activez la synchronisation cryptée optionnelle avec le compagnon mobile, seules les données que vous choisissez explicitement de synchroniser sont envoyées, et elles sont cryptées de bout en bout via le relais AgentsRoom.
Puis-je enregistrer les conseils en tant que prompts réutilisables ?
Oui. Chaque conseil dans le moniteur de session a un bouton Réparer ceci qui ouvre un prompt prêt à l'emploi et modifiable. Envoyez-le directement au terminal de l'agent, copiez-le dans le presse-papiers, ou enregistrez-le dans votre bibliothèque de prompts globale afin que la même correction soit à un clic sur chaque projet.
Arrêtez de deviner votre utilisation des tokens Claude Code
Téléchargez AgentsRoom et obtenez un compteur de tokens par session en direct sur chaque agent Claude. Rouge en cas de surutilisation, taux de réussite du cache d'un coup d'œil, conseils pour consommer moins. Tout local, tout à vous.
App companion : suivez vos agents en déplacement
Utilisez Claude, Codex, Antigravity CLI ou un autre fournisseur IA.
Remontez bugs et demandes directement dans votre backlog public.
Aperçu d'AgentsRoom en action.