Penggunaan token: per sesi: langsung

Penggunaan token Claude Code,
dilacak per sesi, secara real-time

AgentsRoom memantau penggunaan token Claude Code Anda di setiap terminal agen. Sebuah penghitung token kecil berada di komposer dan diperbarui secara langsung. Ketika konsumsi token Anda meningkat pada satu sesi Claude, lencana berubah merah dan memperingatkan Anda sebelum Anda melewati jendela konteks.

Klik lencana dan pemantau sesi terbuka: token input, token output, pembacaan cache, penulisan cache, tingkat hit cache, jumlah pesan, model yang diarahkan, durasi sesi, dan penggunaan alat. Satu panel, satu sesi Claude, semua angka yang mendorong penggunaan token Claude Code Anda.

Gratis · macOS · 100% lokal, tanpa proxy

Demo langsung dari lencana penggunaan token Claude Code di AgentsRoom: ia berada di setiap komposer agen, berubah merah saat konsumsi token berat, dan membuka pemantau sesi penuh dengan token input, token output, pembacaan cache, dan penulisan cache.

Penggunaan token Claude Code adalah biaya variabel nomor satu dalam menjalankan agen pengkodean AI. Setiap prompt, setiap panggilan alat, setiap penyuntikan ulang CLAUDE.md menghabiskan token. Tanpa visibilitas, Anda baru menyadari bahwa Anda telah melewati anggaran Anda ketika API membatasi atau tagihan tiba. AgentsRoom menempatkan meteran penggunaan token Claude Code langsung di setiap sesi agen sehingga Anda melihat konsumsi saat itu terjadi, bukan setelahnya.

Penghitung token berada di komposer terminal, tepat di samping tombol kirim. Ia diperbarui beberapa detik setelah setiap giliran Claude. Token terakumulasi di seluruh sesi: token input, token output, penulisan cache, dan pembacaan cache, semua dijumlahkan dan diberi kode warna sehingga Anda dapat membacanya sekilas. Ketika penggunaan token Claude Code per sesi melewati ambang konsumsi berat, lencana berubah merah dengan ikon peringatan, sama seperti indikator bahan bakar yang mengingatkan Anda sebelum tangki kosong.

Klik dan pemantau sesi terbuka. Anda mendapatkan snapshot langsung dari sesi Claude yang aktif: durasi sejak pesan pertama, jumlah prompt pengguna versus giliran asisten, penggunaan alat, model yang menangani percakapan, id sesi Claude (dapat disalin untuk --resume), dan rincian token lengkap. Tingkat hit cache dihitung secara langsung, diberi kode warna hijau / amber / merah, dengan pengingat satu baris bahwa pembacaan cache menghabiskan biaya sekitar sepuluh kali lebih sedikit daripada input segar. Panel tunggal ini mengubah penggunaan token Claude Code dari kotak hitam menjadi pengukur waktu nyata.

Tampilan dekat komposer agen AgentsRoom dengan lencana penggunaan token Claude Code yang berubah merah, memperingatkan konsumsi berat pada 58 juta token

Lencana token berada tepat di samping tombol kirim dan berubah merah saat konsumsi sebuah sesi menjadi berat.

Mengapa penggunaan token Claude Code per sesi itu penting

Sebagian besar pembungkus Claude melaporkan penggunaan token di tingkat akun, sekali sehari, dalam dasbor yang harus Anda ingat untuk dibuka. Pada saat itu, kerusakan sudah terjadi. AgentsRoom mendorong penggunaan token Claude Code ke permukaan, di setiap terminal agen, sehingga Anda tidak bisa mengabaikannya. Penghitung token berada dua sentimeter dari tombol kirim. Anda melihatnya seperti Anda melihat lencana yang belum dibaca di ponsel Anda.

Per sesi adalah granularitas yang tepat. Sekelompok agen yang berjalan paralel tidak memberi tahu Anda siapa yang menghabiskan token. Satu agen mungkin terjebak dalam prompt yang macet sementara empat lainnya diam. Dengan meteran penggunaan token Claude Code per sesi, agen yang berisik segera menonjol: lencananya merah, tingkat hit cache-nya rendah, jumlah pesannya meningkat cepat. Anda masuk, memperbaiki prompt, menghemat anggaran.

Seluruh fitur ini bersifat lokal. AgentsRoom membaca penggunaan token Claude Code Anda langsung dari transkrip JSONL yang ditulis Claude ke ~/.claude/projects/. Tidak ada yang meninggalkan mesin Anda. Tidak ada pelacak penggunaan pihak ketiga. Tidak ada proxy di depan API. Penghitung token di AgentsRoom hanyalah pembacaan data yang lebih cepat dan lebih terlihat dari data yang sudah disimpan Anthropic di disk Anda.

Modal penggunaan token Claude Code di AgentsRoom: durasi, status, jumlah pesan, penggunaan alat, model, id sesi, plus rincian token dengan input, output, penulisan cache, pembacaan cache, dan tingkat hit cache

Panel penggunaan token Claude Code di AgentsRoom. Klik lencana token per sesi di mana saja di komposer agen, dapatkan setiap angka yang penting, plus tips untuk mengurangi konsumsi token Anda.

Apa yang ditunjukkan panel penggunaan token Claude Code

Satu klik pada lencana token membuka pemantau sesi langsung. Berikut adalah setiap angka yang Anda dapatkan pada sesi Claude yang aktif.

Durasi sesi

Waktu yang berlalu antara pesan pertama dan terakhir dari sesi Claude yang aktif, diperbarui secara langsung. Berguna untuk menemukan agen yang telah menghabiskan konteks selama berjam-jam.

Status agen langsung

Diam, bekerja, selesai, atau membutuhkan input. Status ini dipasangkan dengan penghitung token sehingga Anda dapat melihat sekilas sesi Claude mana yang sedang mengonsumsi dan mana yang hanya duduk di sana.

Pesan dan giliran asisten

Jumlah prompt pengguna versus giliran asisten dalam sesi Claude yang aktif. Rasio yang tidak seimbang adalah sinyal kuat bahwa seorang agen terjebak dalam loop atau bahwa prompt Anda terlalu samar.

Penggunaan alat

Jumlah total Read, Edit, Bash, Grep, Glob, dan panggilan alat lainnya yang dieksekusi oleh Claude dalam sesi. Panggilan alat mendorong sebagian besar token input, jadi angka ini melacak penggunaan token Claude Code dengan dekat.

Model yang digunakan

Setiap model Claude yang menangani satu giliran dalam sesi: Sonnet, Opus, Haiku, varian bertanggal. AgentsRoom menghapus duplikasi dan memperpendek nama sehingga Anda segera melihat apakah sesi Anda diarahkan secara otomatis di antara model.

ID sesi Claude

Pengidentifikasi sesi internal Claude, dapat disalin dengan satu klik. Gunakan untuk claude --resume percakapan yang sama persis dari CLI tanpa kehilangan konteks.

Token input

Token input segar yang dikirim ke Claude selama sesi, sebelum ada penggunaan ulang cache. Ini adalah bucket paling mahal dari penggunaan token Claude Code Anda.

Token output

Token yang dihasilkan oleh Claude dalam sesi. Token output dikenakan biaya lebih tinggi daripada input, jadi nilai tinggi tanpa kemajuan berarti seorang agen sedang berputar.

Penulisan cache

Token yang ditulis Claude ke cache prompt selama sesi. Penulisan cache dikenakan biaya sedikit lebih tinggi tetapi membuka pembacaan cache yang murah pada giliran berikutnya.

Pembacaan cache

Token yang disajikan dari cache prompt alih-alih dihargai ulang sebagai input segar. Pembacaan cache menghabiskan biaya sekitar 10x lebih sedikit daripada token input, itulah sebabnya tingkat hit cache adalah metrik utama penggunaan token Claude Code Anda.

Tingkat hit cache

Persentase token sisi input yang disajikan dari cache, diberi kode warna hijau di atas 70 persen, amber antara 30 dan 70, merah di bawah 30. Semakin tinggi semakin murah. Pengungkit terbaik tunggal untuk penggunaan token Claude Code.

Total token

Jumlah kumulatif di seluruh input, output, penulisan cache, dan pembacaan cache untuk sesi aktif. Berguna sebagai angka utama ketika Anda membandingkan konsumsi token di antara agen.

Mengapa meteran token berubah merah

AgentsRoom memeriksa penggunaan token Claude Code per sesi Anda pada setiap polling. Ketika total yang berjalan melewati ambang konsumsi berat, lencana berubah merah dengan ikon peringatan. Itu adalah isyarat untuk membuka pemantau sesi dan memutuskan apa yang harus dilakukan: kompak, membuat agen baru, mengganti model, atau cukup menyelesaikan tugas dan menyelesaikannya.

Merah bukanlah batas keras. AgentsRoom tidak membatasi agen Anda atau menghentikan jalannya. Ini adalah dorongan visual, pada satu agen, sehingga loop yang tidak terkendali tidak secara diam-diam menguras anggaran Anthropic Anda saat Anda fokus pada jendela lain. Sesi panjang dengan tingkat hit cache yang sehat sangat baik dan tetap hijau.

Bagaimana AgentsRoom melacak penggunaan token Claude Code

Tiga lapisan: pemantau penggunaan, parser JSONL, dan UI langsung.

01

Pemantau membaca total token setiap 15 detik

Tugas latar belakang membaca penggunaan token per sesi dari status lokal Claude Anda dan mendorongnya ke dalam penyimpanan renderer. Tidak ada proxy di API, tidak ada panggilan jaringan tambahan. Hanya pembacaan angka yang lebih cepat dan terlihat dari data yang sudah ditulis Claude ke disk.

02

Parser JSONL diperbarui setiap 10 detik saat modal terbuka

Pemantau sesi menambahkan panggilan IPC satu kali yang menjelajahi transkrip JSONL sesi Claude yang aktif untuk menghitung jumlah pesan, giliran asisten, penggunaan alat, model yang diarahkan, dan timestamp pertama/terakhir. Pembaruan berjalan setiap 10 detik saat panel ditampilkan, sehingga angka tetap langsung tanpa membakar parser pada setiap polling renderer.

03

UI langsung: lencana plus pemantau sesi

Lencana di komposer terminal membaca total token dan memutuskan hijau atau merah. Klik dan pemantau sesi terbuka, dalam portal sehingga menutupi seluruh jendela. Angka diformat dengan pemisah ribuan, tingkat hit cache diberi warna, dan bagian tips mendorong Anda untuk mengonsumsi lebih sedikit.

Tips untuk mengurangi penggunaan token Claude Code Anda

Pemantau sesi menampilkan tips ini secara kontekstual, berdasarkan tingkat hit cache langsung Anda. Kirim salah satu dari mereka langsung ke terminal agen dengan satu klik.

Tingkat hit cache rendah: stabilkan awalan prompt

Di bawah 30 persen, Claude membayar harga input penuh setiap giliran. Mengedit CLAUDE.md di tengah sesi, mengganti model, atau mengatur ulang pesan sistem awal merusak cache. Kunci bagian atas prompt dan lihat tingkat hit cache meningkat.

Gunakan /compact alih-alih /clear

Slash clear menghapus percakapan dan memaksa penetapan harga input penuh pada giliran berikutnya. Slash compact mempertahankan tugas dan memperkecil riwayat menjadi ringkasan, sehingga awalan cache bertahan. Perasaan segar yang sama, penggunaan token Claude Code jauh lebih rendah.

Baca sebagian, bukan seluruhnya

Pada file yang lebih besar dari 100 baris, minta agen untuk menggunakan Read dengan offset dan limit, atau grep untuk simbol terlebih dahulu. Memuat file 4000 baris setiap giliran adalah penyebab utama penggunaan token Claude Code yang tidak terlihat.

Edit alih-alih Tulis

Alat Edit hanya mengirim perbedaan kembali ke Claude. Tulis mengirim ulang seluruh file. Pada komponen 600 baris, itu menggandakan token output dan membengkak input giliran berikutnya.

Buat sub-agen untuk pencarian luas

Glob dan Grep di ratusan file menghasilkan banyak kebisingan ke dalam konteks utama Anda. Alat Agen berjalan di jendela konteksnya sendiri dan hanya mengembalikan ringkasan, menjaga prompt induk tetap kecil.

Perkecil CLAUDE.md Anda

CLAUDE.md diawali di setiap giliran. Setiap paragraf yang tidak berguna di sana menghabiskan biaya token input yang disimpan dikalikan setiap pesan. Pindahkan konteks panjang ke context/ dan referensikan sesuai permintaan.

Pemantau sesi AgentsRoom dengan statistik penggunaan alat, file yang dibaca, dan tips kontekstual untuk mengurangi penggunaan token Claude Code, masing-masing dengan tombol Fix this sekali klik

Pemantau sesi membaca tingkat hit cache Anda secara langsung dan menampilkan perbaikan yang siap dikirim. Satu klik pada Fix this mengirim prompt langsung ke agen.

Meteran token AgentsRoom vs Claude Code vanilla

Claude Code vanilla menunjukkan total token di akhir sesi, dalam baris footer kecil yang harus Anda gulir ke atas untuk menemukannya. Tidak ada meteran langsung. Tidak ada rincian per sesi. Tidak ada tingkat hit cache sekilas. Tidak ada peringatan saat konsumsi melonjak. Anda menemukan penggunaan berlebihan setelah fakta, ketika API membatasi laju atau faktur bulanan terlalu tinggi.

AgentsRoom mengubah penggunaan token Claude Code menjadi sinyal kelas satu. Setiap agen mendapatkan penghitung tokennya sendiri. Merah saat penggunaan berlebihan. Klik untuk rincian lengkap. Tingkat hit cache dihitung secara real-time. Tips yang membaca angka langsung Anda dan mengusulkan prompt siap pakai untuk memperbaiki kebocoran. Sesi Claude yang sama, transkrip JSONL yang sama, tetapi dengan visibilitas yang sebenarnya dibutuhkan oleh armada agen paralel.

Ketika meteran penggunaan token Claude Code menyelamatkan Anda

Tiga situasi nyata di mana pelacak token per sesi membayar dirinya sendiri.

Seorang agen terjebak dalam loop

Satu agen terus membaca file yang sama dan mencoba perbaikan yang sama. Lencana tokennya berubah merah dalam beberapa menit, tingkat hit cache-nya merosot, rasio pesannya tidak seimbang. Anda melihatnya di dasbor, masuk, menulis ulang prompt, menghemat anggaran.

Tugas panjang berjalan dengan baik

Tiga jam dalam refactor, Anda bertanya-tanya apakah agen masih berada di jalur yang benar. Buka pemantau sesi: 700 pesan, 180 penggunaan alat, 78 persen tingkat hit cache, semua hijau. Konsumsi token tinggi dalam angka absolut, normal dalam efisiensi. Biarkan ia bekerja.

Jalankan semalaman di armada

Lima agen bekerja melalui backlog saat Anda tidur. Di pagi hari, penggunaan token per sesi memberi tahu Anda mana yang efisien, mana yang terjebak, mana yang kehabisan konteks. Triage dalam dua menit alih-alih membaca setiap transkrip.

Meteran penggunaan token Claude Code adalah satu bagian dari permukaan pemantau yang lebih besar. Status agen langsung, lencana dok, dan notifikasi dorong seluler melengkapi gambaran.

Lihat bagaimana AgentsRoom memantau agen AI

Melihat angkanya adalah langkah pertama. Panduan lengkap kami merinci dengan tepat ke mana token Claude Code pergi dan bagaimana memotong tagihan tanpa memperlambat: konteks yang lebih ketat, model yang tepat, delegasi, dan lainnya.

Baca: potong biaya token Claude Code Anda

FAQ

Apakah pelacak penggunaan token Claude Code akurat?

Ya. AgentsRoom membaca transkrip JSONL yang sama yang ditulis Claude sendiri ke ~/.claude/projects/. Token input, token output, penulisan cache, dan pembacaan cache diambil langsung dari payload penggunaan per pesan yang dikeluarkan Anthropic. Tidak ada estimasi, tidak ada proxy, tidak ada pembulatan. Angka di pemantau sesi cocok dengan apa yang ditagih Anthropic.

Apakah penghitung token memperlambat agen saya?

Tidak. Pemantau membaca file lokal setiap 15 detik. Parsing JSONL hanya berjalan saat pemantau sesi terbuka, setiap 10 detik. Tidak ada panggilan jaringan tambahan ke Anthropic, tidak ada instrumen yang disuntikkan ke Claude, tidak ada overhead pada panggilan alat. Agen Anda berjalan dengan kecepatan penuh.

Kapan lencana berubah merah?

Ketika penggunaan token Claude Code per sesi kumulatif melewati ambang konsumsi berat yang disetel untuk sesi pengkodean panjang yang normal. Ambang tersebut cukup konservatif sehingga sesi yang tidak aktif tidak pernah memicu, dan cukup ketat sehingga loop yang tidak terkendali berubah merah dalam beberapa giliran. Merah adalah peringatan, bukan pembatas.

Mengapa tingkat hit cache sangat penting?

Pembacaan cache menghabiskan biaya sekitar 10x lebih sedikit daripada token input segar. Sesi dengan tingkat hit cache 80 persen sekitar lima kali lebih murah daripada sesi yang sama dengan 0 persen. Tingkat hit cache adalah pengungkit terbaik tunggal untuk penggunaan token Claude Code Anda. AgentsRoom menampilkannya secara langsung sehingga Anda dapat memperbaiki arah di tengah sesi alih-alih menemukan di akhir.

Apakah ini mendukung Codex, Antigravity, OpenCode, Aider, Grok Build, Mistral Vibe, dan Kimi Code juga?

Pemantau sesi dalam bentuknya saat ini spesifik untuk Claude karena ia membaca transkrip JSONL Claude dan rincian cache prompt adalah fitur penagihan khusus Claude. Status, peran, dan notifikasi berfungsi untuk setiap penyedia. Kami sedang melacak penggunaan yang tidak bergantung pada penyedia dalam roadmap.

Apakah AgentsRoom mengirim penggunaan token Claude Code saya ke server?

Tidak. Penghitung token, pemantau sesi, dan tingkat hit cache dihitung sepenuhnya di Mac Anda, dari file lokal. Tidak ada yang meninggalkan mesin Anda. Jika Anda mengaktifkan sinkronisasi terenkripsi opsional ke pendamping seluler, hanya data yang secara eksplisit Anda pilih untuk dicerminkan yang dikirim, dan itu terenkripsi end-to-end melalui relay AgentsRoom.

Bisakah saya menyimpan tips sebagai prompt yang dapat digunakan kembali?

Ya. Setiap tips di pemantau sesi memiliki tombol Perbaiki ini yang membuka prompt siap pakai yang dapat diedit. Kirim langsung ke terminal agen, salin ke clipboard, atau simpan ke perpustakaan prompt global Anda sehingga perbaikan yang sama hanya satu klik jauh di setiap proyek.

Hentikan menebak penggunaan token Claude Code Anda

Unduh AgentsRoom dan dapatkan meteran token per sesi langsung di setiap agen Claude. Merah saat penggunaan berlebihan, tingkat hit cache sekilas, tips untuk mengonsumsi lebih sedikit. Semua lokal, semua milik Anda.

GratisUnduh AgentsRoom

Aplikasi pendamping: pantau agen Anda saat bepergian

Gunakan Claude, Codex, Antigravity CLI, atau penyedia AI lainnya.

Dapatkan ekstensi
Chrome Web Store

Kirim bug dan permintaan langsung ke backlog publik Anda.

Sekilas AgentsRoom dalam aksi.

Beberapa proyek
Multi-penyedia
Beberapa agen
Status langsung
File diff & commit
Pendamping mobile
Pratinjau langsung
Tim agen
Otomatisasi browser
Dev berbasis backlog
Pustaka prompt
Pustaka skill
Lihat semua fitur