Berapa Token yang Masih Saya Miliki di Claude? Angka Itu Tidak Ada.

Paket langganan Claude Anda tidak dihitung dalam token, jadi tidak ada layar yang menampilkan saldo token. Berikut yang sebenarnya diukur, di mana membacanya, dan mengapa kuota berkurang saat Anda tidak mengetik apa pun.

Ini salah satu pertanyaan yang paling banyak dicari tentang Claude, dan diajukan dalam hampir semua bahasa. Jawabannya pun tidak nyaman: angka seperti itu tidak ada, karena paket langganan Anda tidak dijual dalam satuan token.

Ini bukan sekadar soal teknis. Hal ini menjelaskan mengapa Anda tidak pernah menemukan penghitung yang Anda cari, mengapa setiap halaman yang mengaku bisa menampilkannya sebenarnya hanya menebak, dan mengapa hal yang benar-benar menghentikan Anda di tengah pekerjaan bukanlah hal yang diperhatikan kebanyakan orang.

Paket langganan Anda diukur dalam jendela, bukan dalam token

Anthropic tidak menyatakan langganan Claude sebagai jatah token. Langganan itu diukur sebagai jendela penggunaan: satu jendela sesi yang bergulir, dan satu jendela mingguan di atasnya. Keduanya dipakai bersama di semua permukaan tempat Anda masuk, jadi satu sore panjang di Claude chat menyisakan ruang lebih sedikit untuk Claude Code pada malam harinya. Keduanya juga dipakai bersama oleh semua model, itulah sebabnya beralih ke model yang lebih murah dengan /model tidak mengembalikan limit Anda setelah limit itu tercapai.

Karena itu, yang bisa Anda baca adalah porsi sebuah jendela dan waktu jendela itu kembali, bukan saldo. Ketika kuota Anda benar-benar habis, pesan yang menghentikan Anda menyebutkan batas mana yang tercapai dan kapan batas itu di-reset, dan pesan itulah satu-satunya angka yang otoritatif untuk akun Anda.

Satu-satunya tempat di mana jumlah token punya arti harfiah adalah API, yang ditagih per token. Semua penjelasan di bawah ini tentang langganan, dan itulah yang sebenarnya ditanyakan kebanyakan orang.

Angka yang bisa Anda baca, dan di mana letaknya

Ada dua layar, dan keduanya menjawab pertanyaan yang berbeda.

Di dalam Claude Code, /usage adalah yang paling layak dipelajari. Pada paket langganan Pro, Max, Team atau Enterprise, perintah ini menampilkan bilah penggunaan untuk limit paket Anda, dan tekan d atau w untuk berpindah antara 24 jam terakhir dan 7 hari terakhir. Di bawah bilah itu, ia melakukan sesuatu yang lebih berguna daripada angka mentah mana pun: ia mengatribusikan penggunaan terkini ke skill, subagent, plugin dan masing-masing server MCP, semuanya dalam bentuk persentase, lalu memunculkan tanda perilaku ketika satu pola menyumbang 10% atau lebih dari konsumsi terkini Anda, misalnya konteks yang panjang atau cache miss.

Ada satu catatan penting yang mudah terlewat: angka-angka itu dihitung dari riwayat sesi lokal Anda di mesin tersebut. Pekerjaan yang dilakukan dari laptop lain, atau di claude.ai, tidak termasuk di dalamnya.

Di web, Settings lalu Usage di claude.ai adalah tampilan pada tingkat akun: paket langganan Anda, posisi Anda saat ini, dan kapan jendela mingguan di-reset. Jika Anda bekerja di dua mesin, inilah tampilan yang lengkap.

Untuk rincian per sesi tentang biaya sebenarnya dari sebuah pekerjaan, blok teratas /usage mencetak jumlah mentahnya:

Usage by model:
   claude-sonnet-4-6:  1.2k input, 5.3k output, 940.0k cache read, 50.0k cache write

Empat angka itu adalah keseluruhan cerita dari sebuah sesi coding, dan yang terbesar hampir selalu cache read. Jika Anda ingin melihat tampilan itu secara terus-menerus alih-alih hanya saat diminta, AgentsRoom menyediakan meteran token langsung pada setiap sesi di sebelah terminal, dengan pembagian input, output dan cache yang sama serta lencana merah ketika sebuah sesi mulai memanas. Versi langkah demi langkah untuk membaca penghitung bawaan CLI dibahas di cara memeriksa penggunaan token Claude Code.

Apa sebenarnya token itu begitu ada agent yang terlibat

Token adalah potongan teks: kira-kira tiga perempat kata dalam bahasa Inggris, dan jelas lebih sedikit dalam kode, karena tanda baca dan identifier mudah terpecah.

Bagian yang mengejutkan banyak orang adalah bahwa sebuah percakapan dikirim ulang secara utuh pada setiap permintaan. Ajukan pertanyaan satu baris dalam sesi yang sudah terbuka sejak pagi, dan Anda tidak membayar untuk baris itu, Anda membayar seluruh riwayat yang ikut terkirim bersamanya. Setiap kali agent memakai sebuah tool, ia mengirim satu permintaan lagi yang membawa serta hasil tool sebelumnya, dan itulah sebabnya satu permintaan "perbaiki tes ini" bisa berubah menjadi belasan kali bolak-balik.

Prompt caching adalah yang membuat hal ini masih bisa ditanggung. Riwayat yang berulang ditagih dengan tarif cache yang jauh lebih rendah, itulah sebabnya angka cache read sangat besar sementara tagihannya tidak. Hal ini juga menyiapkan panggung bagi kebiasaan paling mahal dalam pekerjaan dengan agent, yang menjadi topik bagian berikutnya.

Mengapa bilah itu bergerak saat Anda tidak mengetik apa pun

Jika penggunaan Anda naik pada sesi yang sedang menganggur, penyebabnya salah satu dari ini, dan tidak satu pun merupakan bug:

  • Cache yang kedaluwarsa. Konteks yang di-cache bertahan sekitar satu jam pada langganan, dan turun menjadi lima menit begitu Anda memakai kredit penggunaan, atau memakai kunci API. Kembali dari makan siang dan pesan pertama Anda meleset dari cache: seluruh percakapan Anda diproses ulang dengan harga penuh. Satu jeda, satu pemrosesan ulang penuh.
  • Apa pun yang memulai giliran dengan sendirinya. Tugas terjadwal yang berjalan, pesan yang datang dari sesi Anda yang lain, pemeriksaan tujuan sementara pekerjaan latar belakang berjalan. Masing-masing mengirim ulang konteks penuh, persis seperti pesan yang Anda ketik sendiri.
  • Agent rekan setim. Setiap rekan setim yang aktif menjalankan jendela konteksnya sendiri dan terus mengonsumsi kuota sampai ia berhenti. Panduan resmi Anthropic memperkirakan satu tim dalam mode plan setara dengan kira-kira tujuh kali sesi standar.
  • Pemadatan. /compact harus membaca percakapan yang diringkasnya, jadi memadatkan konteks yang besar itu sendiri merupakan permintaan yang besar. /clear tidak memakan biaya, dan ketika Anda tidak membutuhkan kesinambungan, itulah langkah yang lebih baik.
  • Pekerjaan latar belakang. Ringkasan untuk --resume dan pekerjaan rutin sejenis menyedot sedikit kuota bahkan saat Anda menganggur, biasanya di bawah empat sen per sesi.

Di sinilah juga dua peringatan yang sering dicampuradukkan orang akhirnya berpisah jalan. Peringatan konteks atau auto-compact mengatakan bahwa satu percakapan mendekati jendela konteks model, dan membersihkan sesi tersebut menyelesaikannya. Limit penggunaan mengatakan bahwa kuota yang termasuk dalam langganan Anda sudah habis di seluruh sesi, dan membersihkan konteks tidak mengembalikan sedikit pun. Petunjuk yang bisa diandalkan: limit penggunaan menyebutkan waktu reset, peringatan konteks tidak.

Apa yang harus dilakukan ketika bilah hampir penuh

Kira-kira diurutkan dari yang paling besar hasilnya dibanding usahanya:

  1. Bersihkan konteks di antara tugas yang tidak berkaitan. Konteks basi akan dikirim ulang pada setiap pesan sampai sesi berakhir. Gunakan /rename sebelum /clear jika Anda ingin menemukannya lagi dengan /resume.
  2. Sesuaikan model dengan pekerjaannya. Sonnet menangani sebagian besar pekerjaan coding; membiarkan Opus sebagai default adalah penyebab paling umum kuota langganan yang lenyap sebelum hari Kamis.
  3. Baca atribusi di /usage. Jika satu server MCP atau satu subagent menyumbang 30% dari minggu Anda, di situlah perbaikannya, dan Anda tidak akan pernah menebak yang mana.
  4. Turunkan penalaran sebelum mematikannya. Token penalaran ditagih sebagai output. Menurunkan tingkat upaya penalaran biasanya sudah cukup.
  5. Dorong pekerjaan yang bertele-tele ke subagent. Output tes dan berkas log tetap berada di konteks subagent, dan hanya ringkasannya yang kembali.
  6. Jaga berkas konteks tetap pendek. Apa pun yang ada di CLAUDE.md atau AGENTS.md dimuat saat sesi dimulai dan dibayar pada setiap giliran, termasuk ketika isinya tidak relevan. Instruksi alur kerja yang panjang sebaiknya diletakkan di sebuah skill, yang hanya dimuat ketika dipanggil. Penjelasan lebih lanjut ada di panduan berkas konteks AGENTS.md.

Jika Anda ingin versi yang lebih panjang khusus tentang sisi penghematan biaya, mengurangi biaya token Claude Code membahasnya secara rinci.

Versi singkatnya

Berhentilah mencari saldo token: paket langganan Anda tidak punya saldo semacam itu. Pelajari kedua jendela tersebut, baca /usage untuk melihat atribusinya alih-alih totalnya, dan perlakukan cache sebagai hal yang menentukan minggu Anda. Developer yang tidak pernah kena limit jarang sekali adalah mereka yang mengetik lebih sedikit. Mereka adalah orang yang memulai sesi baru ketika topiknya berganti.

Menjalankan beberapa agent sekaligus membuat semua ini sekaligus lebih parah dan lebih mudah dilihat, karena konsumsinya berhenti menjadi satu angka dan berubah menjadi satu angka per agent. Tampilan itulah yang menjadi dasar rancangan AgentsRoom.

Pertanyaan yang sering diajukan

Berapa token yang tersisa di Claude?

Tidak ada angka semacam itu yang bisa dilihat. Langganan Claude tidak dijual sebagai anggaran token: langganan itu diukur sebagai porsi dari jendela sesi yang bergulir ditambah jendela mingguan, dan yang bisa Anda baca adalah persentase dari kedua jendela itu beserta waktu reset-nya, bukan saldo token. Tempat membacanya adalah perintah /usage di dalam Claude Code, atau Settings lalu Usage di claude.ai. Hanya di API, yang ditagih per token, angka token punya arti.

Bagaimana cara kerja token Claude?

Token adalah potongan teks, kira-kira tiga perempat kata dalam bahasa Inggris dan lebih sedikit lagi dalam kode. Setiap permintaan mengirim ulang seluruh percakapan Anda, jadi sesi coding membayar riwayat yang menumpuk pada setiap giliran, bukan hanya kalimat yang Anda ketik. Itulah sebabnya penggunaan dihitung dalam empat angka terpisah: input, output, tulis cache dan baca cache. Riwayat yang di-cache ditagih dengan tarif jauh lebih rendah daripada input baru, dan justru karena itulah sesi yang dibiarkan terbuka seharian tetap menyedot kuota paket langganan Anda.

Kapan penggunaan Claude saya di-reset?

Ada dua jam hitung dan keduanya berdiri sendiri. Jendela sesi bergulir, jadi ia berakhir sekian jam tetap setelah dibuka, bukan pada waktu yang Anda pilih sendiri. Jendela mingguan berada di atasnya dan di-reset pada momen tetap yang ditetapkan untuk akun Anda. Pesan limit itu sendiri memberi tahu Anda kapan jendela yang menghentikan Anda akan kembali, dan pesan itulah jawaban otoritatif untuk akun Anda. Kedua jam hitung ini dipakai bersama oleh Claude chat dan Claude Code, jadi pemakaian chat yang berat memperpendek anggaran coding Anda.

Apakah beralih ke model yang lebih murah mengembalikan limit saya?

Tidak. Jendela sesi dan jendela mingguan dipakai bersama oleh semua model, jadi beralih dengan /model tidak memulihkan akses setelah Anda mencapai batas tersebut. Cara ini membantu dalam satu kasus khusus: pesan yang spesifik per model, misalnya ketika Anda mencapai limit Opus, di mana pindah ke Sonnet memungkinkan Anda terus bekerja. Cara ini juga membantu sebelum kuota Anda habis, karena model yang lebih murah mengonsumsi lebih sedikit dari kuota yang sama untuk pekerjaan yang sama.

Mengapa penggunaan saya naik padahal saya tidak melakukan apa-apa?

Karena menganggur tidak gratis dalam sesi agent. Apa pun yang memulai sebuah giliran akan mengirim ulang seluruh konteks Anda: tugas terjadwal yang berjalan, pesan yang datang dari sesi lain, agent rekan setim yang masih berjalan, pemeriksaan tujuan. Dua hal lain memakan token tanpa giliran: pemadatan, yang harus membaca percakapan yang diringkasnya, dan pesan pertama setelah jeda panjang, yang meleset dari prompt cache dan memproses ulang seluruh riwayat Anda dengan harga penuh.

Apakah peringatan konteks sama dengan limit penggunaan?

Tidak, dan mencampuradukkan keduanya membuat orang memilih solusi yang salah. Peringatan konteks atau auto-compact berkaitan dengan satu percakapan yang mendekati jendela konteks model, dan diselesaikan dengan membersihkan atau memadatkan sesi tersebut. Limit penggunaan berkaitan dengan kuota yang termasuk dalam langganan Anda di seluruh sesi, dan membersihkan konteks tidak mengembalikan sedikit pun dari kuota itu. Petunjuknya ada pada pilihan katanya: pesan limit menyebutkan waktu reset, peringatan konteks tidak.

Unduh AgentsRoom

Jalankan agen AI Anda (Claude, Codex, Antigravity CLI, OpenCode, Aider, Grok Build, Mistral Vibe, Kimi Code) di semua proyek Anda, dari satu jendela.

GratisUnduh AgentsRoom

Aplikasi pendamping: pantau agen Anda saat bepergian

Gunakan Claude, Codex, Antigravity CLI, atau penyedia AI lainnya.

Dapatkan ekstensi
Chrome Web Store

Kirim bug dan permintaan langsung ke backlog publik Anda.

Sekilas AgentsRoom dalam aksi.

Beberapa proyek
Multi-penyedia
Beberapa agen
Status langsung
File diff & commit
Pendamping mobile
Pratinjau langsung
Tim agen
Otomatisasi browser
Dev berbasis backlog
Pustaka prompt
Pustaka skill
Lihat semua fitur

Lanjutkan membaca