Claude'da token nedir ve nasıl çalışır? 3,8 milyarını saydık
Token bir kelimenin parçasıdır ve Claude bunların dört türünü sayar: girdi, önbellek yazmaları, önbellek okumaları ve çıktı. Kendi Claude Code oturumlarımızın 30 gününü saydık, 3,8 milyar token: %98'i önbellekten yeniden okunan konuşmaydı, %0,3'ü Claude'un yazdıklarıydı. Her türün maliyeti, bir oturumun neden her turda ağırlaştığı ve 5 saatlik pencerenin neyi ölçtüğü.
Bu kelimeyle Claude'un etrafında her yerde karşılaşırsın: fiyat listesinde, limit mesajında, /usage içinde, tasarruf üzerine yazılmış her makalede. Neredeyse kimse token'ın ne olduğunu söylemiyor ve insanların baktığı sayı nadiren önemli olan sayı. Claude'un karşılık olarak yazdığı kısım, bir kodlama oturumunun saydığı şeyin yüzde birinin bir kesri kadar.
Biz de kendi token'larımızı saydık. Tek bir Mac'te, 10 Eylül ile 9 Ekim 2026 arasında otuz günlük Claude Code oturumları: 388 oturum, modele 19.668 istek, 3,8 milyar token. İşte token'ın ne olduğu, Claude'un onları saydığı dört yol ve bu sayıların gerçek bir iş üzerinde nasıl göründüğü.
Token bir metin parçasıdır ve parçanın boyutu değişir
Bir model ne harfleri ne de kelimeleri okur. Token'ları okur: sabit bir sözlükten gelen metin parçaları, bazen kısa bir kelimenin tamamı, çoğu zaman bir kelimenin bir kısmı, hiç görmediği bir şey için bazen tek bir karakter ya da bayt. Her şey bu parçalarla sayılır: gönderdiğin şey, Claude'un yazdığı şey, turlar arasında tuttuğu şey.
Bir token'a ne kadar metin sığdığı modele ve dile bağlıdır. Anthropic'in sözlüğü, Claude 4.7 öncesi modellerde token başına yaklaşık 3,5 İngilizce karakter veriyor ve Claude 4.7 ve sonrasının aynı metin için yaklaşık %30 daha fazla token üreten yeni bir tokenizer kullandığını söylüyor. Kesin sayı yalnızca kullanmayı düşündüğün modelle birlikte token sayma uç noktasından çıkar.
Oranı kendi metnimiz üzerinde ölçtük. Ajanlarımız Fransızca yanıt veriyor, bu yüzden yalnızca düz metinden oluşan, düşünme, araç çağrısı ve kod bloğu içermeyen, en az 80 kelimelik yanıtları aldık: Opus 5, Opus 5.5, Fable 5.1 ve Sonnet 5.5 arasında dağılan 296 yanıt. Medyan: token başına 2,3 karakter, kelime başına yaklaşık 2,6 token. Kod, JSON ve Latin olmayan yazı sistemleri başka oranlar verir. Mesele kesin rakam değil: bir token bir kelimeden küçüktür ve onları asla elle saymazsın.
Her istek dört sayaçta sayılır
Claude Code her oturumu ~/.claude/projects/ altında bir JSONL transkriptine yazar. Modelin her yanıtı bir usage bloğu taşır. İşte transkriptlerimizden gerçek bir örnek, işe yarayan alanlar bırakılmış hâliyle:
"usage": {
"input_tokens": 2,
"cache_creation_input_tokens": 51836,
"cache_read_input_tokens": 24882,
"output_tokens": 315,
"output_tokens_details": { "thinking_tokens": 54 },
"cache_creation": {
"ephemeral_1h_input_tokens": 51836,
"ephemeral_5m_input_tokens": 0
}
}
Dört sayaç var ve aynı maliyette değiller:
input_tokens: prompt'un önbelleğe ne yazılan ne de önbellekten okunan kısmı, temel girdi fiyatından faturalandırılır. Claude Code'da bu neredeyse her zaman bir avuç token'dır, çünkü neredeyse her şey önbellekten geçer.cache_creation_input_tokens: bir sonraki isteğin yeniden kullanabilmesi için önbelleğe kaydedilen prompt kısmı. Bir önbellek yazması, 5 dakikalık önbellek için girdi fiyatının 1,25 katı, 1 saatlik önbellek için 2 katıdır. Transkriptlerimizde yazmaların %97'si 1 saatlik türdendi.cache_read_input_tokens: prompt'un önbellekten yeniden oynatılan kısmı. Bir önbellek okuması çoğu modelde girdi fiyatının 0,1 katı, Opus 5.5 ve Sonnet 5.5'te 0,05 katı ve Fable 5.1'de 0,025 katıdır (Anthropic'in prompt önbellekleme sayfası, 10 Ekim 2026'da kontrol edildi).output_tokens: Claude'un yazdığı şey, düşünme dahil. Çıktı, güncel tüm modellerde girdi fiyatının 5 katıdır: Opus 5.5'te milyon başına 20 dolar, Opus 5'te 25, Fable 5.1'de 50, Sonnet 5.5'te 10.
İlk üçünün toplamı, modelin bu istek için okuduğu bağlamı verir. Dördüncüsü yanıttır.
30 günlük oturumlarımız nasıl görünüyor
19.668 istek üzerinde, her istek bir kez sayılarak (tek bir API çağrısı bir transkriptin birden çok satırına yayılabilir):
| Sayaç | Token | Token payı | API liste fiyatlarıyla maliyet payı |
|---|---|---|---|
| Girdi (önbelleksiz) | 114.411 | %0,003 | %0,04 |
| Önbellek yazmaları | 74.834.070 | %2,0 | %37,4 |
| Önbellek okumaları | 3.710.054.709 | %97,7 | %45,7 |
| Çıktı | 12.727.193 | %0,34 | %16,8 |
| Toplam | 3.797.730.383 | %100 | 2.563 dolar |
Maliyet sütunu her isteği kendi modeli ve kendi önbellek süresiyle fiyatlandırır. Bu tutarı biz ödemiyoruz: bu oturumlar bir abonelik üzerinde çalıştı. Bu, her sayacın ağırlığıdır; AgentsRoom'un bir planın yüzdesini projeler arasında paylaştırmak için kullandığı ağırlıklandırmanın aynısı.
Üç okuma.
Neredeyse her token yeniden okunan konuşmadır. Token'ların %97,7'si önbellek okuması. İsteklerin %99,2'si önbellekten bir şey okuyor. İnsanlar bir oturumun "50 milyon token kullandığını" söylediğinde baktıkları şey bu.
Claude'un yazdığı şey token olarak küçük, maliyet olarak küçük değil. Token'ların %0,34'ü, faturanın %16,8'i, çünkü çıktı var olan en pahalı token. Bu çıktının %29'u düşünmeydi.
Önbellek yazmaları pahalı sürpriz. Token'ların %2'si, maliyetin %37'si. Önbelleğin süresinin dolmasından kaynaklandıklarını sanıyorduk, ama 19.668 istekten yalnızca 16'sı soğuk bir bağlamı yeniden yazmak zorunda kaldı, bunların yedisi bir saatten uzun bir sessizlikten sonra. Yazmaların %79'u basitçe her yeni mesajın ve her araç sonucunun, sonraki her turda yeniden okunmadan önce girdi fiyatının iki katına bir kez kaydedilmesi. Kalan %20 her oturumun ilk isteği.
Bir oturum neden her turda ağırlaşır
Model iki istek arasında hiçbir şey tutmaz. Claude Code her seferinde her şeyi yeniden gönderir: sistem prompt'u, araç tanımları, CLAUDE.md, her mesaj, okuduğu her dosya, her komut çıktısı. Önbellek tekrarlanan kısmı token başına ucuz yapar, bedava yapmaz, küçültmez de.
Oturumdaki konuma göre istek başına okunan medyan bağlam:
| Oturumdaki istek | İstek | Medyan bağlam |
|---|---|---|
| 1. | 388 | 52.000 token |
| 2. ile 10. arası | 3.210 | 93.000 token |
| 11. ile 50. arası | 8.546 | 161.000 token |
| 51. ile 200. arası | 6.414 | 237.000 token |
| 200.'den sonra | 1.110 | 342.000 token |
Medyan istek, 290 token'lık yanıt yazmak için 179.000 token'lık bağlam okudu. Bir kodlama ajanındaki token'ların bütün hikâyesi bu oran: yanıt kısa, okuma uzun ve okuma oturumla birlikte büyüyor.
İlk isteğimiz ağır, kimse bir şey yazmadan önce 52.000 token, çünkü ajanlarımız uzun bir rol brifingi ve araç tanımları prompt'ta duran dört MCP sunucusuyla başlıyor. Boş bir klasördeki çıplak bir Claude Code oturumu çok daha aşağıdan başlar. /context, seninkinin ilk mesajdan önce ne taşıdığını gösterir.
Bir oturum ne kadar kullanır
En az üç istekten oluşan 380 oturum üzerinde:
- Medyanda 33 istek, ortadaki yarı için 16 ile 61 arası.
- Medyanda 27.000 çıktı token'ı, 12.000 ile 48.000 arası.
- Medyanda 5,4 milyon işlenmiş token, ortadaki yarı için 1,5 ile 10,7 milyon arası, bunun 5,1 milyonu önbellek okuması.
- Medyanda önbelleğe yazılan veya önbelleksiz gönderilen 181.000 token: gerçekten yeni olan kısım.
- Medyanda API liste fiyatlarıyla 4,55 dolar, ortadaki yarı için 1,81 ile 9,25 arası.
Yani "bir kodlama oturumu kaç token kullanır" sorusunun dürüst cevabı, yaklaşık bir ile on milyon arasında bir aralık ve bunun neredeyse tamamı yeniden okunan aynı bağlam. Bütün öğleden sonra tek bir uzun görev üzerinde çalışan bir oturum aralığın tepesinde durur; bir hatayı düzeltip duran bir oturum ise dibinde.
5 saatlik pencere ve hafta gerçekte neyi sayıyor
Pro veya Max planında asla bir token bakiyesi görmezsin. Anthropic'in yardım merkezi, iki planın da beş saatlik bir oturum limiti ve haftalık bir limiti olduğunu, bu limitlerin Claude ile Claude Code (IDE dahil) arasında paylaşıldığını ve Max planlarının Fable için ayrı bir haftalık limiti olduğunu söylüyor. Hiçbiri için token rakamı yayınlamıyor. /usage her pencerenin yüzdesini ve sıfırlanacağı saati gösterir.
Bu yüzdeyi neyin oynattığı, Anthropic'in kendi listesine göre: mesaj uzunluğu, ek boyutu, mevcut konuşmanın uzunluğu, araç kullanımı, model seçimi, çaba seviyesi ve çok adımlı görevler. Yukarıdaki tablolarla birlikte okunduğunda, bir kodlama oturumuna hâkim olan "mevcut konuşmanın uzunluğu": her istekte okunan bağlam elli istekte 52.000'den 237.000 token'a çıkıyor. Yardım merkezi ayrıca projelerde önbelleğe alınan içeriğin yeniden kullanıldığında limitlerinden daha az düştüğünü söylüyor; bu, bir önbellek okumasının fiyatıyla aynı fikir.
Anthropic'in token'ları bir pencerenin yüzdesine nasıl çevirdiğini bilmiyoruz ve bir dönüşüm uydurmayacağız. Verilerin söylediği şu: uzun bir oturumdaki geç bir istek, aynı soru için erken bir isteğin birkaç katı kadar sayılıyor.
Pratikte sayıyı ne değiştirir
Verilerimizdeki önem sırasına göre dört kaldıraç:
- İlgisiz görevler arasında
/clear. Anthropic bunu "hem kalite hem maliyet için en etkili tek kaldıraç" olarak tanımlıyor. Eski bir oturumdaki yeni bir görev, her istekte eski görevin bağlamının bedelini öder. - Uzun bir oturuma devam ederken
/compact. Geçmişi kısa bir özetle değiştirir, böylece sonraki istekler daha az okur. - Bağlama neyin girdiğine dikkat et. 20.000 token'lık bir dosya okuması veya komut çıktısı, girdi fiyatının iki katına bir kez yazılır, sonra oturum bitene kadar sonraki her istekte yeniden okunur. Dosyanın tamamı yerine ihtiyacın olan satırları okumak iki kez kazandırır.
- Model ve çaba. Çıktımızın %29'u düşünmeydi ve çıktı en pahalı token. Rutin işlerde daha düşük bir çaba seviyesi çıktıyı azaltır, daha ucuz bir model ise bütün fiyatları bir anda düşürür.
Verilerimizde önemli olmayan şey: bir oturumu boşta bırakmak. Claude Code'un transkriptlerimizde kullandığı 1 saatlik önbellekle, soğuk yeniden yazma 30 günde 16 kez gerçekleşti.
Daha az harcamanın başka yolları için Claude Code token maliyetlerini nasıl düşürürsün yazısına bak.
Kendininkileri say
Yukarıdaki tablo bağımlılığı olmayan bir betikten çıkıyor. Makinedeki tüm Claude Code transkriptlerini okur, her isteği bir kez sayar ve dört sayacı ve oturum medyanlarını yazdırır. Bir zaman aralığı istersen o["timestamp"] üzerine bir filtre ekle.
import json, glob, os, statistics as st
from collections import defaultdict
FIELDS = ("input_tokens", "cache_creation_input_tokens",
"cache_read_input_tokens", "output_tokens")
totals, sessions = defaultdict(int), []
for path in glob.glob(os.path.expanduser("~/.claude/projects/*/*.jsonl")):
seen, session = set(), defaultdict(int)
with open(path, errors="ignore") as fh:
for line in fh:
try: o = json.loads(line)
except ValueError: continue
msg = o.get("message") or {}
usage = msg.get("usage") if isinstance(msg, dict) else None
if o.get("type") != "assistant" or not usage: continue
rid = o.get("requestId") or o.get("uuid")
if rid in seen: continue # one API call can span several lines
seen.add(rid)
session["requests"] += 1
for f in FIELDS:
n = usage.get(f) or 0
totals[f] += n
session[f] += n
if session["requests"] >= 3: sessions.append(session)
grand = sum(totals[f] for f in FIELDS)
for f in FIELDS:
print(f"{f:30s} {totals[f]:>15,} {100 * totals[f] / grand:6.2f}%")
for key in ("requests", "output_tokens", "cache_read_input_tokens"):
print(f"median per session, {key}: {st.median(s[key] for s in sessions):,.0f}")
Kendi paylarını bizimkilerle karşılaştır. Önbellek okuma satırı yeniden okunan konuşma, önbellek yazma satırı ise yeni olan şey: bu ikisi faturan hakkında çıktı satırından daha fazlasını söyler.
AgentsRoom bunu nerede gösteriyor
Betik sana bir ay verir. Sen çalışırken AgentsRoom aynı sayaçları ajan başına gösterir: bir oturum ağırlaştığında kırmızıya dönen her oturumun yazma alanında bir token rozeti, girdi, çıktı, önbellek yazmaları, önbellek okumaları ve önbellek isabet oranıyla bir oturum monitörü, ve hangi dosya okumasının ya da hangi araç sonucunun bağlamı doldurduğunu göstermek için oturumu tur tur yeniden oynatan bir oturum izi. Kullanım paneli, planının bildirdiği yüzdeyi projelerin ve ajanların arasında paylaştırır; her oturumu API fiyatlarıyla ne tutacağına göre ağırlıklandırır, yukarıdaki tabloyla aynı ağırlıklandırma.
Bunların hiçbirinin sana vermediği şey bir token bakiyesi, çünkü planının böyle bir bakiyesi yok. Bu soru için Claude'da kaç token'ın kaldığı yazısına bak. Bu çıktı token'larının hangi hızla geldiği için ölçülmüş hâliyle Claude Code'un saniyedeki token sayısı yazısına bak.
Sık sorulan sorular
Claude'da token nedir?
Claude'un metni okuduğu ve yazdığı birim: bir kelimenin parçası, bazen kısa bir kelimenin tamamı, bazen tek bir karakter ya da bayt. Anthropic, boyutun modele ve dile bağlı olduğunu belirtiyor: Claude 4.7 öncesi modellerde bir token yaklaşık 3,5 İngilizce karakterdi, Claude 4.7 ve sonrası ise aynı metin için yaklaşık %30 daha fazla token üreten yeni bir tokenizer kullanıyor. Claude'un yaptığı her şey token cinsinden ölçülür: gönderdiğin şey, karşılığında yazdığı şey ve turlar arasında önbelleğinde tuttuğu şey.
Bir Claude token'ı kaç karakter veya kaç kelimedir?
Dile ve metne bağlı. Anthropic, Claude 4.7 öncesi modellerde token başına yaklaşık 3,5 İngilizce karakter, Claude 4.7 ve sonrasında ise aynı metin için yaklaşık %30 daha fazla token veriyor. Ajanlarımızın Eylül ve Ekim 2026'da Fransızca yazdığı 296 düz metin yanıtta bir token 2,3 karakterdi, yani kelime başına yaklaşık 2,6 token. Kod, JSON ve Latin olmayan yazı sistemleri başka oranlar verir. Kesin bir sayım için Anthropic'in token sayma uç noktası metni ve modeli alır.
Claude Code neden bu kadar çok token kullanıyor?
Çünkü her istek konuşmanın tamamını yeniden gönderir: sistem prompt'u, araç tanımları, CLAUDE.md, o ana kadarki her mesaj ve her araç sonucu. 19.668 isteğimizde medyan istek 290 token'lık yanıt yazmak için 179.000 token'lık bağlam taşıdı ve bağlam, bir oturumun ilk isteğindeki 52.000 token'dan elli istek sonra 237.000'e çıktı. Önbellek bu yeniden okumayı token başına ucuzlatır, ama yine de sayılır.
Tipik bir Claude Code oturumu kaç token kullanır?
10 Eylül ile 9 Ekim 2026 arasında kaydedilen, üç veya daha fazla istekten oluşan 380 oturumumuzda: medyanda 33 istek, 27.000 çıktı token'ı ve toplamda 5,4 milyon işlenmiş token, bunun 5,1 milyonu önbellek okuması. Oturumların yarısı 1,5 ile 10,7 milyon token arasında kaldı. API liste fiyatlarıyla bu medyan oturum yaklaşık 4,55 dolar tutardı; Pro veya Max planında ise aynı iş bunun yerine 5 saatlik ve haftalık pencerelerden düşülür.
Düşünme token'ları sayılıyor mu?
Evet. Düşünme token'ları her usage bloğunda output_tokens içinde yer alır ve thinking_tokens alanı çıktının ne kadarının düşünme olduğunu söyler. API'de çıktı fiyatından faturalandırılırlar ve Anthropic, çaba seviyesini bir planın kullanım limitlerini daha hızlı tüketen şeyler arasında sayar. Derlemimizde düşünme, modellerin yazdığı her şeyin %29'uydu.
Önbellek yazma ve önbellek okuma token'ları arasındaki fark nedir?
Önbellek yazması, bir sonraki isteğin yeniden kullanabilmesi için prompt'un bir kısmını saklar ve düz girdiden daha pahalıdır: 5 dakikalık önbellek için girdi fiyatının 1,25 katı, 1 saatlik önbellek için 2 katı. Önbellek okuması bu saklanan kısmı yeniden kullanır ve çok daha ucuzdur: çoğu modelde girdi fiyatının 0,1 katı, Opus 5.5 ve Sonnet 5.5'te 0,05 katı, Fable 5.1'de 0,025 katı. Oturumlarımızda önbellek okumaları token'ların %98'ini ve liste fiyatlarıyla maliyetin %46'sını oluşturdu; önbellek yazmaları token'ların %2'sini ve maliyetin %37'sini.
AgentsRoom'u İndirin
Tüm yapay zeka ajanlarınızı, tüm projelerinizde, tek bir pencereden çalıştırın.
Yardımcı uygulama: hareket halindeyken ajanlarınızı izleyin
Claude, Codex, Antigravity CLI veya başka bir AI sağlayıcı kullan.
Hataları ve istekleri doğrudan genel backlogunuza gönderin.
Okumaya devam et
Claude'da kaç token kaldı? Bakmanız gereken iki ekran.
Claude aboneliğiniz token cinsinden tanımlanmıyor, bu yüzden hiçbir ekran size bir token bakiyesi göstermez. İşte gerçekte neyi ölçtüğü, onu gerçekten gösteren iki ekran, siz yazmazken neden azaldığı ve Eylül 2026'daki haftalık pencere değişikliğinin haftanıza ne yaptığı.
Makaleyi okuClaude Code aynı anda tek bir oturum açık tutar: birden fazlasını nasıl çalıştırırsınız
Aynı makinede bir iş hesabı ile kişisel bir hesabı birlikte çalıştırmak için saha rehberi: hangi oturumun aktif olduğuna karar veren tek ortam değişkeni, ikiden fazla terminaliniz olduğunda shell yaklaşımının neden bozulduğu ve proje başına hesap sabitlemenin nasıl yapıldığı.
Makaleyi okuSSH bağlantısı koptuktan sonra Claude Code'u çalışır tutmak: tmux tarifi
SSH bağlantısı koptuktan sonra Claude Code'u tmux ile çalışır tutun. Aynı sürece yeniden bağlanın, kalıcılığı kontrol edin ve AgentsRoom'un isteğe bağlı ayarını kullanın.
Makaleyi oku