โทเค็นใน Claude คืออะไร และทำงานอย่างไร เรานับมาแล้ว 3.8 พันล้านโทเค็น
โทเค็นคือชิ้นส่วนของคำ และ Claude นับโทเค็นสี่ประเภท ได้แก่ อินพุต การเขียนแคช การอ่านแคช และเอาต์พุต เรานับเซสชัน Claude Code ของเราเองตลอด 30 วัน รวม 3.8 พันล้านโทเค็น: 98% คือบทสนทนาที่ถูกอ่านซ้ำจากแคช และ 0.3% คือสิ่งที่ Claude เขียน แต่ละประเภทมีราคาเท่าไร ทำไมเซสชันจึงหนักขึ้นทุกรอบ และช่วงเวลา 5 ชั่วโมงวัดอะไร
คุณเจอคำนี้ได้ทุกที่รอบตัว Claude: ในตารางราคา ในข้อความแจ้งขีดจำกัด ใน /usage และในทุกบทความที่สอนวิธีประหยัดเงิน แทบไม่มีใครบอกว่าโทเค็นคืออะไร และตัวเลขที่คนส่วนใหญ่ดูก็ไม่ค่อยใช่ตัวเลขที่สำคัญ ส่วนที่ Claude เขียนตอบกลับมีสัดส่วนเพียงเศษเสี้ยวของหนึ่งเปอร์เซ็นต์ของสิ่งที่เซสชันเขียนโค้ดนับ
เราจึงนับของเราเอง เซสชัน Claude Code ตลอดสามสิบวันบน Mac เครื่องเดียว ตั้งแต่วันที่ 10 กันยายนถึง 9 ตุลาคม 2026: 388 เซสชัน 19,668 คำขอไปยังโมเดล และ 3.8 พันล้านโทเค็น บทความนี้อธิบายว่าโทเค็นคืออะไร Claude นับโทเค็นด้วยวิธีใดบ้างทั้งสี่แบบ และตัวเลขเหล่านั้นหน้าตาเป็นอย่างไรในงานจริง
โทเค็นคือชิ้นส่วนของข้อความ และขนาดของชิ้นส่วนนั้นไม่คงที่
โมเดลไม่ได้อ่านตัวอักษรหรือคำ มันอ่านโทเค็น: ชิ้นส่วนของข้อความจากคลังคำศัพท์ที่ตายตัว บางครั้งเป็นคำสั้น ๆ ทั้งคำ บ่อยครั้งเป็นส่วนหนึ่งของคำ บางครั้งเป็นอักขระเดียวหรือไบต์เดียวสำหรับสิ่งที่มันไม่เคยเห็นมาก่อน ทุกอย่างถูกนับเป็นชิ้นส่วนเหล่านี้: สิ่งที่คุณส่งไป สิ่งที่ Claude เขียน และสิ่งที่มันเก็บไว้ระหว่างแต่ละรอบ
ปริมาณข้อความที่บรรจุในหนึ่งโทเค็นขึ้นอยู่กับโมเดลและภาษา อภิธานศัพท์ของ Anthropic ให้ตัวเลขราว 3.5 อักขระภาษาอังกฤษต่อโทเค็นในโมเดลก่อน Claude 4.7 และระบุว่า Claude 4.7 ขึ้นไปใช้ tokenizer รุ่นใหม่ที่สร้างโทเค็นมากขึ้นราว 30% สำหรับข้อความเดียวกัน จำนวนที่แน่นอนได้มาจาก endpoint นับโทเค็น เท่านั้น โดยระบุโมเดลที่คุณตั้งใจจะใช้
เราวัดอัตราส่วนนี้กับข้อความของเราเอง เอเจนต์ของเราตอบเป็นภาษาฝรั่งเศส เราจึงเลือกเฉพาะคำตอบที่เป็นข้อความล้วน ไม่มีการคิด ไม่มีการเรียกใช้เครื่องมือ ไม่มีบล็อกโค้ด และยาวอย่างน้อย 80 คำ: ได้ 296 คำตอบจาก Opus 5, Opus 5.5, Fable 5.1 และ Sonnet 5.5 ค่ามัธยฐานอยู่ที่ 2.3 อักขระต่อโทเค็น หรือประมาณ 2.6 โทเค็นต่อคำ โค้ด JSON และอักษรที่ไม่ใช่อักษรละตินให้อัตราส่วนที่ต่างออกไป ประเด็นไม่ได้อยู่ที่ตัวเลขที่แน่นอน: โทเค็นเล็กกว่าคำ และคุณไม่มีทางนับมันด้วยมือ
ทุกคำขอถูกนับด้วยตัวนับสี่ตัว
Claude Code เขียนทุกเซสชันลงในทรานสคริปต์ JSONL ใต้ ~/.claude/projects/ ทุกคำตอบจากโมเดลมีบล็อก usage แนบมาด้วย นี่คือตัวอย่างจริงจากทรานสคริปต์ของเรา โดยเก็บไว้เฉพาะฟิลด์ที่มีประโยชน์:
"usage": {
"input_tokens": 2,
"cache_creation_input_tokens": 51836,
"cache_read_input_tokens": 24882,
"output_tokens": 315,
"output_tokens_details": { "thinking_tokens": 54 },
"cache_creation": {
"ephemeral_1h_input_tokens": 51836,
"ephemeral_5m_input_tokens": 0
}
}
ตัวนับสี่ตัว และแต่ละตัวมีราคาไม่เท่ากัน:
input_tokens: ส่วนของพรอมต์ที่ไม่ได้ถูกเขียนลงแคชและไม่ได้ถูกอ่านจากแคช คิดราคาตามราคาอินพุตพื้นฐาน ใน Claude Code ส่วนนี้แทบจะเป็นแค่ไม่กี่โทเค็นเสมอ เพราะเกือบทุกอย่างผ่านแคชcache_creation_input_tokens: ส่วนของพรอมต์ที่ถูกเก็บลงแคชเพื่อให้คำขอถัดไปนำกลับมาใช้ได้ การเขียนแคชมีราคา 1.25 เท่าของราคาอินพุตสำหรับแคช 5 นาที และ 2 เท่าสำหรับแคช 1 ชั่วโมง ในทรานสคริปต์ของเรา 97% ของการเขียนเป็นแคชแบบ 1 ชั่วโมงcache_read_input_tokens: ส่วนของพรอมต์ที่ถูกเล่นซ้ำจากแคช การอ่านแคชมีราคา 0.1 เท่าของราคาอินพุตในโมเดลส่วนใหญ่ 0.05 เท่าใน Opus 5.5 และ Sonnet 5.5 และ 0.025 เท่าใน Fable 5.1 (หน้า prompt caching ของ Anthropic ตรวจสอบเมื่อวันที่ 10 ตุลาคม 2026)output_tokens: สิ่งที่ Claude เขียน รวมถึงการคิด เอาต์พุตมีราคา 5 เท่าของราคาอินพุตในทุกโมเดลปัจจุบัน: 20 ดอลลาร์ต่อล้านโทเค็นใน Opus 5.5, 25 ใน Opus 5, 50 ใน Fable 5.1 และ 10 ใน Sonnet 5.5
สามตัวแรกรวมกันคือบริบทที่โมเดลอ่านสำหรับคำขอนี้ ตัวที่สี่คือคำตอบ
เซสชันของเราตลอด 30 วันมีหน้าตาเป็นอย่างไร
จากทั้งหมด 19,668 คำขอ นับคำขอละหนึ่งครั้ง (การเรียก API หนึ่งครั้งอาจกินพื้นที่หลายบรรทัดในทรานสคริปต์):
| ตัวนับ | โทเค็น | สัดส่วนของโทเค็น | สัดส่วนของต้นทุนตามราคามาตรฐานของ API |
|---|---|---|---|
| อินพุต (ไม่ผ่านแคช) | 114,411 | 0.003% | 0.04% |
| การเขียนแคช | 74,834,070 | 2.0% | 37.4% |
| การอ่านแคช | 3,710,054,709 | 97.7% | 45.7% |
| เอาต์พุต | 12,727,193 | 0.34% | 16.8% |
| รวม | 3,797,730,383 | 100% | 2,563 ดอลลาร์ |
คอลัมน์ต้นทุนคำนวณราคาของแต่ละคำขอตามโมเดลและระยะเวลาแคชของคำขอนั้นเอง เราไม่ได้จ่ายเงินจำนวนนี้ เพราะเซสชันเหล่านี้ทำงานบนแพ็กเกจสมาชิก ตัวเลขนี้คือน้ำหนักของตัวนับแต่ละตัว ซึ่งเป็นการถ่วงน้ำหนักแบบเดียวกับที่ AgentsRoom ใช้แบ่งเปอร์เซ็นต์ของแพ็กเกจให้แต่ละโปรเจกต์
อ่านได้สามประเด็น
เกือบทุกโทเค็นคือบทสนทนาที่ถูกอ่านซ้ำ 97.7% ของโทเค็นเป็นการอ่านแคช 99.2% ของคำขออ่านบางอย่างจากแคช เวลาที่มีคนบอกว่าเซสชันหนึ่ง "ใช้ไป 50 ล้านโทเค็น" สิ่งที่เขากำลังดูอยู่ก็คือส่วนนี้
สิ่งที่ Claude เขียนมีจำนวนโทเค็นน้อยมาก แต่ต้นทุนไม่ได้น้อยเลย 0.34% ของโทเค็น แต่ 16.8% ของบิล เพราะเอาต์พุตคือโทเค็นที่แพงที่สุด การคิดมีสัดส่วน 29% ของเอาต์พุตนั้น
การเขียนแคชคือเรื่องที่แพงเกินคาด 2% ของโทเค็น แต่ 37% ของต้นทุน เราคิดว่ามันเกิดจากแคชหมดอายุ แต่มีเพียง 16 คำขอจาก 19,668 ที่ต้องเขียนบริบทที่เย็นลงแล้วใหม่ทั้งหมด และเจ็ดครั้งในนั้นเกิดหลังจากเงียบไปนานกว่าหนึ่งชั่วโมง 79% ของการเขียนเป็นเพียงข้อความใหม่แต่ละข้อความและผลลัพธ์จากเครื่องมือแต่ละรายการที่ถูกเก็บหนึ่งครั้งในราคาสองเท่าของราคาอินพุต ก่อนจะถูกอ่านซ้ำในทุกรอบถัดไป อีก 20% คือคำขอแรกของแต่ละเซสชัน
ทำไมเซสชันจึงหนักขึ้นทุกรอบ
โมเดลไม่เก็บอะไรไว้เลยระหว่างสองคำขอ Claude Code ส่งทุกอย่างไปใหม่ทุกครั้ง: พรอมต์ระบบ คำจำกัดความของเครื่องมือ CLAUDE.md ทุกข้อความ ทุกไฟล์ที่มันอ่าน และทุกเอาต์พุตของคำสั่ง แคชทำให้ส่วนที่ซ้ำถูกลงต่อโทเค็น แต่ไม่ได้ฟรี และไม่ได้เล็กลง
ค่ามัธยฐานของบริบทที่อ่านต่อคำขอ ตามตำแหน่งในเซสชัน:
| คำขอในเซสชัน | จำนวนคำขอ | บริบทค่ามัธยฐาน |
|---|---|---|
| คำขอที่ 1 | 388 | 52,000 โทเค็น |
| ที่ 2 ถึง 10 | 3,210 | 93,000 โทเค็น |
| ที่ 11 ถึง 50 | 8,546 | 161,000 โทเค็น |
| ที่ 51 ถึง 200 | 6,414 | 237,000 โทเค็น |
| หลังคำขอที่ 200 | 1,110 | 342,000 โทเค็น |
คำขอที่เป็นค่ามัธยฐานอ่านบริบท 179,000 โทเค็นเพื่อเขียนคำตอบ 290 โทเค็น อัตราส่วนนี้คือเรื่องราวทั้งหมดของโทเค็นในเอเจนต์เขียนโค้ด: คำตอบสั้น การอ่านยาว และการอ่านยิ่งยาวขึ้นตามอายุของเซสชัน
คำขอแรกของเราหนัก 52,000 โทเค็นก่อนที่ใครจะพิมพ์อะไรเลย เพราะเอเจนต์ของเราเริ่มต้นด้วยคำอธิบายบทบาทที่ยาว และเซิร์ฟเวอร์ MCP สี่ตัวที่คำจำกัดความของเครื่องมืออยู่ในพรอมต์ เซสชัน Claude Code เปล่า ๆ ในโฟลเดอร์ว่างเริ่มต้นที่ระดับต่ำกว่านี้มาก /context จะแสดงว่าเซสชันของคุณแบกอะไรอยู่ก่อนข้อความแรก
หนึ่งเซสชันใช้อะไรไปบ้าง
จาก 380 เซสชันที่มีอย่างน้อยสามคำขอ:
- 33 คำขอ ที่ค่ามัธยฐาน และ 16 ถึง 61 สำหรับครึ่งกลาง
- โทเค็นเอาต์พุต 27,000 โทเค็น ที่ค่ามัธยฐาน ตั้งแต่ 12,000 ถึง 48,000
- โทเค็นที่ประมวลผล 5.4 ล้านโทเค็น ที่ค่ามัธยฐาน และ 1.5 ถึง 10.7 ล้านสำหรับครึ่งกลาง ซึ่ง 5.1 ล้านเป็นการอ่านแคช
- 181,000 โทเค็น ที่ถูกเขียนลงแคชหรือส่งโดยไม่ผ่านแคชที่ค่ามัธยฐาน: ส่วนที่เป็นของใหม่จริง ๆ
- 4.55 ดอลลาร์ ตามราคามาตรฐานของ API ที่ค่ามัธยฐาน และ 1.81 ถึง 9.25 สำหรับครึ่งกลาง
ดังนั้นคำตอบตรง ๆ สำหรับคำถามว่า "เซสชันเขียนโค้ดหนึ่งเซสชันใช้กี่โทเค็น" คือช่วงประมาณหนึ่งถึงสิบล้าน ซึ่งเกือบทั้งหมดเป็นบริบทเดิมที่ถูกอ่านซ้ำ เซสชันที่ทำงานตลอดบ่ายกับงานยาวงานเดียวจะอยู่ด้านบนของช่วงนี้ ส่วนเซสชันที่แก้บั๊กหนึ่งตัวแล้วหยุดจะอยู่ด้านล่าง
ช่วงเวลา 5 ชั่วโมงและรายสัปดาห์นับอะไรจริง ๆ
บนแพ็กเกจ Pro หรือ Max คุณจะไม่เห็นยอดโทเค็นคงเหลือเลย ศูนย์ช่วยเหลือของ Anthropic ระบุว่าทั้งสองแพ็กเกจมีขีดจำกัดเซสชันห้าชั่วโมงและขีดจำกัดรายสัปดาห์ ขีดจำกัดเหล่านี้ใช้ร่วมกันระหว่าง Claude และ Claude Code (รวมถึง IDE) และแพ็กเกจ Max มีขีดจำกัดรายสัปดาห์แยกต่างหากสำหรับ Fable โดยไม่ได้เผยแพร่ตัวเลขโทเค็นของขีดจำกัดใดเลย /usage แสดงเปอร์เซ็นต์ของแต่ละช่วงเวลา และเวลาที่ช่วงเวลานั้นจะรีเซ็ต
สิ่งที่ทำให้เปอร์เซ็นต์นั้นขยับ ตามรายการของ Anthropic เอง ได้แก่ ความยาวของข้อความ ขนาดไฟล์แนบ ความยาวของบทสนทนาปัจจุบัน การใช้เครื่องมือ การเลือกโมเดล ระดับความพยายาม และงานที่มีหลายขั้นตอน เมื่ออ่านคู่กับตารางด้านบน "ความยาวของบทสนทนาปัจจุบัน" คือปัจจัยที่ครอบงำเซสชันเขียนโค้ด: บริบทที่อ่านในแต่ละคำขอเพิ่มจาก 52,000 เป็น 237,000 โทเค็นภายในห้าสิบคำขอ ศูนย์ช่วยเหลือยังระบุด้วยว่าเนื้อหาที่แคชไว้ในโปรเจกต์จะถูกนับเข้าขีดจำกัดน้อยลงเมื่อถูกนำกลับมาใช้ ซึ่งเป็นแนวคิดเดียวกับราคาของการอ่านแคช
เราไม่รู้ว่า Anthropic แปลงโทเค็นเป็นเปอร์เซ็นต์ของช่วงเวลาอย่างไร และเราจะไม่แต่งสูตรแปลงขึ้นมาเอง สิ่งที่ข้อมูลบอกได้คือ คำขอช่วงท้ายในเซสชันยาวถูกนับมากกว่าคำขอช่วงต้นหลายเท่า สำหรับคำถามเดียวกัน
สิ่งที่เปลี่ยนจำนวนที่ถูกนับ ในทางปฏิบัติ
คันโยกสี่ตัว เรียงตามลำดับความสำคัญในข้อมูลของเรา:
/clearระหว่างงานที่ไม่เกี่ยวข้องกัน Anthropic เรียกมันว่า "คันโยกที่ได้ผลที่สุดเพียงหนึ่งเดียว ทั้งด้านคุณภาพและต้นทุน" งานใหม่ในเซสชันเก่าต้องจ่ายค่าบริบทของงานเก่าในทุกคำขอ/compactเมื่อคุณทำงานต่อในเซสชันที่ยาว คำสั่งนี้แทนที่ประวัติด้วยบทสรุปสั้น ๆ คำขอถัดไปจึงอ่านน้อยลง- ระวังสิ่งที่เข้าไปในบริบท การอ่านไฟล์หรือเอาต์พุตของคำสั่งขนาด 20,000 โทเค็นจะถูกเขียนหนึ่งครั้งในราคาสองเท่าของราคาอินพุต แล้วถูกอ่านซ้ำในทุกคำขอถัดไปจนกว่าเซสชันจะจบ การอ่านเฉพาะบรรทัดที่คุณต้องการแทนการอ่านทั้งไฟล์จึงคุ้มสองต่อ
- โมเดลและระดับความพยายาม การคิดมีสัดส่วน 29% ของเอาต์พุตของเรา และเอาต์พุตคือโทเค็นที่แพงที่สุด ระดับความพยายามที่ต่ำลงสำหรับงานประจำจะลดเอาต์พุต และโมเดลที่ถูกกว่าจะลดราคาทุกอย่างพร้อมกัน
สิ่งที่ไม่มีผลในข้อมูลของเรา: การปล่อยเซสชันทิ้งไว้เฉย ๆ ด้วยแคช 1 ชั่วโมงที่ Claude Code ใช้ในทรานสคริปต์ของเรา การเขียนใหม่จากแคชที่เย็นแล้วเกิดขึ้น 16 ครั้งใน 30 วัน
หากต้องการวิธีใช้จ่ายให้น้อยลงอีก อ่าน วิธีลดค่าโทเค็นของ Claude Code
นับของคุณเอง
ตารางด้านบนมาจากสคริปต์ที่ไม่ต้องติดตั้งอะไรเพิ่ม มันอ่านทรานสคริปต์ Claude Code ทั้งหมดบนเครื่อง นับแต่ละคำขอหนึ่งครั้ง แล้วพิมพ์ตัวนับทั้งสี่และค่ามัธยฐานต่อเซสชัน เพิ่มตัวกรองบน o["timestamp"] หากคุณต้องการช่วงเวลาเฉพาะ
import json, glob, os, statistics as st
from collections import defaultdict
FIELDS = ("input_tokens", "cache_creation_input_tokens",
"cache_read_input_tokens", "output_tokens")
totals, sessions = defaultdict(int), []
for path in glob.glob(os.path.expanduser("~/.claude/projects/*/*.jsonl")):
seen, session = set(), defaultdict(int)
with open(path, errors="ignore") as fh:
for line in fh:
try: o = json.loads(line)
except ValueError: continue
msg = o.get("message") or {}
usage = msg.get("usage") if isinstance(msg, dict) else None
if o.get("type") != "assistant" or not usage: continue
rid = o.get("requestId") or o.get("uuid")
if rid in seen: continue # one API call can span several lines
seen.add(rid)
session["requests"] += 1
for f in FIELDS:
n = usage.get(f) or 0
totals[f] += n
session[f] += n
if session["requests"] >= 3: sessions.append(session)
grand = sum(totals[f] for f in FIELDS)
for f in FIELDS:
print(f"{f:30s} {totals[f]:>15,} {100 * totals[f] / grand:6.2f}%")
for key in ("requests", "output_tokens", "cache_read_input_tokens"):
print(f"median per session, {key}: {st.median(s[key] for s in sessions):,.0f}")
เปรียบเทียบสัดส่วนของคุณกับของเรา บรรทัดการอ่านแคชคือบทสนทนาที่ถูกอ่านซ้ำ และบรรทัดการเขียนแคชคือสิ่งที่เป็นของใหม่: สองบรรทัดนี้บอกเรื่องบิลของคุณได้มากกว่าบรรทัดเอาต์พุต
AgentsRoom แสดงข้อมูลนี้ที่ไหน
สคริปต์ให้ภาพรวมทั้งเดือน ระหว่างที่คุณทำงาน AgentsRoom แสดงตัวนับชุดเดียวกันสำหรับแต่ละเอเจนต์: ป้ายโทเค็นในช่องพิมพ์ข้อความของทุกเซสชัน ที่เปลี่ยนเป็นสีแดงเมื่อเซสชันเริ่มหนัก ตัวติดตามเซสชันที่แสดงอินพุต เอาต์พุต การเขียนแคช การอ่านแคช และอัตราการใช้แคชสำเร็จ และร่องรอยเซสชันที่เล่นซ้ำเซสชันทีละรอบเพื่อแสดงว่าการอ่านไฟล์หรือผลลัพธ์จากเครื่องมือใดที่ทำให้บริบทเต็ม แผงการใช้งานจะแบ่งเปอร์เซ็นต์ที่แพ็กเกจของคุณรายงานให้กับโปรเจกต์และเอเจนต์ของคุณ โดยถ่วงน้ำหนักแต่ละเซสชันตามต้นทุนที่จะเกิดขึ้นในราคา API ซึ่งเป็นการถ่วงน้ำหนักแบบเดียวกับตารางด้านบน
สิ่งที่ไม่มีหน้าจอไหนให้คุณได้คือยอดโทเค็นคงเหลือ เพราะแพ็กเกจของคุณไม่มีสิ่งนั้น สำหรับคำถามนั้น อ่าน โทเค็นใน Claude ของคุณเหลืออยู่เท่าไหร่ และสำหรับความเร็วที่โทเค็นเอาต์พุตเหล่านั้นมาถึง อ่าน โทเค็นต่อวินาทีของ Claude Code จากการวัดจริง
คำถามที่พบบ่อย
โทเค็นใน Claude คืออะไร
หน่วยที่ Claude ใช้อ่านและเขียนข้อความ: ชิ้นส่วนของคำ บางครั้งเป็นคำสั้น ๆ ทั้งคำ บางครั้งเป็นอักขระเดียวหรือไบต์เดียว Anthropic ระบุว่าขนาดขึ้นอยู่กับโมเดลและภาษา: ในโมเดลก่อน Claude 4.7 หนึ่งโทเค็นยาวประมาณ 3.5 อักขระภาษาอังกฤษ และ Claude 4.7 ขึ้นไปใช้ tokenizer รุ่นใหม่ที่สร้างโทเค็นมากขึ้นราว 30% สำหรับข้อความเดียวกัน ทุกอย่างที่ Claude ทำถูกวัดเป็นโทเค็น: สิ่งที่คุณส่งไป สิ่งที่มันเขียนตอบกลับ และสิ่งที่มันเก็บไว้ในแคชระหว่างแต่ละรอบ
โทเค็นของ Claude หนึ่งโทเค็นเท่ากับกี่อักขระหรือกี่คำ
ขึ้นอยู่กับภาษาและตัวข้อความ Anthropic ให้ตัวเลขราว 3.5 อักขระภาษาอังกฤษต่อโทเค็นในโมเดลก่อน Claude 4.7 และโทเค็นมากขึ้นราว 30% สำหรับข้อความเดียวกันใน Claude 4.7 ขึ้นไป จากคำตอบที่เป็นข้อความล้วน 296 รายการที่เอเจนต์ของเราเขียนเป็นภาษาฝรั่งเศสในเดือนกันยายนและตุลาคม 2026 หนึ่งโทเค็นยาว 2.3 อักขระ หรือประมาณ 2.6 โทเค็นต่อคำ โค้ด JSON และอักษรที่ไม่ใช่อักษรละตินให้อัตราส่วนที่ต่างออกไป หากต้องการจำนวนที่แน่นอน endpoint นับโทเค็นของ Anthropic จะรับข้อความและโมเดลไปคำนวณให้
ทำไม Claude Code ถึงใช้โทเค็นเยอะขนาดนี้
เพราะทุกคำขอจะส่งบทสนทนาทั้งหมดไปใหม่: พรอมต์ระบบ คำจำกัดความของเครื่องมือ CLAUDE.md ทุกข้อความ และผลลัพธ์จากเครื่องมือทุกรายการจนถึงตอนนั้น จาก 19,668 คำขอของเรา คำขอที่เป็นค่ามัธยฐานแบกบริบท 179,000 โทเค็นเพื่อเขียนคำตอบ 290 โทเค็น และบริบทเพิ่มจาก 52,000 โทเค็นในคำขอแรกของเซสชันเป็น 237,000 หลังจากห้าสิบคำขอ แคชทำให้การอ่านซ้ำนั้นถูกลงต่อโทเค็น แต่ก็ยังถูกนับอยู่ดี
เซสชัน Claude Code ทั่วไปใช้โทเค็นเท่าไร
จาก 380 เซสชันของเราที่มีสามคำขอขึ้นไป ซึ่งบันทึกระหว่างวันที่ 10 กันยายนถึง 9 ตุลาคม 2026: ค่ามัธยฐานอยู่ที่ 33 คำขอ โทเค็นเอาต์พุต 27,000 โทเค็น และโทเค็นที่ประมวลผลรวม 5.4 ล้านโทเค็น ซึ่ง 5.1 ล้านเป็นการอ่านแคช ครึ่งหนึ่งของเซสชันอยู่ระหว่าง 1.5 ถึง 10.7 ล้านโทเค็น ตามราคามาตรฐานของ API เซสชันค่ามัธยฐานนี้จะมีค่าใช้จ่ายราว 4.55 ดอลลาร์ ส่วนในแพ็กเกจ Pro หรือ Max งานเดียวกันจะถูกนับเข้ากับช่วงเวลา 5 ชั่วโมงและช่วงเวลารายสัปดาห์แทน
โทเค็นการคิดถูกนับด้วยหรือไม่
ถูกนับ โทเค็นการคิดเป็นส่วนหนึ่งของ output_tokens ในทุกบล็อก usage โดยมีฟิลด์ thinking_tokens บอกว่าเอาต์พุตส่วนใดเป็นการคิด ใน API โทเค็นเหล่านี้คิดราคาเท่าเอาต์พุต และ Anthropic ระบุระดับความพยายามไว้ในรายการสิ่งที่ทำให้ขีดจำกัดการใช้งานของแพ็กเกจหมดเร็วขึ้น ในคลังข้อมูลของเรา การคิดมีสัดส่วน 29% ของทุกสิ่งที่โมเดลเขียน
การเขียนแคชกับการอ่านแคชต่างกันอย่างไร
การเขียนแคชจะเก็บส่วนหนึ่งของพรอมต์ไว้เพื่อให้คำขอถัดไปนำกลับมาใช้ได้ และมีราคาสูงกว่าอินพุตปกติ: 1.25 เท่าของราคาอินพุตสำหรับแคช 5 นาที และ 2 เท่าสำหรับแคช 1 ชั่วโมง การอ่านแคชจะนำส่วนที่เก็บไว้นั้นกลับมาใช้และมีราคาต่ำกว่ามาก: 0.1 เท่าของราคาอินพุตในโมเดลส่วนใหญ่ 0.05 เท่าใน Opus 5.5 และ Sonnet 5.5 และ 0.025 เท่าใน Fable 5.1 ในเซสชันของเรา การอ่านแคชคิดเป็น 98% ของโทเค็นและ 46% ของต้นทุนตามราคามาตรฐาน ส่วนการเขียนแคชคิดเป็น 2% ของโทเค็นและ 37% ของต้นทุน
ดาวน์โหลด AgentsRoom
รันเอเจนต์ AI ทั้งหมดของคุณในทุกโปรเจกต์ จากหน้าต่างเดียว
แอปคู่หู: ตรวจสอบเอเจนต์ของคุณได้ทุกที่
นำของคุณเอง: Claude, Codex, Antigravity CLI, หรือผู้ให้บริการ AI อื่น ๆ
ส่งข้อบกพร่องและคำขอไปยังแบ็คล็อกสาธารณะของคุณโดยตรง
อ่านต่อ
แปลง PDF เป็น Markdown เพื่อประหยัด LLM Tokens: คู่มือ MarkItDown
การส่ง PDF ตรงไปยัง Claude หรือ LLM ใด ๆ จะเผาผลาญ tokens อย่างเงียบ ๆ: ทุกหน้าจะถูกแปลงเป็นภาพด้วยเช่นกัน แปลงไฟล์เป็น Markdown ก่อนด้วย MarkItDown เครื่องมือโอเพนซอร์สฟรีจากไมโครซอฟท์ และลดค่าใช้จ่าย tokens ของคุณได้ถึง 80% คู่มือเต็มรูปแบบพร้อม CLI, Python, และการตั้งค่า MCP.
อ่านบทความให้ Claude Code ทำงานต่อหลัง SSH หลุด: สูตร tmux
ให้ Claude Code ทำงานต่อหลัง SSH หลุดด้วย tmux กลับไปเชื่อมต่อกับโปรเซสเดิม ตรวจสอบว่าเซสชันคงอยู่จริง และใช้ตัวเลือกของ AgentsRoom ที่คุณต้องเปิดเอง
อ่านบทความClaude Code Routines: อะไรรันบนคลาวด์ อะไรอยู่บนเครื่องของคุณ และจะเลือกอย่างไร
Routines คือวิธีที่ Claude Code ใช้รันพรอมต์ที่บันทึกไว้โดยไม่ต้องมีคุณอยู่: ตามกำหนดเวลา เมื่อมีการเรียก API หรือเมื่อเกิดเหตุการณ์บน GitHub ในรูปแบบ cloud session บน clone ใหม่ของ repository ของคุณ ตอนนี้ยังอยู่ในสถานะ research preview Claude Code ยังมีวิธีจัดตารางงานในเครื่องอีกสองแบบ คืองานที่กำหนดเวลาของแอปเดสก์ท็อปและ /loop และทั้งสามแบบทำงานไม่เหมือนกัน: ช่วงห่างขั้นต่ำ การเข้าถึงไฟล์ในเครื่องของคุณ การขออนุญาต และสิ่งที่เกิดขึ้นเมื่อแล็ปท็อปเข้าสู่โหมดสลีป คู่มือนี้วางทั้งสามแบบเทียบกันพร้อมข้อจำกัดจากเอกสาร แล้วอธิบายว่าทำไมเอเจนต์เจ็ดตัวที่รันทุกคืนของเราจึงรันบนเครื่องในพื้นที่แทน
อ่านบทความ