โทเค็นใน Claude คืออะไร และทำงานอย่างไร เรานับมาแล้ว 3.8 พันล้านโทเค็น

โทเค็นคือชิ้นส่วนของคำ และ Claude นับโทเค็นสี่ประเภท ได้แก่ อินพุต การเขียนแคช การอ่านแคช และเอาต์พุต เรานับเซสชัน Claude Code ของเราเองตลอด 30 วัน รวม 3.8 พันล้านโทเค็น: 98% คือบทสนทนาที่ถูกอ่านซ้ำจากแคช และ 0.3% คือสิ่งที่ Claude เขียน แต่ละประเภทมีราคาเท่าไร ทำไมเซสชันจึงหนักขึ้นทุกรอบ และช่วงเวลา 5 ชั่วโมงวัดอะไร

คุณเจอคำนี้ได้ทุกที่รอบตัว Claude: ในตารางราคา ในข้อความแจ้งขีดจำกัด ใน /usage และในทุกบทความที่สอนวิธีประหยัดเงิน แทบไม่มีใครบอกว่าโทเค็นคืออะไร และตัวเลขที่คนส่วนใหญ่ดูก็ไม่ค่อยใช่ตัวเลขที่สำคัญ ส่วนที่ Claude เขียนตอบกลับมีสัดส่วนเพียงเศษเสี้ยวของหนึ่งเปอร์เซ็นต์ของสิ่งที่เซสชันเขียนโค้ดนับ

เราจึงนับของเราเอง เซสชัน Claude Code ตลอดสามสิบวันบน Mac เครื่องเดียว ตั้งแต่วันที่ 10 กันยายนถึง 9 ตุลาคม 2026: 388 เซสชัน 19,668 คำขอไปยังโมเดล และ 3.8 พันล้านโทเค็น บทความนี้อธิบายว่าโทเค็นคืออะไร Claude นับโทเค็นด้วยวิธีใดบ้างทั้งสี่แบบ และตัวเลขเหล่านั้นหน้าตาเป็นอย่างไรในงานจริง

โทเค็นคือชิ้นส่วนของข้อความ และขนาดของชิ้นส่วนนั้นไม่คงที่

โมเดลไม่ได้อ่านตัวอักษรหรือคำ มันอ่านโทเค็น: ชิ้นส่วนของข้อความจากคลังคำศัพท์ที่ตายตัว บางครั้งเป็นคำสั้น ๆ ทั้งคำ บ่อยครั้งเป็นส่วนหนึ่งของคำ บางครั้งเป็นอักขระเดียวหรือไบต์เดียวสำหรับสิ่งที่มันไม่เคยเห็นมาก่อน ทุกอย่างถูกนับเป็นชิ้นส่วนเหล่านี้: สิ่งที่คุณส่งไป สิ่งที่ Claude เขียน และสิ่งที่มันเก็บไว้ระหว่างแต่ละรอบ

ปริมาณข้อความที่บรรจุในหนึ่งโทเค็นขึ้นอยู่กับโมเดลและภาษา อภิธานศัพท์ของ Anthropic ให้ตัวเลขราว 3.5 อักขระภาษาอังกฤษต่อโทเค็นในโมเดลก่อน Claude 4.7 และระบุว่า Claude 4.7 ขึ้นไปใช้ tokenizer รุ่นใหม่ที่สร้างโทเค็นมากขึ้นราว 30% สำหรับข้อความเดียวกัน จำนวนที่แน่นอนได้มาจาก endpoint นับโทเค็น เท่านั้น โดยระบุโมเดลที่คุณตั้งใจจะใช้

เราวัดอัตราส่วนนี้กับข้อความของเราเอง เอเจนต์ของเราตอบเป็นภาษาฝรั่งเศส เราจึงเลือกเฉพาะคำตอบที่เป็นข้อความล้วน ไม่มีการคิด ไม่มีการเรียกใช้เครื่องมือ ไม่มีบล็อกโค้ด และยาวอย่างน้อย 80 คำ: ได้ 296 คำตอบจาก Opus 5, Opus 5.5, Fable 5.1 และ Sonnet 5.5 ค่ามัธยฐานอยู่ที่ 2.3 อักขระต่อโทเค็น หรือประมาณ 2.6 โทเค็นต่อคำ โค้ด JSON และอักษรที่ไม่ใช่อักษรละตินให้อัตราส่วนที่ต่างออกไป ประเด็นไม่ได้อยู่ที่ตัวเลขที่แน่นอน: โทเค็นเล็กกว่าคำ และคุณไม่มีทางนับมันด้วยมือ

ทุกคำขอถูกนับด้วยตัวนับสี่ตัว

Claude Code เขียนทุกเซสชันลงในทรานสคริปต์ JSONL ใต้ ~/.claude/projects/ ทุกคำตอบจากโมเดลมีบล็อก usage แนบมาด้วย นี่คือตัวอย่างจริงจากทรานสคริปต์ของเรา โดยเก็บไว้เฉพาะฟิลด์ที่มีประโยชน์:

"usage": {
  "input_tokens": 2,
  "cache_creation_input_tokens": 51836,
  "cache_read_input_tokens": 24882,
  "output_tokens": 315,
  "output_tokens_details": { "thinking_tokens": 54 },
  "cache_creation": {
    "ephemeral_1h_input_tokens": 51836,
    "ephemeral_5m_input_tokens": 0
  }
}

ตัวนับสี่ตัว และแต่ละตัวมีราคาไม่เท่ากัน:

  • input_tokens: ส่วนของพรอมต์ที่ไม่ได้ถูกเขียนลงแคชและไม่ได้ถูกอ่านจากแคช คิดราคาตามราคาอินพุตพื้นฐาน ใน Claude Code ส่วนนี้แทบจะเป็นแค่ไม่กี่โทเค็นเสมอ เพราะเกือบทุกอย่างผ่านแคช
  • cache_creation_input_tokens: ส่วนของพรอมต์ที่ถูกเก็บลงแคชเพื่อให้คำขอถัดไปนำกลับมาใช้ได้ การเขียนแคชมีราคา 1.25 เท่าของราคาอินพุตสำหรับแคช 5 นาที และ 2 เท่าสำหรับแคช 1 ชั่วโมง ในทรานสคริปต์ของเรา 97% ของการเขียนเป็นแคชแบบ 1 ชั่วโมง
  • cache_read_input_tokens: ส่วนของพรอมต์ที่ถูกเล่นซ้ำจากแคช การอ่านแคชมีราคา 0.1 เท่าของราคาอินพุตในโมเดลส่วนใหญ่ 0.05 เท่าใน Opus 5.5 และ Sonnet 5.5 และ 0.025 เท่าใน Fable 5.1 (หน้า prompt caching ของ Anthropic ตรวจสอบเมื่อวันที่ 10 ตุลาคม 2026)
  • output_tokens: สิ่งที่ Claude เขียน รวมถึงการคิด เอาต์พุตมีราคา 5 เท่าของราคาอินพุตในทุกโมเดลปัจจุบัน: 20 ดอลลาร์ต่อล้านโทเค็นใน Opus 5.5, 25 ใน Opus 5, 50 ใน Fable 5.1 และ 10 ใน Sonnet 5.5

สามตัวแรกรวมกันคือบริบทที่โมเดลอ่านสำหรับคำขอนี้ ตัวที่สี่คือคำตอบ

เซสชันของเราตลอด 30 วันมีหน้าตาเป็นอย่างไร

จากทั้งหมด 19,668 คำขอ นับคำขอละหนึ่งครั้ง (การเรียก API หนึ่งครั้งอาจกินพื้นที่หลายบรรทัดในทรานสคริปต์):

ตัวนับโทเค็นสัดส่วนของโทเค็นสัดส่วนของต้นทุนตามราคามาตรฐานของ API
อินพุต (ไม่ผ่านแคช)114,4110.003%0.04%
การเขียนแคช74,834,0702.0%37.4%
การอ่านแคช3,710,054,70997.7%45.7%
เอาต์พุต12,727,1930.34%16.8%
รวม3,797,730,383100%2,563 ดอลลาร์

คอลัมน์ต้นทุนคำนวณราคาของแต่ละคำขอตามโมเดลและระยะเวลาแคชของคำขอนั้นเอง เราไม่ได้จ่ายเงินจำนวนนี้ เพราะเซสชันเหล่านี้ทำงานบนแพ็กเกจสมาชิก ตัวเลขนี้คือน้ำหนักของตัวนับแต่ละตัว ซึ่งเป็นการถ่วงน้ำหนักแบบเดียวกับที่ AgentsRoom ใช้แบ่งเปอร์เซ็นต์ของแพ็กเกจให้แต่ละโปรเจกต์

อ่านได้สามประเด็น

เกือบทุกโทเค็นคือบทสนทนาที่ถูกอ่านซ้ำ 97.7% ของโทเค็นเป็นการอ่านแคช 99.2% ของคำขออ่านบางอย่างจากแคช เวลาที่มีคนบอกว่าเซสชันหนึ่ง "ใช้ไป 50 ล้านโทเค็น" สิ่งที่เขากำลังดูอยู่ก็คือส่วนนี้

สิ่งที่ Claude เขียนมีจำนวนโทเค็นน้อยมาก แต่ต้นทุนไม่ได้น้อยเลย 0.34% ของโทเค็น แต่ 16.8% ของบิล เพราะเอาต์พุตคือโทเค็นที่แพงที่สุด การคิดมีสัดส่วน 29% ของเอาต์พุตนั้น

การเขียนแคชคือเรื่องที่แพงเกินคาด 2% ของโทเค็น แต่ 37% ของต้นทุน เราคิดว่ามันเกิดจากแคชหมดอายุ แต่มีเพียง 16 คำขอจาก 19,668 ที่ต้องเขียนบริบทที่เย็นลงแล้วใหม่ทั้งหมด และเจ็ดครั้งในนั้นเกิดหลังจากเงียบไปนานกว่าหนึ่งชั่วโมง 79% ของการเขียนเป็นเพียงข้อความใหม่แต่ละข้อความและผลลัพธ์จากเครื่องมือแต่ละรายการที่ถูกเก็บหนึ่งครั้งในราคาสองเท่าของราคาอินพุต ก่อนจะถูกอ่านซ้ำในทุกรอบถัดไป อีก 20% คือคำขอแรกของแต่ละเซสชัน

ทำไมเซสชันจึงหนักขึ้นทุกรอบ

โมเดลไม่เก็บอะไรไว้เลยระหว่างสองคำขอ Claude Code ส่งทุกอย่างไปใหม่ทุกครั้ง: พรอมต์ระบบ คำจำกัดความของเครื่องมือ CLAUDE.md ทุกข้อความ ทุกไฟล์ที่มันอ่าน และทุกเอาต์พุตของคำสั่ง แคชทำให้ส่วนที่ซ้ำถูกลงต่อโทเค็น แต่ไม่ได้ฟรี และไม่ได้เล็กลง

ค่ามัธยฐานของบริบทที่อ่านต่อคำขอ ตามตำแหน่งในเซสชัน:

คำขอในเซสชันจำนวนคำขอบริบทค่ามัธยฐาน
คำขอที่ 138852,000 โทเค็น
ที่ 2 ถึง 103,21093,000 โทเค็น
ที่ 11 ถึง 508,546161,000 โทเค็น
ที่ 51 ถึง 2006,414237,000 โทเค็น
หลังคำขอที่ 2001,110342,000 โทเค็น

คำขอที่เป็นค่ามัธยฐานอ่านบริบท 179,000 โทเค็นเพื่อเขียนคำตอบ 290 โทเค็น อัตราส่วนนี้คือเรื่องราวทั้งหมดของโทเค็นในเอเจนต์เขียนโค้ด: คำตอบสั้น การอ่านยาว และการอ่านยิ่งยาวขึ้นตามอายุของเซสชัน

คำขอแรกของเราหนัก 52,000 โทเค็นก่อนที่ใครจะพิมพ์อะไรเลย เพราะเอเจนต์ของเราเริ่มต้นด้วยคำอธิบายบทบาทที่ยาว และเซิร์ฟเวอร์ MCP สี่ตัวที่คำจำกัดความของเครื่องมืออยู่ในพรอมต์ เซสชัน Claude Code เปล่า ๆ ในโฟลเดอร์ว่างเริ่มต้นที่ระดับต่ำกว่านี้มาก /context จะแสดงว่าเซสชันของคุณแบกอะไรอยู่ก่อนข้อความแรก

หนึ่งเซสชันใช้อะไรไปบ้าง

จาก 380 เซสชันที่มีอย่างน้อยสามคำขอ:

  • 33 คำขอ ที่ค่ามัธยฐาน และ 16 ถึง 61 สำหรับครึ่งกลาง
  • โทเค็นเอาต์พุต 27,000 โทเค็น ที่ค่ามัธยฐาน ตั้งแต่ 12,000 ถึง 48,000
  • โทเค็นที่ประมวลผล 5.4 ล้านโทเค็น ที่ค่ามัธยฐาน และ 1.5 ถึง 10.7 ล้านสำหรับครึ่งกลาง ซึ่ง 5.1 ล้านเป็นการอ่านแคช
  • 181,000 โทเค็น ที่ถูกเขียนลงแคชหรือส่งโดยไม่ผ่านแคชที่ค่ามัธยฐาน: ส่วนที่เป็นของใหม่จริง ๆ
  • 4.55 ดอลลาร์ ตามราคามาตรฐานของ API ที่ค่ามัธยฐาน และ 1.81 ถึง 9.25 สำหรับครึ่งกลาง

ดังนั้นคำตอบตรง ๆ สำหรับคำถามว่า "เซสชันเขียนโค้ดหนึ่งเซสชันใช้กี่โทเค็น" คือช่วงประมาณหนึ่งถึงสิบล้าน ซึ่งเกือบทั้งหมดเป็นบริบทเดิมที่ถูกอ่านซ้ำ เซสชันที่ทำงานตลอดบ่ายกับงานยาวงานเดียวจะอยู่ด้านบนของช่วงนี้ ส่วนเซสชันที่แก้บั๊กหนึ่งตัวแล้วหยุดจะอยู่ด้านล่าง

ช่วงเวลา 5 ชั่วโมงและรายสัปดาห์นับอะไรจริง ๆ

บนแพ็กเกจ Pro หรือ Max คุณจะไม่เห็นยอดโทเค็นคงเหลือเลย ศูนย์ช่วยเหลือของ Anthropic ระบุว่าทั้งสองแพ็กเกจมีขีดจำกัดเซสชันห้าชั่วโมงและขีดจำกัดรายสัปดาห์ ขีดจำกัดเหล่านี้ใช้ร่วมกันระหว่าง Claude และ Claude Code (รวมถึง IDE) และแพ็กเกจ Max มีขีดจำกัดรายสัปดาห์แยกต่างหากสำหรับ Fable โดยไม่ได้เผยแพร่ตัวเลขโทเค็นของขีดจำกัดใดเลย /usage แสดงเปอร์เซ็นต์ของแต่ละช่วงเวลา และเวลาที่ช่วงเวลานั้นจะรีเซ็ต

สิ่งที่ทำให้เปอร์เซ็นต์นั้นขยับ ตามรายการของ Anthropic เอง ได้แก่ ความยาวของข้อความ ขนาดไฟล์แนบ ความยาวของบทสนทนาปัจจุบัน การใช้เครื่องมือ การเลือกโมเดล ระดับความพยายาม และงานที่มีหลายขั้นตอน เมื่ออ่านคู่กับตารางด้านบน "ความยาวของบทสนทนาปัจจุบัน" คือปัจจัยที่ครอบงำเซสชันเขียนโค้ด: บริบทที่อ่านในแต่ละคำขอเพิ่มจาก 52,000 เป็น 237,000 โทเค็นภายในห้าสิบคำขอ ศูนย์ช่วยเหลือยังระบุด้วยว่าเนื้อหาที่แคชไว้ในโปรเจกต์จะถูกนับเข้าขีดจำกัดน้อยลงเมื่อถูกนำกลับมาใช้ ซึ่งเป็นแนวคิดเดียวกับราคาของการอ่านแคช

เราไม่รู้ว่า Anthropic แปลงโทเค็นเป็นเปอร์เซ็นต์ของช่วงเวลาอย่างไร และเราจะไม่แต่งสูตรแปลงขึ้นมาเอง สิ่งที่ข้อมูลบอกได้คือ คำขอช่วงท้ายในเซสชันยาวถูกนับมากกว่าคำขอช่วงต้นหลายเท่า สำหรับคำถามเดียวกัน

สิ่งที่เปลี่ยนจำนวนที่ถูกนับ ในทางปฏิบัติ

คันโยกสี่ตัว เรียงตามลำดับความสำคัญในข้อมูลของเรา:

  • /clear ระหว่างงานที่ไม่เกี่ยวข้องกัน Anthropic เรียกมันว่า "คันโยกที่ได้ผลที่สุดเพียงหนึ่งเดียว ทั้งด้านคุณภาพและต้นทุน" งานใหม่ในเซสชันเก่าต้องจ่ายค่าบริบทของงานเก่าในทุกคำขอ
  • /compact เมื่อคุณทำงานต่อในเซสชันที่ยาว คำสั่งนี้แทนที่ประวัติด้วยบทสรุปสั้น ๆ คำขอถัดไปจึงอ่านน้อยลง
  • ระวังสิ่งที่เข้าไปในบริบท การอ่านไฟล์หรือเอาต์พุตของคำสั่งขนาด 20,000 โทเค็นจะถูกเขียนหนึ่งครั้งในราคาสองเท่าของราคาอินพุต แล้วถูกอ่านซ้ำในทุกคำขอถัดไปจนกว่าเซสชันจะจบ การอ่านเฉพาะบรรทัดที่คุณต้องการแทนการอ่านทั้งไฟล์จึงคุ้มสองต่อ
  • โมเดลและระดับความพยายาม การคิดมีสัดส่วน 29% ของเอาต์พุตของเรา และเอาต์พุตคือโทเค็นที่แพงที่สุด ระดับความพยายามที่ต่ำลงสำหรับงานประจำจะลดเอาต์พุต และโมเดลที่ถูกกว่าจะลดราคาทุกอย่างพร้อมกัน

สิ่งที่ไม่มีผลในข้อมูลของเรา: การปล่อยเซสชันทิ้งไว้เฉย ๆ ด้วยแคช 1 ชั่วโมงที่ Claude Code ใช้ในทรานสคริปต์ของเรา การเขียนใหม่จากแคชที่เย็นแล้วเกิดขึ้น 16 ครั้งใน 30 วัน

หากต้องการวิธีใช้จ่ายให้น้อยลงอีก อ่าน วิธีลดค่าโทเค็นของ Claude Code

นับของคุณเอง

ตารางด้านบนมาจากสคริปต์ที่ไม่ต้องติดตั้งอะไรเพิ่ม มันอ่านทรานสคริปต์ Claude Code ทั้งหมดบนเครื่อง นับแต่ละคำขอหนึ่งครั้ง แล้วพิมพ์ตัวนับทั้งสี่และค่ามัธยฐานต่อเซสชัน เพิ่มตัวกรองบน o["timestamp"] หากคุณต้องการช่วงเวลาเฉพาะ

import json, glob, os, statistics as st
from collections import defaultdict

FIELDS = ("input_tokens", "cache_creation_input_tokens",
          "cache_read_input_tokens", "output_tokens")
totals, sessions = defaultdict(int), []
for path in glob.glob(os.path.expanduser("~/.claude/projects/*/*.jsonl")):
    seen, session = set(), defaultdict(int)
    with open(path, errors="ignore") as fh:
        for line in fh:
            try: o = json.loads(line)
            except ValueError: continue
            msg = o.get("message") or {}
            usage = msg.get("usage") if isinstance(msg, dict) else None
            if o.get("type") != "assistant" or not usage: continue
            rid = o.get("requestId") or o.get("uuid")
            if rid in seen: continue   # one API call can span several lines
            seen.add(rid)
            session["requests"] += 1
            for f in FIELDS:
                n = usage.get(f) or 0
                totals[f] += n
                session[f] += n
    if session["requests"] >= 3: sessions.append(session)

grand = sum(totals[f] for f in FIELDS)
for f in FIELDS:
    print(f"{f:30s} {totals[f]:>15,} {100 * totals[f] / grand:6.2f}%")
for key in ("requests", "output_tokens", "cache_read_input_tokens"):
    print(f"median per session, {key}: {st.median(s[key] for s in sessions):,.0f}")

เปรียบเทียบสัดส่วนของคุณกับของเรา บรรทัดการอ่านแคชคือบทสนทนาที่ถูกอ่านซ้ำ และบรรทัดการเขียนแคชคือสิ่งที่เป็นของใหม่: สองบรรทัดนี้บอกเรื่องบิลของคุณได้มากกว่าบรรทัดเอาต์พุต

AgentsRoom แสดงข้อมูลนี้ที่ไหน

สคริปต์ให้ภาพรวมทั้งเดือน ระหว่างที่คุณทำงาน AgentsRoom แสดงตัวนับชุดเดียวกันสำหรับแต่ละเอเจนต์: ป้ายโทเค็นในช่องพิมพ์ข้อความของทุกเซสชัน ที่เปลี่ยนเป็นสีแดงเมื่อเซสชันเริ่มหนัก ตัวติดตามเซสชันที่แสดงอินพุต เอาต์พุต การเขียนแคช การอ่านแคช และอัตราการใช้แคชสำเร็จ และร่องรอยเซสชันที่เล่นซ้ำเซสชันทีละรอบเพื่อแสดงว่าการอ่านไฟล์หรือผลลัพธ์จากเครื่องมือใดที่ทำให้บริบทเต็ม แผงการใช้งานจะแบ่งเปอร์เซ็นต์ที่แพ็กเกจของคุณรายงานให้กับโปรเจกต์และเอเจนต์ของคุณ โดยถ่วงน้ำหนักแต่ละเซสชันตามต้นทุนที่จะเกิดขึ้นในราคา API ซึ่งเป็นการถ่วงน้ำหนักแบบเดียวกับตารางด้านบน

สิ่งที่ไม่มีหน้าจอไหนให้คุณได้คือยอดโทเค็นคงเหลือ เพราะแพ็กเกจของคุณไม่มีสิ่งนั้น สำหรับคำถามนั้น อ่าน โทเค็นใน Claude ของคุณเหลืออยู่เท่าไหร่ และสำหรับความเร็วที่โทเค็นเอาต์พุตเหล่านั้นมาถึง อ่าน โทเค็นต่อวินาทีของ Claude Code จากการวัดจริง

คำถามที่พบบ่อย

โทเค็นใน Claude คืออะไร

หน่วยที่ Claude ใช้อ่านและเขียนข้อความ: ชิ้นส่วนของคำ บางครั้งเป็นคำสั้น ๆ ทั้งคำ บางครั้งเป็นอักขระเดียวหรือไบต์เดียว Anthropic ระบุว่าขนาดขึ้นอยู่กับโมเดลและภาษา: ในโมเดลก่อน Claude 4.7 หนึ่งโทเค็นยาวประมาณ 3.5 อักขระภาษาอังกฤษ และ Claude 4.7 ขึ้นไปใช้ tokenizer รุ่นใหม่ที่สร้างโทเค็นมากขึ้นราว 30% สำหรับข้อความเดียวกัน ทุกอย่างที่ Claude ทำถูกวัดเป็นโทเค็น: สิ่งที่คุณส่งไป สิ่งที่มันเขียนตอบกลับ และสิ่งที่มันเก็บไว้ในแคชระหว่างแต่ละรอบ

โทเค็นของ Claude หนึ่งโทเค็นเท่ากับกี่อักขระหรือกี่คำ

ขึ้นอยู่กับภาษาและตัวข้อความ Anthropic ให้ตัวเลขราว 3.5 อักขระภาษาอังกฤษต่อโทเค็นในโมเดลก่อน Claude 4.7 และโทเค็นมากขึ้นราว 30% สำหรับข้อความเดียวกันใน Claude 4.7 ขึ้นไป จากคำตอบที่เป็นข้อความล้วน 296 รายการที่เอเจนต์ของเราเขียนเป็นภาษาฝรั่งเศสในเดือนกันยายนและตุลาคม 2026 หนึ่งโทเค็นยาว 2.3 อักขระ หรือประมาณ 2.6 โทเค็นต่อคำ โค้ด JSON และอักษรที่ไม่ใช่อักษรละตินให้อัตราส่วนที่ต่างออกไป หากต้องการจำนวนที่แน่นอน endpoint นับโทเค็นของ Anthropic จะรับข้อความและโมเดลไปคำนวณให้

ทำไม Claude Code ถึงใช้โทเค็นเยอะขนาดนี้

เพราะทุกคำขอจะส่งบทสนทนาทั้งหมดไปใหม่: พรอมต์ระบบ คำจำกัดความของเครื่องมือ CLAUDE.md ทุกข้อความ และผลลัพธ์จากเครื่องมือทุกรายการจนถึงตอนนั้น จาก 19,668 คำขอของเรา คำขอที่เป็นค่ามัธยฐานแบกบริบท 179,000 โทเค็นเพื่อเขียนคำตอบ 290 โทเค็น และบริบทเพิ่มจาก 52,000 โทเค็นในคำขอแรกของเซสชันเป็น 237,000 หลังจากห้าสิบคำขอ แคชทำให้การอ่านซ้ำนั้นถูกลงต่อโทเค็น แต่ก็ยังถูกนับอยู่ดี

เซสชัน Claude Code ทั่วไปใช้โทเค็นเท่าไร

จาก 380 เซสชันของเราที่มีสามคำขอขึ้นไป ซึ่งบันทึกระหว่างวันที่ 10 กันยายนถึง 9 ตุลาคม 2026: ค่ามัธยฐานอยู่ที่ 33 คำขอ โทเค็นเอาต์พุต 27,000 โทเค็น และโทเค็นที่ประมวลผลรวม 5.4 ล้านโทเค็น ซึ่ง 5.1 ล้านเป็นการอ่านแคช ครึ่งหนึ่งของเซสชันอยู่ระหว่าง 1.5 ถึง 10.7 ล้านโทเค็น ตามราคามาตรฐานของ API เซสชันค่ามัธยฐานนี้จะมีค่าใช้จ่ายราว 4.55 ดอลลาร์ ส่วนในแพ็กเกจ Pro หรือ Max งานเดียวกันจะถูกนับเข้ากับช่วงเวลา 5 ชั่วโมงและช่วงเวลารายสัปดาห์แทน

โทเค็นการคิดถูกนับด้วยหรือไม่

ถูกนับ โทเค็นการคิดเป็นส่วนหนึ่งของ output_tokens ในทุกบล็อก usage โดยมีฟิลด์ thinking_tokens บอกว่าเอาต์พุตส่วนใดเป็นการคิด ใน API โทเค็นเหล่านี้คิดราคาเท่าเอาต์พุต และ Anthropic ระบุระดับความพยายามไว้ในรายการสิ่งที่ทำให้ขีดจำกัดการใช้งานของแพ็กเกจหมดเร็วขึ้น ในคลังข้อมูลของเรา การคิดมีสัดส่วน 29% ของทุกสิ่งที่โมเดลเขียน

การเขียนแคชกับการอ่านแคชต่างกันอย่างไร

การเขียนแคชจะเก็บส่วนหนึ่งของพรอมต์ไว้เพื่อให้คำขอถัดไปนำกลับมาใช้ได้ และมีราคาสูงกว่าอินพุตปกติ: 1.25 เท่าของราคาอินพุตสำหรับแคช 5 นาที และ 2 เท่าสำหรับแคช 1 ชั่วโมง การอ่านแคชจะนำส่วนที่เก็บไว้นั้นกลับมาใช้และมีราคาต่ำกว่ามาก: 0.1 เท่าของราคาอินพุตในโมเดลส่วนใหญ่ 0.05 เท่าใน Opus 5.5 และ Sonnet 5.5 และ 0.025 เท่าใน Fable 5.1 ในเซสชันของเรา การอ่านแคชคิดเป็น 98% ของโทเค็นและ 46% ของต้นทุนตามราคามาตรฐาน ส่วนการเขียนแคชคิดเป็น 2% ของโทเค็นและ 37% ของต้นทุน

ดาวน์โหลด AgentsRoom

รันเอเจนต์ AI ทั้งหมดของคุณในทุกโปรเจกต์ จากหน้าต่างเดียว

ฟรีดาวน์โหลด AgentsRoom

แอปคู่หู: ตรวจสอบเอเจนต์ของคุณได้ทุกที่

นำของคุณเอง: Claude, Codex, Antigravity CLI, หรือผู้ให้บริการ AI อื่น ๆ

รับส่วนขยาย
Chrome Web Store

ส่งข้อบกพร่องและคำขอไปยังแบ็คล็อกสาธารณะของคุณโดยตรง

หลายโปรเจกต์
ผู้ให้บริการหลายราย
หลาย agents
สถานะสด
ไฟล์ diff & commit
คู่หูมือถือ
ตัวอย่างสด
ทีมเอเจนต์
การทำงานอัตโนมัติในเบราว์เซอร์
การพัฒนาที่ขับเคลื่อนด้วย backlog
ห้องสมุดคำสั่ง
ห้องสมุดทักษะ
ดูฟีเจอร์ทั้งหมด

อ่านต่อ