我在Claude裡還剩多少令牌?根本沒有這個數字
你的Claude訂閱套餐不是按令牌計價的,所以沒有任何介面會顯示令牌餘額。這裡講清楚它到底計量什麼、去哪裡看,以及為什麼你沒在打字它也在掉。
這是關於Claude被搜尋得最多的問題之一,幾乎每種語言裡都有人在問。它的答案也不太讓人舒服:根本沒有這樣一個數字,因為你的套餐不是按令牌賣的。
這不是在摳字眼。它解釋了為什麼你找不到那個你在找的計數器,為什麼每一個聲稱能顯示它的頁面其實都在猜,以及為什麼真正讓你在任務中途被攔下的東西,並不是大多數人盯著看的那個。
你的套餐按用量週期計量,不是按令牌
Anthropic並沒有把Claude訂閱表述成一份令牌額度,而是按用量週期來計量:一個滾動的會話週期,加上疊在它上面的每週週期。兩者在你登入的所有入口之間共享,所以在Claude聊天裡泡一個下午,當晚留給Claude Code的餘地就更少。兩者同樣在各個模型之間共享,這就是為什麼一旦觸頂,用/model換一個更便宜的模型並不會把限制還給你。
因此你能讀到的,是某個週期被佔用的比例,以及它什麼時候恢復,而不是餘額。真的用完時,攔住你的那條提示會說明你撞到的是哪一道上限、它什麼時候重置,對你的帳號來說,那條提示是唯一權威的數字。
令牌數量唯一有字面意義的地方是API,它按令牌計費。下面所有內容講的都是訂閱套餐,那也正是大多數人真正在問的東西。
你真正能讀到的數字,以及它在哪裡
兩個介面,回答的是不同的問題。
在Claude Code裡,/usage是值得花時間學會的那一個。在Pro、Max、Team或Enterprise套餐上,它會顯示對應套餐限制的用量條,按d或w可以在最近24小時和最近7天之間切換。用量條下面它做了一件比任何原始數字都有用的事:把最近的用量歸因到技能、子代理、外掛和單個MCP伺服器上,各自給出一個百分比;當某一種模式佔到你近期消耗的10%或更多時,比如長上下文或快取未命中,它還會給出一個行為提示。
有一個前提很重要,也很容易被漏掉:這些數字是根據那台機器上的本地會話記錄算出來的。在另一台筆記本上、或者在claude.ai上做的事情,都不在裡面。
在網頁端,claude.ai的Settings然後Usage是帳號層面的檢視:你的套餐、你目前的位置,以及每週週期什麼時候重置。如果你在兩台機器之間來回工作,完整的是這一個。
想按會話拆解一件工作實際花了多少,/usage最上面那一塊會列印原始計數:
Usage by model:
claude-sonnet-4-6: 1.2k input, 5.3k output, 940.0k cache read, 50.0k cache write
這四個數字就是一次編碼會話的全部故事,其中最大的那個幾乎總是cache read。如果你希望持續看到這個檢視,而不是每次手動去問,AgentsRoom會為每個會話保持一個即時令牌計量器,就在終端旁邊,同樣區分輸入、輸出和快取,會話開始燒得厲害時還會亮出一個紅色角標。逐步讀懂CLI自帶計數器的做法,寫在如何檢查Claude Code令牌使用情況裡。
一旦有代理參與,令牌到底是什麼
令牌是一段文字碎片:在英文裡大約相當於四分之三個單詞,在程式碼裡明顯更少,因為標點和識別符號很容易被切碎。
讓人意外的部分是:**每一次請求都會把整段對話完整地重新發一遍。**在一個從早上就開著的會話裡問一句話,你付的不是那一行的錢,而是隨它一起被帶過去的全部歷史。代理每用一次工具就再發一次請求,把之前的工具結果一併帶上,這就是為什麼一句「把這個測試修好」會變成十幾個來回。
提示快取是讓這一切還撐得住的原因。重複的歷史按低得多的快取價格計費,這就是為什麼cache read那個數字大得嚇人,而帳單沒有。它同時也埋下了代理工作中最貴的那個習慣,正是下一節要講的東西。
為什麼你沒在打字,用量條卻在動
如果一個閒置會話的用量還在漲,原因就在下面這幾條裡,而且沒有一條是缺陷:
- 快取過期。 在訂閱套餐上,快取的上下文大約能活一個小時;一旦開始消耗用量額度,或者走API金鑰,就掉到五分鐘。吃完午飯回來,你的第一條訊息就沒命中快取:整段對話按全價被重新處理一遍。一次停頓,一次完整重算。
- 任何會自己開啟一輪對話的東西。 定時任務觸發、來自你另一個會話的訊息、後台工作執行時的一次目標籤到。每一個都會把完整上下文重新發一遍,和你親手打出來的訊息一模一樣。
- 代理隊友。 每個活躍的隊友代理都跑著自己的上下文視窗,並且一直消耗到它退出為止。按Anthropic自己的說法,一支處於計劃模式的團隊大約相當於標準會話的七倍。
- 壓縮。
/compact必須先讀完它要總結的那段對話,所以壓縮一個大上下文字身就是一次很大的請求。/clear不花任何東西,當你不需要延續上下文時,它是更好的選擇。 - 後台工作。 為
--resume生成的摘要和類似的雜活,即使你閒著也會消耗一點點,通常每個會話不到四美分。
這裡也是兩種被人混為一談的警告分道揚鑣的地方。上下文警告或自動壓縮警告說的是某一段對話正在逼近模型的上下文視窗,清空那個會話就能解決。用量限制說的是你套餐內包含的用量額度已經在所有會話之間花光了,執行/clear一點也拿不回來。可靠的辨別方法:用量限制會給出一個重置時間,上下文警告不會。
用量條快滿了該怎麼辦
大致按投入產出比排序:
- 在不相關的任務之間執行
/clear。 陳舊的上下文會在這個會話餘下的每一條訊息裡被重新傳送。如果之後還想用/resume把它找回來,先/rename再/clear。 - 讓模型和任務相稱。 Sonnet能應付大多數編碼工作;把Opus一直留作預設,是額度週四就見底的最常見原因。
- 讀
/usage裡的歸因。 如果某一個MCP伺服器或某一個子代理佔了你一週的30%,那就是要修的地方,而且你絕對猜不到是哪一個。 - 先把思考調低,再考慮關掉。 思考令牌是按輸出計費的。把推理強度等級降一檔通常就夠了。
- 把囉嗦的工作推給子代理。 測試輸出和日誌檔案留在子代理的上下文裡,回來的只有一份摘要。
- 讓上下文檔案保持短小。
CLAUDE.md或AGENTS.md裡的任何內容都會在會話開始時載入,並且每一輪都要為它付費,哪怕它和當前的事毫無關係。冗長的工作流程說明應該放進技能裡,技能只在被呼叫時才載入。更多內容見AGENTS.md上下文檔案指南。
如果你想專門看省錢那一面的加長版,降低Claude Code令牌成本把它講得很細。
長話短說
別再找令牌餘額了:你的套餐裡沒有這個東西。搞清楚那兩個用量週期,讀/usage是為了看歸因而不是看總數,並且把快取當成決定你這一週的關鍵。從不撞上限的開發者,很少是打字更少的那批人,而是話題一變就重開一個新會話的那批人。
同時跑好幾個代理會讓這一切既更嚴重,也更容易看清,因為消耗不再是一個數字,而是每個代理一個數字。AgentsRoom整個產品就是圍繞這個檢視做出來的。
常見問題
我在Claude裡還剩多少令牌?
根本沒有這樣一個數字可以去查。Claude訂閱並不是按令牌預算賣的:它計量的是一個滾動會話週期加上一個每週週期的佔用比例,你能讀到的是這些週期已用掉的百分比和它們的重置時間,而不是令牌餘額。檢視的地方是Claude Code裡的/usage命令,或者claude.ai上的Settings然後Usage。只有在按令牌計費的API上,一個令牌數字才真正有意義。
Claude的令牌是怎麼運作的?
令牌是一段文字碎片,在英文裡大約相當於四分之三個單詞,在程式碼裡更少。每一次請求都會把整段對話重新發一遍,所以一個編碼會話每一輪付的是它累積起來的全部歷史,而不只是你剛打的那句話。這就是為什麼用量要分成四個獨立的數字來算:輸入、輸出、快取寫入和快取讀取。快取過的歷史比全新輸入便宜得多,而這恰恰也是一個開了一整天的會話仍然在消耗你套餐的原因。
我的Claude用量什麼時候重置?
有兩個時鐘,而且互相獨立。會話週期是滾動的,所以它在開啟之後固定的小時數就到期,而不是在你選定的某個時間點。每週週期疊在它上面,在系統分配給你帳號的一個固定時刻重置。限制提示本身會告訴你,攔住你的那個週期什麼時候回來,對你的帳號來說那條提示才是權威答案。這兩個時鐘在Claude聊天和Claude Code之間共享,所以聊天用得兇會壓縮你寫程式碼的預算。
換一個更便宜的模型能把限制還給我嗎?
不能。會話週期和每週週期在各個模型之間共享,所以一旦觸頂,用/model切換並不會恢復訪問。它在一種特定情況下確實有用:針對某個模型的提示,比如撞到Opus的限制,這時換到Sonnet就能繼續幹活。它在你還沒用完之前也有用,因為同樣的工作量,更便宜的模型消耗的額度更少。
為什麼我什麼都沒做,用量還在漲?
因為在代理會話裡,閒著不是免費的。任何會開啟一輪對話的東西都會把你的完整上下文重新發一遍:定時任務觸發、來自另一個會話的訊息、還在跑的代理隊友、一次目標籤到。另外兩件事不用開啟對話也照樣燒令牌:壓縮,它必須先讀完自己要總結的那段對話;以及長時間停頓之後的第一條訊息,它沒命中提示快取,會按全價把你的全部歷史重新處理一遍。
上下文警告和用量限制是一回事嗎?
不是,而且把兩者搞混會讓人用錯解法。上下文警告或自動壓縮警告說的是某一段對話正在逼近模型的上下文視窗,清空或壓縮那個會話就能解決。用量限制說的是你套餐內包含的用量額度在所有會話之間已經花光了,執行/clear一點也拿不回來。辨別的關鍵在措辭上:限制提示會給出一個重置時間,上下文警告不會。
下載 AgentsRoom
在一個視窗中執行你所有專案的 AI 代理(Claude、Codex、Antigravity CLI、OpenCode、Aider、Grok Build、Mistral Vibe、Kimi Code)。
配套應用:隨時隨地監控你的 Agent
使用 Claude、Codex、Antigravity CLI 或其他 AI 提供商。
把 Bug 和需求直接傳送到您的公開待辦清單。
AgentsRoom 實際執行一瞥。
繼續閱讀
Claude 現在會給輸出打水印,但你的程式碼幾乎不受影響
Anthropic 開始給 Claude 的輸出打水印。它到底標記了什麼、為什麼生成的程式碼基本逃得掉、誰才真的能檢測到,以及為什麼你的 SEO 一點都不用動。
閱讀全文Claude Code一次只保持一個登入狀態,這是同時執行多個帳戶的方法
在同一台機器上同時執行工作帳戶和個人帳戶的實戰指南:決定哪個登入狀態生效的那個環境變數、為什麼開到第三個終端後shell方案就不管用了,以及如何為每個專案固定一個帳戶。
閱讀全文程式碼現在由代理來寫。開發者這份工作,變成了下面這樣。
寫程式碼只是六個環節裡的一環,而它正是代理拿走的那一環。剩下的五環沒有變輕,反而全都變重了。這篇文章逐環走一遍今天真正剩下的活:聽見使用者要什麼、決定值不值得做、把它寫成代理讀不錯的任務簡報、盯住執行、按影響範圍審查,最後發布並回話。
閱讀全文