我在Claude里还剩多少令牌?根本没有这个数字

你的Claude订阅套餐不是按令牌计价的,所以没有任何界面会显示令牌余额。这里讲清楚它到底计量什么、去哪里看,以及为什么你没在打字它也在掉。

这是关于Claude被搜索得最多的问题之一,几乎每种语言里都有人在问。它的答案也不太让人舒服:根本没有这样一个数字,因为你的套餐不是按令牌卖的。

这不是在抠字眼。它解释了为什么你找不到那个你在找的计数器,为什么每一个声称能显示它的页面其实都在猜,以及为什么真正让你在任务中途被拦下的东西,并不是大多数人盯着看的那个。

你的套餐按用量周期计量,不是按令牌

Anthropic并没有把Claude订阅表述成一份令牌额度,而是按用量周期来计量:一个滚动的会话周期,加上叠在它上面的每周周期。两者在你登录的所有入口之间共享,所以在Claude聊天里泡一个下午,当晚留给Claude Code的余地就更少。两者同样在各个模型之间共享,这就是为什么一旦触顶,用/model换一个更便宜的模型并不会把限制还给你。

因此你能读到的,是某个周期被占用的比例,以及它什么时候恢复,而不是余额。真的用完时,拦住你的那条提示会说明你撞到的是哪一道上限、它什么时候重置,对你的账号来说,那条提示是唯一权威的数字。

令牌数量唯一有字面意义的地方是API,它按令牌计费。下面所有内容讲的都是订阅套餐,那也正是大多数人真正在问的东西。

你真正能读到的数字,以及它在哪里

两个界面,回答的是不同的问题。

在Claude Code里,/usage是值得花时间学会的那一个。在Pro、Max、Team或Enterprise套餐上,它会显示对应套餐限制的用量条,按dw可以在最近24小时和最近7天之间切换。用量条下面它做了一件比任何原始数字都有用的事:把最近的用量归因到技能、子代理、插件和单个MCP服务器上,各自给出一个百分比;当某一种模式占到你近期消耗的10%或更多时,比如长上下文或缓存未命中,它还会给出一个行为提示

有一个前提很重要,也很容易被漏掉:这些数字是根据那台机器上的本地会话记录算出来的。在另一台笔记本上、或者在claude.ai上做的事情,都不在里面。

在网页端,claude.ai的Settings然后Usage是账号层面的视图:你的套餐、你目前的位置,以及每周周期什么时候重置。如果你在两台机器之间来回工作,完整的是这一个。

想按会话拆解一件工作实际花了多少,/usage最上面那一块会打印原始计数:

Usage by model:
   claude-sonnet-4-6:  1.2k input, 5.3k output, 940.0k cache read, 50.0k cache write

这四个数字就是一次编码会话的全部故事,其中最大的那个几乎总是cache read。如果你希望持续看到这个视图,而不是每次手动去问,AgentsRoom会为每个会话保持一个实时令牌计量器,就在终端旁边,同样区分输入、输出和缓存,会话开始烧得厉害时还会亮出一个红色角标。逐步读懂CLI自带计数器的做法,写在如何检查Claude Code令牌使用情况里。

一旦有代理参与,令牌到底是什么

令牌是一段文本碎片:在英文里大约相当于四分之三个单词,在代码里明显更少,因为标点和标识符很容易被切碎。

让人意外的部分是:**每一次请求都会把整段对话完整地重新发一遍。**在一个从早上就开着的会话里问一句话,你付的不是那一行的钱,而是随它一起被带过去的全部历史。代理每用一次工具就再发一次请求,把之前的工具结果一并带上,这就是为什么一句“把这个测试修好”会变成十几个来回。

提示缓存是让这一切还撑得住的原因。重复的历史按低得多的缓存价格计费,这就是为什么cache read那个数字大得吓人,而账单没有。它同时也埋下了代理工作中最贵的那个习惯,正是下一节要讲的东西。

为什么你没在打字,用量条却在动

如果一个闲置会话的用量还在涨,原因就在下面这几条里,而且没有一条是缺陷:

  • 缓存过期。 在订阅套餐上,缓存的上下文大约能活一个小时;一旦开始消耗用量额度,或者走API密钥,就掉到五分钟。吃完午饭回来,你的第一条消息就没命中缓存:整段对话按全价被重新处理一遍。一次停顿,一次完整重算。
  • 任何会自己开启一轮对话的东西。 定时任务触发、来自你另一个会话的消息、后台工作运行时的一次目标签到。每一个都会把完整上下文重新发一遍,和你亲手打出来的消息一模一样。
  • 代理队友。 每个活跃的队友代理都跑着自己的上下文窗口,并且一直消耗到它退出为止。按Anthropic自己的说法,一支处于计划模式的团队大约相当于标准会话的七倍。
  • 压缩。 /compact必须先读完它要总结的那段对话,所以压缩一个大上下文本身就是一次很大的请求。/clear不花任何东西,当你不需要延续上下文时,它是更好的选择。
  • 后台工作。--resume生成的摘要和类似的杂活,即使你闲着也会消耗一点点,通常每个会话不到四美分。

这里也是两种被人混为一谈的警告分道扬镳的地方。上下文警告或自动压缩警告说的是某一段对话正在逼近模型的上下文窗口,清空那个会话就能解决。用量限制说的是你套餐内包含的用量额度已经在所有会话之间花光了,执行/clear一点也拿不回来。可靠的辨别方法:用量限制会给出一个重置时间,上下文警告不会。

用量条快满了该怎么办

大致按投入产出比排序:

  1. 在不相关的任务之间执行/clear 陈旧的上下文会在这个会话余下的每一条消息里被重新发送。如果之后还想用/resume把它找回来,先/rename/clear
  2. 让模型和任务相称。 Sonnet能应付大多数编码工作;把Opus一直留作默认,是额度周四就见底的最常见原因。
  3. /usage里的归因。 如果某一个MCP服务器或某一个子代理占了你一周的30%,那就是要修的地方,而且你绝对猜不到是哪一个。
  4. 先把思考调低,再考虑关掉。 思考令牌是按输出计费的。把推理强度等级降一档通常就够了。
  5. 把啰嗦的工作推给子代理。 测试输出和日志文件留在子代理的上下文里,回来的只有一份摘要。
  6. 让上下文文件保持短小。 CLAUDE.mdAGENTS.md里的任何内容都会在会话开始时载入,并且每一轮都要为它付费,哪怕它和当前的事毫无关系。冗长的工作流说明应该放进技能里,技能只在被调用时才载入。更多内容见AGENTS.md上下文文件指南

如果你想专门看省钱那一面的加长版,降低Claude Code令牌成本把它讲得很细。

长话短说

别再找令牌余额了:你的套餐里没有这个东西。搞清楚那两个用量周期,读/usage是为了看归因而不是看总数,并且把缓存当成决定你这一周的关键。从不撞上限的开发者,很少是打字更少的那批人,而是话题一变就重开一个新会话的那批人。

同时跑好几个代理会让这一切既更严重,也更容易看清,因为消耗不再是一个数字,而是每个代理一个数字。AgentsRoom整个产品就是围绕这个视图做出来的。

常见问题

我在Claude里还剩多少令牌?

根本没有这样一个数字可以去查。Claude订阅并不是按令牌预算卖的:它计量的是一个滚动会话周期加上一个每周周期的占用比例,你能读到的是这些周期已用掉的百分比和它们的重置时间,而不是令牌余额。查看的地方是Claude Code里的/usage命令,或者claude.ai上的Settings然后Usage。只有在按令牌计费的API上,一个令牌数字才真正有意义。

Claude的令牌是怎么运作的?

令牌是一段文本碎片,在英文里大约相当于四分之三个单词,在代码里更少。每一次请求都会把整段对话重新发一遍,所以一个编码会话每一轮付的是它累积起来的全部历史,而不只是你刚打的那句话。这就是为什么用量要分成四个独立的数字来算:输入、输出、缓存写入和缓存读取。缓存过的历史比全新输入便宜得多,而这恰恰也是一个开了一整天的会话仍然在消耗你套餐的原因。

我的Claude用量什么时候重置?

有两个时钟,而且互相独立。会话周期是滚动的,所以它在开启之后固定的小时数就到期,而不是在你选定的某个时间点。每周周期叠在它上面,在系统分配给你账号的一个固定时刻重置。限制提示本身会告诉你,拦住你的那个周期什么时候回来,对你的账号来说那条提示才是权威答案。这两个时钟在Claude聊天和Claude Code之间共享,所以聊天用得凶会压缩你写代码的预算。

换一个更便宜的模型能把限制还给我吗?

不能。会话周期和每周周期在各个模型之间共享,所以一旦触顶,用/model切换并不会恢复访问。它在一种特定情况下确实有用:针对某个模型的提示,比如撞到Opus的限制,这时换到Sonnet就能继续干活。它在你还没用完之前也有用,因为同样的工作量,更便宜的模型消耗的额度更少。

为什么我什么都没做,用量还在涨?

因为在代理会话里,闲着不是免费的。任何会开启一轮对话的东西都会把你的完整上下文重新发一遍:定时任务触发、来自另一个会话的消息、还在跑的代理队友、一次目标签到。另外两件事不用开启对话也照样烧令牌:压缩,它必须先读完自己要总结的那段对话;以及长时间停顿之后的第一条消息,它没命中提示缓存,会按全价把你的全部历史重新处理一遍。

上下文警告和用量限制是一回事吗?

不是,而且把两者搞混会让人用错解法。上下文警告或自动压缩警告说的是某一段对话正在逼近模型的上下文窗口,清空或压缩那个会话就能解决。用量限制说的是你套餐内包含的用量额度在所有会话之间已经花光了,执行/clear一点也拿不回来。辨别的关键在措辞上:限制提示会给出一个重置时间,上下文警告不会。

下载 AgentsRoom

在一个窗口中运行你所有项目的 AI 智能体(Claude、Codex、Antigravity CLI、OpenCode、Aider、Grok Build、Mistral Vibe、Kimi Code)。

免费下载 AgentsRoom

配套应用:随时随地监控你的 Agent

使用 Claude、Codex、Antigravity CLI 或其他 AI 提供商。

获取扩展程序
Chrome Web Store

把 Bug 和需求直接发送到您的公开待办清单。

AgentsRoom 实际运行一瞥。

多项目管理
多供应商
多代理运行
实时状态
文件差异与提交
移动应用
实时预览
代理团队
浏览器自动化
Backlog 驱动开发
提示词库
技能库
查看所有功能

继续阅读