我在Claude里还剩多少令牌?要看的是这两个界面
你的Claude订阅套餐不是按令牌计价的,所以没有任何界面会显示令牌余额。这里讲清楚它到底计量什么、真正会显示它的那两个界面,以及为什么你没在打字它也在掉,还有2026年9月的每周周期变更会给你的一周带来什么。
这是关于Claude被搜索得最多的问题之一,几乎每种语言里都有人在问。它的答案也不太让人舒服:根本没有这样一个数字,因为你的套餐不是按令牌卖的。
这不是在抠字眼。它解释了为什么你找不到那个你在找的计数器,为什么每一个声称能显示它的页面其实都在猜,以及为什么真正让你在任务中途被拦下的东西,并不是大多数人盯着看的那个。
你的套餐按用量周期计量,不是按令牌
Anthropic并没有把Claude订阅表述成一份令牌额度,而是按用量周期来计量:一个滚动的会话周期,加上叠在它上面的每周周期。两者在你登录的所有入口之间共享,所以在Claude聊天里泡一个下午,当晚留给Claude Code的余地就更少。两者同样在各个模型之间共享,这就是为什么一旦触顶,用/model换一个更便宜的模型并不会把限制还给你。
因此你能读到的,是某个周期被占用的比例,以及它什么时候恢复,而不是余额。真的用完时,拦住你的那条提示会说明你撞到的是哪一道上限、它什么时候重置,对你的账号来说,那条提示是唯一权威的数字。
令牌数量唯一有字面意义的地方是API,它按令牌计费。下面所有内容讲的都是订阅套餐,那也正是大多数人真正在问的东西。
每周周期不是一个常数
没人会提前算进去的一点是:这个每周周期是可以被重新划定的,而且它不会长期保持不变。
自2026年5月起,每周额度上一直挂着一个临时的50%加成,前后延长了三次。它会持续到2026年9月14日,从那天起接手的是在加成之前的基准之上永久增加25%。相对那个原始基准,这是一次上调;但相对你这一周账号里实际拥有的额度,这是一次17%的削减:原本值150的一周变成值125。滚动的会话周期不变,所以这个差距只会出现在长到足以触到每周上限的星期里,而那恰恰是最能感觉到它的时候。
这道上限的单位也不是令牌。它按活跃计算时长来算,这个时长是在一轮对话被处理的时候往前走,而不是在你坐着读回答的时候,而且Claude Code、claude.ai和Cowork都从同一个池子里取。一个开着三个子代理跑的下午,烧掉这一周的速度远比你发出的消息条数所暗示的要快。
一次完整的5小时会话实际会用掉这一周的多少,也没有人公布。罗宾汉在真实订阅上按服务商和套餐测量它,并标出服务商调整上限的那一天。
你真正能读到的数字,以及它在哪里
两个界面,回答的是不同的问题。
在Claude Code里,/usage是值得花时间学会的那一个。在Pro、Max、Team或Enterprise套餐上,它会显示对应套餐限制的用量条,按d或w可以在最近24小时和最近7天之间切换。用量条下面它做了一件比任何原始数字都有用的事:把最近的用量归因到技能、子代理、插件和单个MCP服务器上,各自给出一个百分比;当某一种模式占到你近期消耗的10%或更多时,比如长上下文或缓存未命中,它还会给出一个行为提示。
有一个前提很重要,也很容易被漏掉:这些数字是根据那台机器上的本地会话记录算出来的。在另一台笔记本上、或者在claude.ai上做的事情,都不在里面。
在网页端,claude.ai的Settings然后Usage是账号层面的视图:你的套餐、你目前的位置,以及每周周期什么时候重置。如果你在两台机器之间来回工作,完整的是这一个。
想按会话拆解一件工作实际花了多少,/usage最上面那一块会打印原始计数:
Usage by model:
claude-sonnet-4-6: 1.2k input, 5.3k output, 940.0k cache read, 50.0k cache write
这四个数字就是一次编码会话的全部故事,其中最大的那个几乎总是cache read。如果你希望持续看到这个视图,而不是每次手动去问,AgentsRoom会为每个会话保持一个实时令牌计量器,就在终端旁边,同样区分输入、输出和缓存,会话开始烧得厉害时还会亮出一个红色角标。逐步读懂CLI自带计数器的做法,写在如何检查Claude Code令牌使用情况里。
/usage会把你花掉的量归因到技能、子代理、插件和MCP服务器,却从不归因到某个项目或某个编码代理。AgentsRoom补上了这一层拆分:它拿服务商公布的那同一个百分比,按每个会话若按API价格计费需要多少钱来加权,把它分摊到你的各个项目和各个代理上。

把它当作估算来读,而不是账单。分母里只有这台机器能看到的工作,所以你在另一台笔记本上或网页端做的事情都不在其中,每一项占比都会略微偏高。
一旦有代理参与,令牌到底是什么
令牌是一段文本碎片:在英文里大约相当于四分之三个单词,在代码里明显更少,因为标点和标识符很容易被切碎。
让人意外的部分是:**每一次请求都会把整段对话完整地重新发一遍。**在一个从早上就开着的会话里问一句话,你付的不是那一行的钱,而是随它一起被带过去的全部历史。代理每用一次工具就再发一次请求,把之前的工具结果一并带上,这就是为什么一句“把这个测试修好”会变成十几个来回。
提示缓存是让这一切还撑得住的原因。重复的历史按低得多的缓存价格计费,这就是为什么cache read那个数字大得吓人,而账单没有。它同时也埋下了代理工作中最贵的那个习惯,正是下一节要讲的东西。
为什么你没在打字,用量条却在动
如果一个闲置会话的用量还在涨,原因就在下面这几条里,而且没有一条是缺陷:
- 缓存过期。 在订阅套餐上,缓存的上下文大约能活一个小时;一旦开始消耗用量额度,或者走API密钥,就掉到五分钟。吃完午饭回来,你的第一条消息就没命中缓存:整段对话按全价被重新处理一遍。一次停顿,一次完整重算。
- 任何会自己开启一轮对话的东西。 定时任务触发、来自你另一个会话的消息、后台工作运行时的一次目标签到。每一个都会把完整上下文重新发一遍,和你亲手打出来的消息一模一样。
- 代理队友。 每个活跃的队友代理都跑着自己的上下文窗口,并且一直消耗到它退出为止。按Anthropic自己的说法,一支处于计划模式的团队大约相当于标准会话的七倍。
- 压缩。
/compact必须先读完它要总结的那段对话,所以压缩一个大上下文本身就是一次很大的请求。/clear不花任何东西,当你不需要延续上下文时,它是更好的选择。 - 后台工作。 为
--resume生成的摘要和类似的杂活,即使你闲着也会消耗一点点,通常每个会话不到四美分。
这里也是两种被人混为一谈的警告分道扬镳的地方。上下文警告或自动压缩警告说的是某一段对话正在逼近模型的上下文窗口,清空那个会话就能解决。用量限制说的是你套餐内包含的用量额度已经在所有会话之间花光了,执行/clear一点也拿不回来。可靠的辨别方法:用量限制会给出一个重置时间,上下文警告不会。
用量条快满了该怎么办
大致按投入产出比排序:
- 在不相关的任务之间执行
/clear。 陈旧的上下文会在这个会话余下的每一条消息里被重新发送。如果之后还想用/resume把它找回来,先/rename再/clear。 - 让模型和任务相称。 Sonnet能应付大多数编码工作;把Opus一直留作默认,是额度周四就见底的最常见原因。
- 读
/usage里的归因。 如果某一个MCP服务器或某一个子代理占了你一周的30%,那就是要修的地方,而且你绝对猜不到是哪一个。 - 先把思考调低,再考虑关掉。 思考令牌是按输出计费的。把推理强度等级降一档通常就够了。
- 把啰嗦的工作推给子代理。 测试输出和日志文件留在子代理的上下文里,回来的只有一份摘要。
- 让上下文文件保持短小。
CLAUDE.md或AGENTS.md里的任何内容都会在会话开始时载入,并且每一轮都要为它付费,哪怕它和当前的事毫无关系。冗长的工作流说明应该放进技能里,技能只在被调用时才载入。更多内容见AGENTS.md上下文文件指南。
如果你想专门看省钱那一面的加长版,降低Claude Code令牌成本把它讲得很细。
这六个手段都默认你及时看见了,而用量条只在你主动去查的时候才显示。如果你更愿意有人来告诉你,AgentsRoom会发送用量提醒:默认在用量条越过50%、再越过75%时,或者越过你为每条用量条各自选定的阈值时,每个周期一次,送到桌面或你的手机上。上面这份清单只有在这一周还有得救的时候才管用。
周期用完之后什么还管用
上一节里的每一个手段都是预防性的:它们改变的是你逼近上限的速度,一旦你已经越过去,它们谁也拿不回任何东西。默认的做法是等重置,而唯一会告诉你它什么时候到来的地方,就是那条限制提示。有三件事能缩短这段等待。
第二个账号。 一个周期属于一个账号,而不是一台机器,所以一个你还没花掉的账号仍然有它自己的那一份。难点在于Claude Code一次只能保持一个登录;在一台机器上使用多个Claude Code账号讲的就是这件事的具体做法。AgentsRoom把这个交接自动化了:当一个账号触到上限时,正在进行的对话会转到你已登录的另一个账号上,从它停下的地方接着走,而不是换个地方从头再来。
另一个服务商。 每周周期是Anthropic的,不是整个行业的。如果你手上还有Codex、Antigravity或Copilot的席位,那些并非非Claude不可的工作,这一周剩下的时间可以放到那边去;而让多个服务商并排跑是这种切换里不会让你赔上已经积累起来的上下文的那个版本。
更便宜的模型,用在触顶之前而不是之后。 一个周期用完之后,用/model切换什么也换不回来,但它确实能把你正处在的这个周期拉长。它是三件事里唯一不需要任何前期准备的,也正因为如此,把默认模型一直留在Opus上,才是最常见的丢掉一个周四的方式。
长话短说
别再找令牌余额了:你的套餐里没有这个东西。搞清楚那两个用量周期,读/usage是为了看归因而不是看总数,并且把缓存当成决定你这一周的关键。从不撞上限的开发者,很少是打字更少的那批人,而是话题一变就重开一个新会话的那批人。
同时跑好几个代理会让这一切既更严重,也更容易看清,因为消耗不再是一个数字,而是每个代理一个数字。AgentsRoom整个产品就是围绕这个视图做出来的。
常见问题
我在Claude里还剩多少令牌?
根本没有这样一个数字可以去查。Claude订阅并不是按令牌预算卖的:它计量的是一个滚动会话周期加上一个每周周期的占用比例,你能读到的是这些周期已用掉的百分比和它们的重置时间,而不是令牌余额。查看的地方是Claude Code里的/usage命令,或者claude.ai上的Settings然后Usage。只有在按令牌计费的API上,一个令牌数字才真正有意义。
Claude的令牌是怎么运作的?
令牌是一段文本碎片,在英文里大约相当于四分之三个单词,在代码里更少。每一次请求都会把整段对话重新发一遍,所以一个编码会话每一轮付的是它累积起来的全部历史,而不只是你刚打的那句话。这就是为什么用量要分成四个独立的数字来算:输入、输出、缓存写入和缓存读取。缓存过的历史比全新输入便宜得多,而这恰恰也是一个开了一整天的会话仍然在消耗你套餐的原因。
我的Claude用量什么时候重置?
有两个时钟,而且互相独立。会话周期是滚动的,所以它在开启之后固定的小时数就到期,而不是在你选定的某个时间点。每周周期叠在它上面,在系统分配给你账号的一个固定时刻重置。限制提示本身会告诉你,拦住你的那个周期什么时候回来,对你的账号来说那条提示才是权威答案。这两个时钟在Claude聊天和Claude Code之间共享,所以聊天用得凶会压缩你写代码的预算。
换一个更便宜的模型能把限制还给我吗?
不能。会话周期和每周周期在各个模型之间共享,所以一旦触顶,用/model切换并不会恢复访问。它在一种特定情况下确实有用:针对某个模型的提示,比如撞到Opus的限制,这时换到Sonnet就能继续干活。它在你还没用完之前也有用,因为同样的工作量,更便宜的模型消耗的额度更少。
为什么我什么都没做,用量还在涨?
因为在代理会话里,闲着不是免费的。任何会开启一轮对话的东西都会把你的完整上下文重新发一遍:定时任务触发、来自另一个会话的消息、还在跑的代理队友、一次目标签到。另外两件事不用开启对话也照样烧令牌:压缩,它必须先读完自己要总结的那段对话;以及长时间停顿之后的第一条消息,它没命中提示缓存,会按全价把你的全部历史重新处理一遍。
Claude Code会在2026年9月削减每周限制吗?
给每周周期加上50%的那个临时加成会持续到2026年9月14日,从那天起接手的是在加成之前的基准之上永久增加25%。相对那个原始基准衡量,这是一次上调;但相对一个Claude Code用户今天手上的额度衡量,这是17%的缩减:原本值150的一周变成值125。滚动的会话周期没有变化,所以这个差距只会在长到足以触到每周上限的星期里显现出来。
上下文警告和用量限制是一回事吗?
不是,而且把两者搞混会让人用错解法。上下文警告或自动压缩警告说的是某一段对话正在逼近模型的上下文窗口,清空或压缩那个会话就能解决。用量限制说的是你套餐内包含的用量额度在所有会话之间已经花光了,执行/clear一点也拿不回来。辨别的关键在措辞上:限制提示会给出一个重置时间,上下文警告不会。
下载 AgentsRoom
在一个窗口中运行你所有项目的所有 AI 代理。
配套应用:随时随地监控你的 Agent
使用 Claude、Codex、Antigravity CLI 或其他 AI 提供商。
把 Bug 和需求直接发送到您的公开待办清单。
继续阅读
Claude Code 的 Routines:哪些在云端运行,哪些留在你的机器上,以及怎么选
Routines 是 Claude Code 在你不在场时运行已保存提示词的方式:按计划、由 API 调用或由 GitHub 事件启动,作为一个 cloud session,在你仓库的全新克隆上运行。它们目前处于研究预览阶段。Claude Code 还有两种在本地安排工作的方式,即桌面应用的定时任务和 /loop,而三者的行为并不相同:最小间隔、对本地文件的访问、权限确认,以及笔记本睡眠时会发生什么。本指南结合文档中的限制把三者摆在一起,再解释为什么我们自己的七个夜间代理运行在一台本地机器上。
阅读全文七个 AI 代理替我们守夜:编程之外的定时代理,附完整提示词
一位用户问我们,除了写代码,还拿 AI 代理做什么。从 8 月 28 日起,七个定时代理每晚在一台 Mac mini 上启动:一个值班 CEO、一个 SEO 团队、一个产品经理、一个修 bug 的修复员、一个社媒团队、一个文档员,还有一个把 25 行摘要发成邮件的汇报员。33 个夜晚,31 封早间邮件,51 个附带提交链接的 bug 修复,7 篇 20 种语言的博客文章。每个代理做什么,它们如何不交谈就把工作交接下去,哪个模型干哪份活,它们的提示词不得不学会的四条规则,以及可以直接复制的提示词本身。
阅读全文代码现在由代理来写。开发者这份工作,变成了下面这样。
写代码只是六个环节里的一环,而它正是代理拿走的那一环。剩下的五环没有变轻,反而全都变重了。这篇文章逐环走一遍今天真正剩下的活:听见用户要什么、决定值不值得做、把它写成代理读不错的任务简报、盯住执行、按影响范围审查,最后发布并回话。
阅读全文