Adaptive Mode:智能模型路由

为每个任务选对 AI 模型,
在你发送之前自动完成

Adaptive Mode 读取你即将发送的 prompt,为任务推荐最具性价比的模型。改个拼写错误或做个翻译,会路由到轻量、便宜的模型;大型重构或架构设计,会路由到旗舰模型。你只为自己真正需要的算力买单。

小模型的成本只是旗舰的一小部分。为每个任务匹配合适的模型,意味着每个任务消耗的套餐预算少得多,于是你每天能跑更多任务,而不会撞上用量上限。一次点击就能应用建议,你继续干活。

Adaptive Mode
正在分析任务
翻译一条界面文案
最佳匹配
Haiku
Sonnet
Opus
每个任务成本每天更多任务

Adaptive Mode 把每个任务匹配到能把它做好的最便宜模型:轻量工作用 Haiku,均衡工作用 Sonnet,繁重工作用 Opus。每个任务成本更低,每天任务更多。

运行 AI 编码 agent 有个花钱的问题。每个模型都有价格,而便宜模型和旗舰之间的差距很大。Claude Opus 最强,也最贵。Claude Haiku 最便宜。Claude Sonnet 居中。大多数人挑一个模型就一直用下去,结果要么给难任务的算力不足,要么更常见地,为简单任务多付钱。

想想你一天里真正让 agent 做的事。改个拼写错误。重命名一个变量。翻译一条界面文案。写个简短的单元测试。给文档做个摘要。这些都不需要旗舰模型。全都跑在 Opus 上,你会为同样的结果,以远超所需的速度烧掉套餐的用量预算。这种浪费看不见,正因如此它才会越积越多。

Adaptive Mode 填上了这道缺口。在你发送第一条消息之前,它读取你的草稿,判断任务到底有多难,再从你 provider 的产品线里推荐仍能把活干好的最便宜模型。重量级模型留给配得上它们的工作:架构、安全审计、大型重构。其余的一切都路由到成本只有一小部分的模型。

为什么要把模型和任务匹配

别再为简单任务多付钱。用旗舰去改一个拼写错误,等于把钱点着烧。Adaptive Mode 把轻量工作导向轻量模型,所以每个琐碎任务的花费,只是顶级档位的一小部分。

把强大的模型留给难题。匹配合适并不等于一味求便宜。当任务是系统设计或安全审计时,Adaptive Mode 会提示你往上升级,让需要深度的工作真正得到深度。

同一套套餐,每天更多任务。每个任务花的预算更少,意味着你更晚才会撞上用量上限。在一整天和一支并行运行的 agent 队伍上,这些节省会累积成实打实的额外吞吐。

工作流零摩擦。建议会在你发送之前,以一个小芯片的形式出现在输入框上方。一次点击即可应用。无需翻菜单,无需手动猜哪个模型合适,也不会拖慢节奏。

经济账:消耗更少,完成更多

同样的 agent,同样的套餐。区别在于每个任务吃掉你多少预算。

一个模型干所有活

  • : 每个任务都跑在你随手留着选中的那个模型上。
  • : 用旗舰处理一个拼写错误或一次翻译,成本是应有的好几倍。
  • : 套餐的用量预算,在根本不需要那种算力的工作上飞快耗尽。
  • : 你在一天里更早撞上用量墙,agent 就卡住了。
  • : 手动切换模型很麻烦,所以没人愿意去弄。

Adaptive Mode 已开启

  • : 每个任务都匹配到能把它做好的最便宜模型。
  • : 轻量工作路由到轻量模型,花费只是一小部分。
  • : 旗舰留给重构、审计和架构。
  • : 每个任务预算更少,意味着撞上任何用量上限之前能跑更多任务。
  • : 一次点击就应用对的模型,于是匹配合适真的发生了。

路由本身几乎免费:一个又小又快的模型用远不到一美分的成本完成分析,然后让开路。

Adaptive Mode 如何运作,一步一步

它在你的第一条消息之前运行一次,从不挡你的路。

01

你开始输入 prompt

用任意 agent 开一个全新对话,写下你想做的事。Adaptive Mode 只看全新的对话,所以它从不打断已经进行中的会话。

02

它读取任务并加以分析

当你的草稿足够充实、你停顿片刻时,Adaptive Mode 会把草稿的前一部分发给一个又小又快的路由模型,由它判断任务有多吃力。

03

出现一条模型建议

输入框上方浮现一个芯片:「切换到 Haiku」、「切换到 Sonnet」或「切换到 Opus」,取最具性价比的那一个。如果你当前的模型已经是最佳选择,它会反过来这样告诉你。

04

你一次点击就应用

点击芯片,模型即被应用。如果某个会话已在运行,Adaptive Mode 会实时切换它。这个选择也会保存到 agent 上,所以下次启动会直接用对的模型开始。

05

或者重新计算,或者忽略

重写了 prompt?点一下刷新,为新草稿重新计算推荐。对当前模型满意?忽略芯片直接发送。每一个决定的主动权都在你手里。

06

之后它保持安静

Adaptive Mode 每个对话只建议一次,所以它从不纠缠你,也不会在你继续编辑时悄悄花掉你的月度额度。干完该干的,然后消失。

不依赖 provider 的模型路由

Adaptive Mode 读取你所用 provider 的模型产品线,并从该目录中推荐。它不绑定任何单一厂商。

Claude

在 Haiku、Sonnet 和 Opus 之间路由。Haiku 用于快速修改、重命名、翻译、简短测试和摘要。Sonnet 用于 pull request 评审、新 endpoint、复杂调试和重构。Opus 用于系统架构、安全审计、大型遗留重构和深度性能优化。

Codex

在 Codex 产品线内路由:从处理小 bug 和快速提问的快速、便宜 mini 模型,到承担端到端功能和测试的均衡默认模型,再到用于复杂系统设计和深度代码评审的旗舰推理模型。

Antigravity

在用于小修改、翻译和摘要的快速 Antigravity 模型,和用于实现功能、调试与更深入分析的强力 Antigravity 模型之间路由。

其他 provider

对任何 provider,Adaptive Mode 都回退到一条简单规则:轻量工作用最便宜的模型,普通工作用均衡的模型,难活用最强的模型。添加一个 provider,它就会在那个 provider 自己的模型里路由。

与你的 provider 协作
Claude、Codex、Antigravity 等等。建议会对照该 provider 实际提供的模型加以校验,所以你永远不会拿到一条无法应用的推荐。
只用你的草稿,只在需要时
为了算出一条建议,你草稿的前一部分会被发送到 AgentsRoom 服务器。它每个对话运行一次,针对新对话,且仅在你开启了 Adaptive Mode 时。
默认开启,一下即可关闭
Adaptive Mode 默认开启,因为匹配合适的模型一上手就能省钱。如果你更想自己挑模型,随时可以在设置里关掉它。

FAQ

AgentsRoom 里的 Adaptive Mode 是什么?

Adaptive Mode 是面向你 AI 编码 agent 的智能模型路由。在你发送第一条消息之前,它读取你的 prompt,从你 provider 的产品线里推荐仍能把任务干好的最具性价比模型。轻任务拿到轻量、便宜的模型;重任务拿到旗舰。目标很简单:别再用强大的模型为不需要它的工作多付钱。

Adaptive Mode 怎么挑模型?

它把你草稿的前一部分发给一个又小又快的路由模型,这个模型事先用「哪类任务适配哪个模型档位」的示例做过引导。然后它返回适配该任务的最便宜模型,并对照你当前 provider 实际提供的模型加以校验。如果你当前的模型已经是最佳选择,它会告诉你模型已最优,而不是硬推一次切换。

这到底是怎么帮我省钱的?

对同一个简单任务,便宜模型的成本只是旗舰的一小部分。如果你把改拼写、重命名、翻译和简短测试都跑在顶级模型上,就会以远超所需的速度烧掉套餐的用量预算。Adaptive Mode 把这些轻量工作导向轻量模型,于是每个任务花得更少,你也能在撞上用量上限前跑更多任务。在一天和大量并行 agent 上,这些节省会累积起来。

它能推荐哪些模型?

你的 provider 提供什么,它就能推荐什么。在 Claude 上是 Haiku、Sonnet 和 Opus。在 Codex 上覆盖快速 mini 模型、均衡默认模型和旗舰推理模型。在 Antigravity 上覆盖快速模型和强力模型。对其他 provider,则回退到最便宜、均衡和最强三档。Adaptive Mode 读取实时的模型列表,所以它推荐的总是你真正能跑起来的模型。

它会自动切换模型吗?

不会。Adaptive Mode 只做建议。你在芯片上点一下就应用变更。如果会话已在运行,它会实时切换模型;无论哪种情况,选择都会保存到 agent,使下次启动直接用对的模型开始。你也可以忽略建议,保留当前模型。

建议什么时候出现?

在一个全新对话里,当你输入了一段充实的 prompt 并停顿片刻之后。它每个对话运行一次,所以从不打断进行中的会话,也不会在你继续编辑时悄悄花掉你的月度额度。

我可以重新计算建议吗?

可以。如果你重写了 prompt,点芯片上的刷新按钮,为新草稿重新计算推荐。一次手动重算会用掉你每月建议次数中的一次,所以它在你需要时随手可得,又不会每敲一个键就运行。

我的 prompt 是私密的吗?

为了算出一条建议,只有你草稿的前一部分会被发送到 AgentsRoom 服务器,每个对话一次,且仅在 Adaptive Mode 开启时。如果你更想自己选模型,可以在设置里彻底关闭这个功能。

Adaptive Mode 是否也支持 Codex 和 Antigravity,而不只是 Claude?

是的。Adaptive Mode 不依赖 provider。它读取 agent 所用 provider 的模型目录,并从该目录中推荐,无论是 Claude、Codex、Antigravity 还是其他受支持的 provider。模型切换命令会针对你所在的 provider 来构建。

我怎么开启或关闭 Adaptive Mode?

它默认开启,因为匹配合适的模型一上手就能省钱。你随时可以在 AgentsRoom 设置的 Adaptive Model 下停用或重新启用它。

搭配使用更佳

别再为你用不上的 AI 模型算力多付钱

下载 AgentsRoom,让 Adaptive Mode 为每个任务挑选最具性价比的模型。轻量工作用轻量模型,难题用旗舰,每个任务烧的预算更少,每天交付的任务更多。

免费下载 AgentsRoom

配套应用:随时随地监控你的 Agent

使用 Claude、Codex、Antigravity CLI 或其他 AI 提供商。

获取扩展
Chrome Web Store

把 Bug 和需求直接发送到您的公开待办清单。

AgentsRoom 实际运行一瞥。

多项目管理
多供应商
多代理运行
实时状态
文件差异与提交
移动应用
实时预览
代理团队
浏览器自动化
Backlog 驱动开发
提示词库
技能库
查看所有功能