Adaptive Mode:智慧模型路由

為每個任務選對 AI 模型,
在你傳送之前自動完成

Adaptive Mode 讀取你即將傳送的 prompt,為任務推薦最具價效比的模型。改個拼寫錯誤或做個翻譯,會路由到輕量、便宜的模型;大型重構或架構設計,會路由到旗艦模型。你只為自己真正需要的算力買單。

小模型的成本只是旗艦的一小部分。為每個任務匹配合適的模型,意味著每個任務消耗的套餐預算少得多,於是你每天能跑更多工,而不會撞上用量上限。一次點選就能應用建議,你繼續幹活。

Adaptive Mode
正在分析任務
翻譯一條介面文案
最佳匹配
Haiku
Sonnet
Opus
每個任務成本每天更多工

Adaptive Mode 把每個任務匹配到能把它做好的最便宜模型:輕量工作用 Haiku,均衡工作用 Sonnet,繁重工作用 Opus。每個任務成本更低,每天任務更多。

AgentsRoom 的 AI Suggestion 意圖介面:候選代理、任務描述輸入框、provider、涉及的資料夾,以及標出 Haiku、Sonnet、Opus 和 Fable 各自成本的五級任務複雜度軌道
一句話就定下代理、模型和會話名字,早在 CLI 啟動之前。

執行 AI 編碼 agent 有個花錢的問題。每個模型都有價格,而便宜模型和旗艦之間的差距很大。Claude Opus 最強,也最貴。Claude Haiku 最便宜。Claude Sonnet 居中。大多數人挑一個模型就一直用下去,結果要麼給難任務的算力不足,要麼更常見地,為簡單任務多付錢。

想想你一天裡真正讓 agent 做的事。改個拼寫錯誤。重新命名一個變數。翻譯一條介面文案。寫個簡短的單元測試。給文件做個摘要。這些都不需要旗艦模型。全都跑在 Opus 上,你會為同樣的結果,以遠超所需的速度燒掉套餐的用量預算。這種浪費看不見,正因如此它才會越積越多。

Adaptive Mode 填上了這道缺口。在你傳送第一條訊息之前,它讀取你的草稿,判斷任務到底有多難,再從你 provider 的產品線裡推薦仍能把活幹好的最便宜模型。重量級模型留給配得上它們的工作:架構、安全審計、大型重構。其餘的一切都路由到成本只有一小部分的模型。

為什麼要把模型和任務匹配

別再為簡單任務多付錢。用旗艦去改一個拼寫錯誤,等於把錢點著燒。Adaptive Mode 把輕量工作導向輕量模型,所以每個瑣碎任務的花費,只是頂級檔位的一小部分。

把強大的模型留給難題。匹配合適並不等於一味求便宜。當任務是系統設計或安全審計時,Adaptive Mode 會提示你往上升級,讓需要深度的工作真正得到深度。

同一套套餐,每天更多工。每個任務花的預算更少,意味著你更晚才會撞上用量上限。在一整天和一支並行執行的 agent 隊伍上,這些節省會累積成實打實的額外吞吐。

工作流程零摩擦。建議會在你傳送之前,以一個小晶片的形式出現在輸入框上方。一次點選即可應用。無需翻選單,無需手動猜哪個模型合適,也不會拖慢節奏。

經濟帳:消耗更少,完成更多

同樣的 agent,同樣的套餐。區別在於每個任務吃掉你多少預算。

一個模型幹所有活

  • : 每個任務都跑在你隨手留著選中的那個模型上。
  • : 用旗艦處理一個拼寫錯誤或一次翻譯,成本是應有的好幾倍。
  • : 套餐的用量預算,在根本不需要那種算力的工作上飛快耗盡。
  • : 你在一天裡更早撞上用量牆,agent 就卡住了。
  • : 手動切換模型很麻煩,所以沒人願意去弄。

Adaptive Mode 已開啟

  • : 每個任務都匹配到能把它做好的最便宜模型。
  • : 輕量工作路由到輕量模型,花費只是一小部分。
  • : 旗艦留給重構、審計和架構。
  • : 每個任務預算更少,意味著撞上任何用量上限之前能跑更多工。
  • : 一次點選就應用對的模型,於是匹配合適真的發生了。

路由本身幾乎免費:一個又小又快的模型用遠不到一美分的成本完成分析,然後讓開路。

AI Suggestion

說出你要做什麼。
代理就以對的模型開啟。

AI Suggestion 把同一個決定往前挪到唯一不花代價的那一刻:會話還不存在的時候。你開啟一個代理,看到的不是終端,而是一個問你這個代理接下來要做什麼的輸入框。你用一句話回答。一次呼叫讀完它,返回模型、會話名字,以及在你沒選代理時,該由誰來接這件事。

然後會話開啟,設定已經就緒,你的那句話就是第一條訊息。你沒有貼上任何東西,沒有等 CLI 起來之後再去改,也沒有為了改個拼寫錯誤付旗艦的價錢。

AI Suggestion
會話開啟之前
改掉登入按鈕上的拼寫錯誤
任務複雜度
輕量
標準
複雜
極難
模型Haiku而不是你的預設模型 Opus
會話登入按鈕拼寫錯誤

一句話進去。一個複雜度級別亮起。代理以這個級別對應的模型開啟,會話名字已經取好。

一次真實的會話,從空白輸入框到跑起來的代理:一句話描述任務,複雜度軌道停在 Sonnet 上,代理和會話名字跟著一起定下,會話開啟時那句話已經發出去了。

為什麼這個決定必須發生在會話開啟之前

同樣的建議,同樣的模型,兩種截然不同的結局。唯一的變數是你在什麼時候被問到。

在終端開啟之後才問

  • : CLI 已經用當時配置的模型起來了。
  • : prompt 已經寫好,你離傳送只差一個鍵。
  • : 現在換模型,等於扔掉你剛開的這個會話。
  • : 建議讀起來就是打擾,於是被關掉。
  • : 旗艦照樣處理這個瑣碎任務,什麼也沒學到。

在會話還不存在時就問

  • : 還什麼都沒開始,所以沒有什麼可推翻的。
  • : 你本來就在描述任務,而那正是這個決定需要的輸入。
  • : 模型、會話名字和代理在一次呼叫裡全部落定。
  • : 會話開啟時已經配置好,你的描述就是第一條訊息。
  • : 選便宜的模型不會讓你損失什麼,所以它真的會發生。

整個想法就是這樣。不是更聰明的建議,而是同一個建議,放在說「好」不用付出代價的時刻。

四個級別,對應到你的提供商的真實模型

複雜度軌道是這個決定看得見的部分。保持自動,分析會點亮其中一個級別。自己點一個級別,它就成了你的決定:什麼都不會傳送,會話立即開啟。

輕量

01

背後沒有邏輯的文案或配置改動。一個拼寫錯誤、一個標籤、一條翻譯字串、一次版本號更新。這是旗艦模型永遠不該看到的級別,也是它最常拿到的級別。

標準

02

解決辦法已經清楚的小改動。給按鈕加個狀態、接上一個已有的元件、寫一個簡短的測試。沒有什麼要排查的,只有活要幹。

複雜

03

要做的功能、要排查的缺陷、要推進的重構。一開始路徑並不明顯,所以模型需要餘地去探索,然後才決定採用哪種方案。

極難

04

架構、審計、原因不明的問題。旗艦模型就是為這些而存在的,而正因為把它留給這類任務,在這裡用它才負擔得起。

功能裡沒有寫死任何模型標識。四個級別是從代理所在提供商的模型目錄中解析出來的,按能力從強到弱排序。如果這個提供商提供的模型不足四個,這張表會向上摺疊:只有三個模型時,複雜和極難都落在旗艦上,絕不會反過來。選小了會白白浪費一整輪執行,選大了只是多付一次呼叫的差價。

AI Suggestion 是怎麼運作的,一步一步來

六個步驟,其中四個可選,總共只有一次呼叫。

01

你開啟一個代理

出現的不是終端,而是意圖介面:動態背景上的代理頭像、一個指向單個輸入框的箭頭,以及右上角一個連結,在你沒這個心情時直接開啟會話。

02

你用一句話描述任務

用平常的說法,用你自己的語言。不是 prompt,也不是規格說明,就是這個代理接下來要做的事。這句話是唯一必填的輸入,它會成為會話的第一條訊息。

03

可選:指出涉及的資料夾

專案的資料夾以資料夾形狀的小標籤顯示。點一個,就給了代理它的範圍,也讓難度估計更準,因為同一個缺陷在行動版應用裡和在網站裡並不是同一個任務。

04

可選:展開高階選項

摺疊在輸入框下面:工作的型別、面向誰、你期望的交付物、諸如不要提交或必須寫測試之類的約束,以及貼上的報錯、工單號這類自由上下文。它們隨同一次呼叫一起發出,並被放在代理第一條 prompt 的開頭。

05

一次呼叫做決定,或者一次都不呼叫

保持自動時,傳送會觸發一個請求,返回級別、模型、會話名字,以及在沒有指定代理時返回代理。如果你自己點了一個級別,就沒有任何請求:會話直接以該級別對應的模型開啟。

06

會話開啟,已經設好

代理以選定的模型啟動,掛在生成好的會話名字下,你的描述透過 CLI 自己的啟動引數作為第一條訊息送達,而不是在啟動之後粘進終端。

沒有選代理

連代理你都不必自己選

如果你開啟這塊螢幕時沒有指定代理,問題就變寬了。光球會顯示一個被三張面孔圍住的問號,而你敲下的這句話決定誰來接這個任務:你房間裡已有的某個代理、十四個內建角色之一,或者目錄裡那兩百六十來位專家之一。

現在新建專案給你的也是這個。它不再僅僅因為總得建立點什麼,就悄悄建一個全棧代理。它先問你在做什麼,再挑出這個答案所需要的代理。

代理、模型和會話名字來自同一次呼叫,因為把三個請求串起來會讓這塊螢幕的延遲變成三倍,而它全部的價值恰恰在於比先開終端再回頭改模型更快。

會話開啟之後的一個問題

代理跑起來之後,一條細條問一次:推薦的模型合適嗎?三個答案:有幫助、太輕、太重。

是三個而不是兩個,因為「選錯了」沒法用。能用的是錯的方向。太輕和太重是相反的修正,只有方向才能告訴定檔策略該往哪邊挪。

這條細條從不阻攔任何事,每個會話只問一次,而且只有在你開啟了使用資料共享時才會把答案發出去。

你說了算,分三個層級

無視它、跳過它,或者在它煩到你的地方關掉它

一塊擋在你和終端之間的螢幕,必須極其容易擺脫。這裡有四條出路,沒有一條埋在選單深處。

直接開啟

螢幕右上角有個連結,點它就像這個功能從未存在過一樣開啟會話。沒有呼叫,沒有分析,沒有延遲。

級別你自己定

點選軌道上的一個級別,它就成了你的決定。完全不會發出請求,會話立即以對應的模型開啟。

對這個代理、這個專案,或者全域關閉

這個設定先看代理,再看專案,再看應用,所以你可以在划算的代理上保留這塊螢幕,在總是同一種開法的代理上把它去掉。

就在當下的位置關掉

這三個關閉開關也在螢幕上的「為什麼會有這塊螢幕」彈出框裡。你在它煩到你的那一刻就能關掉,而不是三層選單之後。

自動化的代理根本看不到這塊螢幕:QA 機器人、待辦工單、定時任務、原型稿、團隊步驟和臨時代理本來就帶著自己的任務說明,也沒有人坐在它們面前。

Adaptive Mode 如何運作,一步一步

它在你的第一條訊息之前執行一次,從不擋你的路。

01

你開始輸入 prompt

用任意 agent 開一個全新對話,寫下你想做的事。Adaptive Mode 只看全新的對話,所以它從不打斷已經進行中的會話。

02

它讀取任務並加以分析

當你的草稿足夠充實、你停頓片刻時,Adaptive Mode 會把草稿的前一部分發給一個又小又快的路由模型,由它判斷任務有多吃力。

03

出現一條模型建議

輸入框上方浮現一個晶片:「切換到 Haiku」、「切換到 Sonnet」或「切換到 Opus」,取最具價效比的那一個。如果你當前的模型已經是最佳選擇,它會反過來這樣告訴你。

04

你一次點選就應用

點選晶片,模型即被應用。如果某個會話已在執行,Adaptive Mode 會即時切換它。這個選擇也會儲存到 agent 上,所以下次啟動會直接用對的模型開始。

05

或者重新計算,或者忽略

重寫了 prompt?點一下重新整理,為新草稿重新計算推薦。對當前模型滿意?忽略晶片直接傳送。每一個決定的主動權都在你手裡。

06

之後它保持安靜

Adaptive Mode 每個對話只建議一次,所以它從不糾纏你,也不會在你繼續編輯時悄悄花掉你的月度額度。幹完該乾的,然後消失。

不依賴 provider 的模型路由

Adaptive Mode 讀取你所用 provider 的模型產品線,並從該目錄中推薦。它不綁定任何單一廠商。

Claude

在 Haiku、Sonnet 和 Opus 之間路由。Haiku 用於快速修改、重新命名、翻譯、簡短測試和摘要。Sonnet 用於 pull request 評審、新 endpoint、複雜除錯和重構。Opus 用於系統架構、安全審計、大型遺留重構和深度效能最佳化。

Codex

在 Codex 產品線內路由:從處理小 bug 和快速提問的快速、便宜 mini 模型,到承擔端到端功能和測試的均衡預設模型,再到用於複雜系統設計和深度程式碼評審的旗艦推理模型。

Antigravity

在用於小修改、翻譯和摘要的快速 Antigravity 模型,和用於實現功能、除錯與更深入分析的強力 Antigravity 模型之間路由。

其他 provider

對任何 provider,Adaptive Mode 都回退到一條簡單規則:輕量工作用最便宜的模型,普通工作用均衡的模型,難活用最強的模型。新增一個 provider,它就會在那個 provider 自己的模型里路由。

與你的 provider 協作
Claude、Codex、Antigravity 等等。建議會對照該 provider 實際提供的模型加以校驗,所以你永遠不會拿到一條無法應用的推薦。
只用你的草稿,只在需要時
為了算出一條建議,你草稿的前一部分會被傳送到 AgentsRoom 伺服器。它每個對話執行一次,針對新對話,且僅在你開啟了 Adaptive Mode 時。
預設關閉,一鍵即可開啟
Adaptive Mode 裝好就是關閉狀態。算出一條建議,就得把你草稿的前一部分傳送到 AgentsRoom 伺服器,所以這個決定權在你手裡:在 AgentsRoom 設定的編輯器選項裡把它開啟,也可以隨時在同一處再關掉。

FAQ

AgentsRoom 裡的 Adaptive Mode 是什麼?

Adaptive Mode 是面向你 AI 編碼 agent 的智慧模型路由。在你傳送第一條訊息之前,它讀取你的 prompt,從你 provider 的產品線裡推薦仍能把任務幹好的最具價效比模型。輕任務拿到輕量、便宜的模型;重任務拿到旗艦。目標很簡單:別再用強大的模型為不需要它的工作多付錢。

Adaptive Mode 怎麼挑模型?

它把你草稿的前一部分發給一個又小又快的路由模型,這個模型事先用「哪類任務適配哪個模型檔位」的示例做過引導。然後它返回適配該任務的最便宜模型,並對照你當前 provider 實際提供的模型加以校驗。如果你當前的模型已經是最佳選擇,它會告訴你模型已最優,而不是硬推一次切換。

這到底是怎麼幫我省錢的?

對同一個簡單任務,便宜模型的成本只是旗艦的一小部分。如果你把改拼寫、重新命名、翻譯和簡短測試都跑在頂級模型上,就會以遠超所需的速度燒掉套餐的用量預算。Adaptive Mode 把這些輕量工作導向輕量模型,於是每個任務花得更少,你也能在撞上用量上限前跑更多工。在一天和大量並行 agent 上,這些節省會累積起來。

它能推薦哪些模型?

你的 provider 提供什麼,它就能推薦什麼。在 Claude 上是 Haiku、Sonnet 和 Opus。在 Codex 上覆蓋快速 mini 模型、均衡預設模型和旗艦推理模型。在 Antigravity 上覆蓋快速模型和強力模型。對其他 provider,則回退到最便宜、均衡和最強三檔。Adaptive Mode 讀取即時的模型列表,所以它推薦的總是你真正能跑起來的模型。

它會自動切換模型嗎?

不會。Adaptive Mode 只做建議。你在晶片上點一下就應用變更。如果會話已在執行,它會即時切換模型;無論哪種情況,選擇都會儲存到 agent,使下次啟動直接用對的模型開始。你也可以忽略建議,保留當前模型。

建議什麼時候出現?

在一個全新對話裡,當你輸入了一段充實的 prompt 並停頓片刻之後。它每個對話執行一次,所以從不打斷進行中的會話,也不會在你繼續編輯時悄悄花掉你的月度額度。

我可以重新計算建議嗎?

可以。如果你重寫了 prompt,點晶片上的重新整理按鈕,為新草稿重新計算推薦。一次手動重算會用掉你每月建議次數中的一次,所以它在你需要時隨手可得,又不會每敲一個鍵就執行。

我的 prompt 是私密的嗎?

為了算出一條建議,只有你草稿的前一部分會被傳送到 AgentsRoom 伺服器,每個對話一次,且僅在 Adaptive Mode 開啟時。如果你更想自己選模型,可以在設定裡徹底關閉這個功能。

Adaptive Mode 是否也支援 Codex 和 Antigravity,而不只是 Claude?

是的。Adaptive Mode 不依賴 provider。它讀取 agent 所用 provider 的模型目錄,並從該目錄中推薦,無論是 Claude、Codex、Antigravity 還是其他受支援的 provider。模型切換命令會針對你所在的 provider 來建置。

我怎麼開啟或關閉 Adaptive Mode?

它預設關閉。開啟 AgentsRoom 設定,進入編輯器選項,勾選 Adaptive Mode 就能開啟它:同一個核取方塊也用來把它關掉。只要它是關閉的,就沒有任何東西會分析你的草稿,也沒有任何與草稿相關的內容離開你的機器。

AgentsRoom 裡的 AI Suggestion 是什麼?

AI Suggestion 是代理會話開始之前顯示的一塊短螢幕。你用一句話描述任務,一次呼叫就返回你的提供商目錄裡能幹成這件事的最便宜模型、一個會話名字,以及在你沒選代理時返回該由誰來接。隨後會話開啟時已經配置好,你的那句話就是它的第一條訊息。

如果我已經知道這個任務有多難呢?

在軌道上點那個級別。它就成了你的決定,呼叫被完全跳過,會話立即以該級別對應的模型開啟。當你已經知道答案時,這塊螢幕是最快的。

如果呼叫失敗或者我離線了會怎樣?

代理照樣開啟,用的是沒有這個功能時它本來會用的模型。網路斷了、觸發限額、返回的內容沒法用,三種情況的結局一樣,因為一塊能攔住你開啟代理的螢幕,比沒有螢幕更糟。當機器確定處於離線狀態時,這塊螢幕壓根不會出現。

它除了選模型,還能選代理嗎?

能,前提是你開啟這塊螢幕時沒有指定代理。任務會拿去和你房間裡已有的代理、十四個內建角色以及專家目錄做匹配。現在新建專案走的也是這條路,而不是因為總得建立點什麼就悄悄建一個全棧代理。

搭配使用更佳

延伸閱讀

別再為你用不上的 AI 模型算力多付錢

下載 AgentsRoom,讓 Adaptive Mode 為每個任務挑選最具價效比的模型。輕量工作用輕量模型,難題用旗艦,每個任務燒的預算更少,每天交付的任務更多。

免費下載 AgentsRoom

配套應用:隨時隨地監控你的 Agent

使用 Claude、Codex、Antigravity CLI 或其他 AI 提供商。

獲取擴充功能
Chrome Web Store

把 Bug 和需求直接傳送到您的公開待辦清單。

多專案管理
多供應商
多代理執行
即時狀態
檔案差異與提交
行動應用
即時預覽
代理團隊
瀏覽器自動化
Backlog 驅動開發
提示詞庫
技能庫
檢視所有功能