Đúng mô hình AI cho từng tác vụ,
được chọn tự động, trước khi bạn gửi
Adaptive Mode đọc prompt mà bạn sắp gửi và gợi ý mô hình tiết kiệm nhất cho tác vụ. Một lần sửa lỗi gõ hay một bản dịch sẽ được định tuyến tới một mô hình nhẹ và rẻ. Một refactor lớn hay một thiết kế kiến trúc sẽ được định tuyến tới một flagship. Bạn chỉ chọn đúng mức sức mạnh mình thực sự cần.
Mô hình nhỏ chỉ tốn một phần nhỏ so với flagship. Chọn đúng cỡ mô hình cho từng tác vụ nghĩa là bạn đốt ít ngân sách gói hơn nhiều cho mỗi tác vụ, nên bạn chạy được nhiều tác vụ hơn mỗi ngày mà không đụng tường giới hạn sử dụng. Một cú nhấp áp dụng gợi ý và bạn tiếp tục làm việc.
Adaptive Mode ghép mỗi tác vụ với mô hình rẻ nhất có thể làm tốt: Haiku cho việc nhẹ, Sonnet cho việc cân bằng, Opus cho việc nặng. Ít chi phí hơn cho mỗi tác vụ, nhiều tác vụ hơn mỗi ngày.
Đây là vấn đề tiền bạc khi chạy các agent lập trình AI. Mỗi mô hình có một mức giá, và khoảng cách giữa cái rẻ và flagship rất lớn. Claude Opus là mô hình mạnh nhất, và đắt nhất. Claude Haiku rẻ nhất. Claude Sonnet nằm ở giữa. Phần lớn mọi người chọn một mô hình rồi để nguyên, nên hoặc họ thiếu sức mạnh cho các tác vụ khó, hoặc, thường gặp hơn nhiều, trả dư cho các tác vụ dễ.
Hãy nghĩ về điều bạn thực sự yêu cầu một agent làm trong một ngày. Sửa một lỗi gõ. Đổi tên một biến. Dịch một chuỗi giao diện. Viết một unit test ngắn. Tóm tắt một tài liệu. Chẳng việc nào cần đến flagship. Chạy tất cả trên Opus thì bạn đốt ngân sách sử dụng của gói nhanh gấp nhiều lần mức cần thiết, cho một kết quả y hệt. Sự lãng phí đó vô hình, và đó chính là lý do nó cộng dồn lại.
Adaptive Mode lấp khoảng cách đó. Trước khi bạn gửi tin nhắn đầu tiên, nó đọc bản nháp của bạn, ước lượng tác vụ thực sự khó đến đâu, và gợi ý mô hình rẻ nhất trong dải sản phẩm của provider mà vẫn làm tốt được việc. Các mô hình hạng nặng được dành riêng cho công việc xứng đáng với chúng: kiến trúc, kiểm toán bảo mật, các refactor lớn. Mọi thứ còn lại được định tuyến tới một mô hình chỉ tốn một phần nhỏ chi phí.
Vì sao nên ghép mô hình với tác vụ
Thôi trả dư cho các tác vụ dễ. Một flagship cho một lần sửa lỗi gõ là đốt tiền. Adaptive Mode hướng việc nhẹ tới một mô hình nhẹ, nên mỗi tác vụ vặt chỉ tốn một phần nhỏ so với khi chạy ở hạng cao nhất.
Để dành mô hình mạnh cho các bài toán khó. Chọn đúng cỡ không có nghĩa là lúc nào cũng đi rẻ. Khi tác vụ là một thiết kế hệ thống hay một kiểm toán bảo mật, Adaptive Mode bảo bạn nâng cấp, để công việc cần chiều sâu thực sự có được chiều sâu đó.
Nhiều tác vụ hơn mỗi ngày trên cùng một gói. Tốn ít ngân sách hơn cho mỗi tác vụ nghĩa là bạn chạm giới hạn sử dụng muộn hơn. Trải suốt một ngày và một đội agent chạy song song, phần tiết kiệm cộng dồn thành lượng công việc thực tăng thêm thật sự.
Không một chút ma sát nào trong luồng làm việc. Gợi ý hiện ra dưới dạng một chip nhỏ phía trên khung soạn tin trước khi bạn gửi. Một cú nhấp áp dụng nó. Không phải lục menu, không phải đoán bằng tay xem mô hình nào hợp, không bị chậm lại.
Bài toán kinh tế: tiêu ít hơn, làm nhiều hơn
Cùng các agent, cùng một gói. Khác biệt nằm ở chỗ mỗi tác vụ ngốn bao nhiêu ngân sách của bạn.
Một mô hình cho mọi thứ
- : Mọi tác vụ đều chạy trên mô hình bạn để nguyên đang chọn.
- : Một flagship cho một lỗi gõ hay một bản dịch tốn gấp nhiều lần mức đáng lẽ.
- : Ngân sách sử dụng của gói cạn nhanh trên công việc vốn chẳng cần đến sức mạnh đó.
- : Bạn chạm tường giới hạn sử dụng sớm hơn trong ngày và các agent khựng lại.
- : Đổi mô hình bằng tay rất lích kích, nên chẳng ai buồn làm.
Adaptive Mode bật
- : Mỗi tác vụ được ghép với mô hình rẻ nhất có thể làm tốt.
- : Việc nhẹ được định tuyến tới một mô hình nhẹ và chỉ tốn một phần nhỏ chi phí.
- : Flagship được để dành cho refactor, kiểm toán và kiến trúc.
- : Ít ngân sách hơn cho mỗi tác vụ nghĩa là nhiều tác vụ hơn trước bất kỳ giới hạn sử dụng nào.
- : Một cú nhấp áp dụng đúng mô hình, nên việc chọn đúng cỡ thực sự diễn ra.
Bản thân việc định tuyến gần như miễn phí: một mô hình nhỏ và nhanh làm phần phân tích với chi phí thấp hơn một cent rất nhiều, rồi nhường chỗ cho bạn.
Adaptive Mode hoạt động thế nào, từng bước
Nó chạy một lần, trước tin nhắn đầu tiên của bạn, và không bao giờ cản đường.
Bạn bắt đầu gõ prompt
Mở một cuộc trò chuyện mới với bất kỳ agent nào và viết ra điều bạn muốn làm. Adaptive Mode chỉ nhìn vào những cuộc trò chuyện hoàn toàn mới, nên nó không bao giờ làm gián đoạn một phiên đang chạy.
Nó đọc tác vụ và phân tích
Khi bản nháp của bạn đủ đầy đặn và bạn dừng lại một chút, Adaptive Mode gửi phần đầu bản nháp tới một mô hình định tuyến nhỏ và nhanh để đánh giá tác vụ đòi hỏi đến đâu.
Một gợi ý mô hình hiện ra
Một chip nổi lên phía trên khung soạn tin: 'Chuyển sang Haiku', 'Chuyển sang Sonnet' hoặc 'Chuyển sang Opus', tùy lựa chọn nào tiết kiệm nhất. Nếu mô hình hiện tại của bạn vốn đã là lựa chọn tốt nhất, nó sẽ báo bạn điều đó thay vì gợi ý đổi.
Bạn áp dụng chỉ với một cú nhấp
Nhấp vào chip và mô hình được áp dụng. Nếu một phiên đang chạy, Adaptive Mode chuyển nó ngay khi đang chạy. Lựa chọn cũng được lưu vào agent, nên lần khởi chạy sau bắt đầu bằng đúng mô hình.
Hoặc tính lại, hoặc bỏ qua
Viết lại prompt rồi à? Nhấn làm mới để tính lại đề xuất cho bản nháp mới. Hài lòng với mô hình hiện tại? Bỏ qua chip và gửi. Bạn nắm quyền kiểm soát mọi quyết định.
Sau đó nó im lặng
Adaptive Mode chỉ gợi ý một lần mỗi cuộc trò chuyện, nên nó không bao giờ làm phiền bạn hay âm thầm tiêu hết hạn mức tháng của bạn trong khi bạn còn đang chỉnh sửa. Làm xong việc của mình rồi biến mất.
Định tuyến mô hình không phụ thuộc provider
Adaptive Mode đọc dải mô hình của provider bạn đang dùng và đề xuất từ chính danh mục đó. Nó không bị trói vào một nhà cung cấp nào.
Claude
Định tuyến giữa Haiku, Sonnet và Opus. Haiku cho sửa lỗi nhanh, đổi tên, dịch thuật, test ngắn và tóm tắt. Sonnet cho review pull request, endpoint mới, gỡ lỗi phức tạp và refactor. Opus cho kiến trúc hệ thống, kiểm toán bảo mật, refactor legacy lớn và công việc tối ưu hiệu năng chuyên sâu.
Codex
Định tuyến trong dải Codex, từ mô hình mini nhanh và rẻ cho bug nhỏ và câu hỏi nhanh, tới mô hình mặc định cân bằng cho tính năng đầu cuối và test, lên tới mô hình suy luận flagship cho thiết kế hệ thống phức tạp và review code chuyên sâu.
Antigravity
Định tuyến giữa mô hình Antigravity nhanh cho sửa nhỏ, dịch thuật và tóm tắt, và mô hình Antigravity đủ mạnh để triển khai tính năng, gỡ lỗi và phân tích sâu hơn.
Các provider khác
Với bất kỳ provider nào, Adaptive Mode quay về một quy tắc đơn giản: mô hình rẻ nhất cho việc nhẹ, một mô hình cân bằng cho việc thường, mô hình mạnh nhất cho việc khó. Thêm một provider và nó định tuyến trong chính các mô hình của provider đó.
FAQ
Adaptive Mode trong AgentsRoom là gì?
Adaptive Mode là định tuyến mô hình thông minh cho các agent lập trình AI của bạn. Trước khi bạn gửi tin nhắn đầu tiên, nó đọc prompt của bạn và gợi ý mô hình tiết kiệm nhất trong dải sản phẩm của provider mà vẫn làm tốt được việc. Một tác vụ nhẹ nhận một mô hình nhẹ và rẻ; một tác vụ nặng nhận một flagship. Mục tiêu rất đơn giản: thôi trả dư cho một mô hình mạnh ở công việc vốn không cần đến nó.
Adaptive Mode chọn mô hình bằng cách nào?
Nó gửi phần đầu bản nháp của bạn tới một mô hình định tuyến nhỏ và nhanh, được hướng dẫn bằng các ví dụ về loại tác vụ nào hợp với hạng mô hình nào. Sau đó nó trả về mô hình rẻ nhất phù hợp với tác vụ, đã được kiểm chứng dựa trên những mô hình mà provider hiện tại của bạn thực sự cung cấp. Nếu mô hình hiện tại đã là lựa chọn tốt nhất, nó sẽ nói mô hình đang tối ưu thay vì thúc bạn đổi.
Việc này thực sự giúp tôi tiết kiệm tiền thế nào?
Các mô hình rẻ hơn chỉ tốn một phần nhỏ so với flagship cho cùng một tác vụ đơn giản. Nếu bạn chạy sửa lỗi gõ, đổi tên, dịch thuật và test ngắn trên mô hình hàng đầu, bạn đốt ngân sách sử dụng của gói nhanh gấp nhiều lần mức cần thiết. Adaptive Mode hướng phần việc nhẹ đó tới một mô hình nhẹ, nên mỗi tác vụ tốn ít hơn và bạn chạy được nhiều tác vụ hơn trước khi chạm giới hạn sử dụng. Trải suốt một ngày và rất nhiều agent chạy song song, phần tiết kiệm đó cộng dồn lại.
Nó có thể gợi ý những mô hình nào?
Bất cứ gì provider của bạn cung cấp. Trên Claude là Haiku, Sonnet và Opus. Trên Codex trải từ mô hình mini nhanh, mô hình mặc định cân bằng tới mô hình suy luận flagship. Trên Antigravity trải từ mô hình nhanh tới mô hình đủ mạnh. Với các provider khác, nó quay về rẻ nhất, cân bằng và mạnh nhất. Adaptive Mode đọc danh sách mô hình trực tiếp, nên luôn đề xuất một mô hình bạn thực sự chạy được.
Nó có tự đổi mô hình không?
Không. Adaptive Mode chỉ gợi ý. Bạn áp dụng thay đổi bằng một cú nhấp duy nhất lên chip. Nếu một phiên đang chạy, nó đổi mô hình ngay khi đang chạy; trong mọi trường hợp, lựa chọn được lưu vào agent để lần khởi chạy sau bắt đầu bằng đúng mô hình. Bạn cũng có thể bỏ qua gợi ý và giữ mô hình hiện tại.
Gợi ý xuất hiện khi nào?
Trên một cuộc trò chuyện hoàn toàn mới, sau khi bạn đã gõ một prompt đầy đặn và dừng lại một chút. Nó chạy một lần mỗi cuộc trò chuyện, nên không bao giờ làm gián đoạn một phiên đang diễn ra và không âm thầm tiêu hết hạn mức tháng của bạn trong khi bạn còn đang chỉnh sửa.
Tôi có thể tính lại gợi ý không?
Có. Nếu bạn viết lại prompt, nhấn nút làm mới trên chip để tính lại đề xuất cho bản nháp mới. Một lần tính lại thủ công dùng một trong số gợi ý hằng tháng của bạn, nên nó luôn sẵn sàng khi bạn cần mà không chạy theo từng phím gõ.
Prompt của tôi có riêng tư không?
Để tính một gợi ý, chỉ phần đầu bản nháp của bạn được gửi tới máy chủ AgentsRoom, một lần mỗi cuộc trò chuyện, và chỉ khi Adaptive Mode được bật. Bạn có thể tắt hẳn tính năng này trong cài đặt nếu thích tự chọn mô hình.
Adaptive Mode có hoạt động với Codex và Antigravity chứ không chỉ Claude không?
Có. Adaptive Mode không phụ thuộc provider. Nó đọc danh mục mô hình của provider mà agent đang dùng và đề xuất từ danh mục đó, dù là Claude, Codex, Antigravity hay một provider được hỗ trợ khác. Lệnh đổi mô hình được dựng cho đúng provider bạn đang dùng.
Làm sao để bật hoặc tắt Adaptive Mode?
Nó bật mặc định, vì chọn đúng cỡ mô hình tiết kiệm tiền ngay từ đầu. Bạn có thể tắt hoặc bật lại bất cứ lúc nào trong cài đặt AgentsRoom, ở mục Adaptive Model.
Kết hợp tốt với
Mức dùng token Claude Code
Xem mức tiêu thụ token và chi phí mỗi phiên theo thời gian thực. Đi đôi với Adaptive Mode: định tuyến khôn ngoan, rồi nhìn phần tiết kiệm hiện về.
Ủy thác agent
Một agent dev giao một bài test cho một agent QA rẻ hơn qua MCP. Cùng ý tưởng với Adaptive Mode, áp dụng cho cả agent.
Đa provider
Chạy Claude, Codex và Antigravity song song. Adaptive Mode định tuyến trong provider mà mỗi agent đang dùng.
Thống kê dự án
Thời gian, prompt, token và chi phí theo từng dự án và từng agent. Góc nhìn bảng điều khiển của khoản ngân sách mà Adaptive Mode giúp bạn bảo vệ.
Theo dõi trạng thái agent
Trạng thái trực tiếp của từng agent trên mọi dự án, để bạn luôn biết ai đang làm việc và ai đang cần đến bạn.
Khôi phục phiên
Thoát ra rồi quay lại với từng agent, terminal và lựa chọn mô hình đúng y nơi bạn đã rời đi.
Thôi trả dư cho sức mạnh mô hình AI mà bạn không cần
Tải AgentsRoom và để Adaptive Mode chọn mô hình tiết kiệm nhất cho từng tác vụ. Mô hình nhẹ cho việc nhẹ, flagship cho các bài toán khó, ít ngân sách bị đốt hơn cho mỗi tác vụ, nhiều tác vụ được hoàn thành hơn mỗi ngày.
Ứng dụng đồng hành: theo dõi agent khi đi đường
Sử dụng Claude, Codex, Antigravity CLI hoặc nhà cung cấp AI khác.
Gửi lỗi và yêu cầu thẳng vào backlog công khai của bạn.
Một cái nhìn về AgentsRoom đang hoạt động.