Adaptive Mode: routing intelligente dei modelli

Il modello IA giusto per ogni attività,
scelto in automatico, prima dell'invio

Adaptive Mode legge il prompt che stai per inviare e suggerisce il modello più conveniente per l'attività. Correggere un refuso o tradurre va verso un modello leggero ed economico. Un grande refactoring o la progettazione di un'architettura va verso un flagship. Scegli solo la potenza che ti serve davvero.

I modelli più piccoli costano una frazione del flagship. Dimensionare il modello su ogni attività significa bruciare molto meno del budget del tuo piano per attività, quindi fare più attività al giorno senza sbattere contro un limite di utilizzo. Un clic applica il suggerimento e tu continui a lavorare.

Adaptive Mode
Analisi dell'attività
Tradurre una stringa dell'interfaccia
Scelta migliore
Haiku
Sonnet
Opus
Costo per attivitàPiù attività al giorno

Adaptive Mode abbina ogni attività al modello più economico in grado di farla bene: Haiku per il lavoro leggero, Sonnet per il lavoro equilibrato, Opus per il lavoro pesante. Meno costo per attività, più attività al giorno.

Schermata di intento di AI Suggestion in AgentsRoom: agenti candidati, il campo di descrizione dell'attività, il provider, le cartelle coinvolte e la barra di complessità dell'attività a cinque livelli che mostra Haiku, Sonnet, Opus e Fable con il loro costo
Una sola frase decide l'agente, il modello e il nome della sessione, prima che parta la CLI.

Ecco il problema di soldi quando fai girare agenti di coding IA. Ogni modello ha un prezzo, e il divario tra quello economico e il flagship è enorme. Claude Opus è il modello più capace, e il più costoso. Claude Haiku è il più economico. Claude Sonnet sta nel mezzo. La maggior parte delle persone sceglie un modello e lo lascia lì, quindi o sottodimensiona le attività difficili o, molto più spesso, paga troppo per quelle facili.

Pensa a cosa chiedi davvero a un agente in una giornata. Correggere un refuso. Rinominare una variabile. Tradurre una stringa dell'interfaccia. Scrivere un breve test unitario. Riassumere un documento. Niente di tutto questo ha bisogno di un flagship. Se fai girare tutto su Opus, bruci il budget di utilizzo del tuo piano molte volte più in fretta del necessario, per un risultato identico. Questo spreco è invisibile, ed è proprio per questo che si accumula.

Adaptive Mode colma questo divario. Prima che tu invii il primo messaggio, legge la tua bozza, valuta quanto è davvero difficile l'attività e suggerisce il modello più economico della gamma del tuo provider che riesce comunque a fare bene il lavoro. I modelli pesanti restano riservati al lavoro che se li merita: architettura, audit di sicurezza, grandi refactoring. Tutto il resto va verso un modello che costa una frazione.

Perché adattare il modello all'attività

Smetti di pagare troppo per le attività facili. Un flagship su una correzione di refuso è denaro buttato. Adaptive Mode indirizza il lavoro leggero verso un modello leggero, così ogni attività banale costa una frazione di quanto costerebbe sulla fascia alta.

Tieni il modello potente per i problemi difficili. Dimensionare non vuol dire andare sempre sull'economico. Quando l'attività è una progettazione di sistema o un audit di sicurezza, Adaptive Mode ti dice di salire di fascia, così il lavoro che richiede profondità la ottiene davvero.

Più attività al giorno con lo stesso piano. Meno budget speso per attività significa raggiungere il limite di utilizzo più tardi. Nell'arco di un'intera giornata e con una flotta di agenti in parallelo, i risparmi si sommano in throughput reale in più.

Zero attrito nel workflow. Il suggerimento appare come un piccolo chip sopra il composer prima dell'invio. Un clic lo applica. Nessun menu da spulciare, nessuna scelta a mano su quale modello calzi, nessun rallentamento.

L'economia: consumare meno, fare di più

Stessi agenti, stesso piano. La differenza è quanto budget divora ogni attività.

Un solo modello per tutto

  • : Ogni attività gira sul modello che hai lasciato selezionato.
  • : Un flagship su un refuso o una traduzione costa molte volte più del dovuto.
  • : Il budget di utilizzo del tuo piano si svuota in fretta su lavoro che non ha mai avuto bisogno di quella potenza.
  • : Sbatti contro il limite di utilizzo prima nella giornata e gli agenti si bloccano.
  • : Cambiare modello a mano è scomodo, quindi nessuno lo fa.

Adaptive Mode attivo

  • : Ogni attività è abbinata al modello più economico in grado di farla bene.
  • : Il lavoro leggero va verso un modello leggero e costa una frazione.
  • : Il flagship è riservato a refactoring, audit e architettura.
  • : Meno budget per attività significa più attività prima di qualsiasi limite di utilizzo.
  • : Un clic applica il modello giusto, così il dimensionamento avviene davvero.

Il routing in sé è quasi gratuito: un modello piccolo e veloce fa l'analisi per molto meno di un centesimo, poi si toglie di mezzo.

AI Suggestion

Di' che cosa c'è da fare.
L'agente si apre sul modello giusto.

AI Suggestion sposta la stessa decisione più a monte, nell'unico momento in cui non costa nulla: prima che la sessione esista. Apri un agente e, invece di un terminale, trovi un unico campo che chiede che cosa sta per fare quell'agente. Rispondi in una frase. Una chiamata la legge e restituisce il modello, il nome della sessione e, se non hai scelto un agente, quale dovrebbe prendersi il lavoro.

Poi la sessione si apre, già impostata, con la tua frase come primo messaggio. Non hai incollato niente, non hai aspettato l'avvio della CLI per correggerla, e non hai pagato tariffa flagship per un refuso.

AI Suggestion
Prima dell'apertura della sessione
Correggere il refuso sul pulsante di login
Complessità dell'attività
Rapida
Standard
Complessa
Estrema
ModelloHaikual posto di Opus, il tuo modello predefinito
SessioneRefuso pulsante login

Entra una frase. Si accende un livello di complessità. L'agente si apre sul modello a cui quel livello corrisponde, con la sessione già battezzata.

Una sessione vera, dal campo vuoto all'agente che gira: una frase descrive l'attività, la barra di complessità si ferma su Sonnet, l'agente e il nome della sessione arrivano insieme a lei, e la sessione si apre con quella frase già inviata.

Perché la decisione deve arrivare prima dell'apertura della sessione

Stesso suggerimento, stesso modello, due esiti completamente diversi. L'unica variabile è quando ti viene posta la domanda.

Domanda posta dopo l'apertura del terminale

  • : La CLI è già partita sul modello che risultava configurato.
  • : Il tuo prompt è scritto e sei a un tasto dall'inviarlo.
  • : Cambiare modello adesso significa buttare la sessione che hai appena avviato.
  • : Il suggerimento viene vissuto come un'interruzione, quindi viene ignorato.
  • : Il flagship svolge comunque l'attività banale, e non si impara nulla.

Domanda posta prima che la sessione esista

  • : Non è ancora partito niente, quindi non c'è nulla da disfare.
  • : Stai già descrivendo l'attività, che è esattamente l'input di cui la decisione ha bisogno.
  • : Il modello, il nome della sessione e l'agente si risolvono in una sola chiamata.
  • : La sessione si apre configurata, con la tua descrizione come primo messaggio.
  • : Scegliere il modello economico non ti costa nulla, quindi succede davvero.

È tutta qui l'idea. Non un suggerimento più intelligente: lo stesso suggerimento, posto in un momento in cui dire di sì è gratis.

Quattro livelli, agganciati ai modelli reali del tuo provider

La barra di complessità è la parte visibile della decisione. Lasciala su Auto e l'analisi accende un livello. Clicca tu stesso un livello e diventa la tua decisione: non parte nulla, e la sessione si apre subito.

Rapida

01

Modifiche di testo o di configurazione, senza logica dietro. Un refuso, un'etichetta, una stringa di traduzione, un numero di versione. È il livello che un modello flagship non dovrebbe mai vedere, ed è quello che gli arriva più spesso.

Standard

02

Un piccolo cambiamento la cui soluzione è già nota. Aggiungere uno stato a un pulsante, collegare un componente che esiste già, scrivere un test breve. Non c'è nulla da investigare, solo lavoro da fare.

Complessa

03

Una funzionalità da costruire, un bug da investigare, un refactoring da portare a termine. La strada non è ovvia all'inizio, quindi il modello ha bisogno di margine per esplorare prima di impegnarsi su un approccio.

Estrema

04

Architettura, un audit, un problema senza causa nota. È per questo che il modello flagship esiste, ed è il fatto di riservarlo a queste attività che rende sostenibile usarlo qui.

Nel codice della funzionalità non è scritto nessun identificativo di modello. I quattro livelli vengono risolti dal catalogo del provider su cui gira l'agente, ordinato dal più capace al meno capace. Se quel provider offre meno di quattro modelli, la tabella si ripiega verso l'alto: con tre modelli, Complessa ed Estrema finiscono entrambe sul flagship, mai il contrario. Sottodimensionare rovina un'esecuzione intera; sovradimensionare costa la differenza di prezzo di una chiamata.

Come funziona AI Suggestion, passo dopo passo

Sei passaggi, quattro dei quali facoltativi, e una sola chiamata in tutto.

01

Apri un agente

Invece di un terminale, trovi la schermata di intento: il volto dell'agente su uno sfondo animato, una freccia che punta a un unico campo, e un link in alto a destra per aprire la sessione direttamente se non ne hai voglia.

02

Descrivi l'attività in una frase

In linguaggio corrente, nella tua lingua. Non è un prompt né una specifica: è quello che quell'agente sta per fare. Quella frase è l'unico input obbligatorio, e diventa il primo messaggio della sessione.

03

Facoltativo: indicare le cartelle coinvolte

Le cartelle del progetto compaiono come piccole pastiglie a forma di cartella. Cliccarne una dà all'agente il suo perimetro e affina la stima di difficoltà, perché lo stesso bug in un'app mobile e in un sito web non sono la stessa attività.

04

Facoltativo: aprire le opzioni avanzate

Ripiegate sotto il campo: la natura del lavoro, a chi è destinato, il risultato che ti aspetti, paletti come niente commit o test obbligatori, e contesto libero come un errore incollato o l'identificativo di un ticket. Viaggiano nella stessa chiamata e vengono messe in testa al primo prompt dell'agente.

05

Una sola chiamata decide, oppure nessuna chiamata

Lasciando su Auto, l'invio fa partire un'unica richiesta che restituisce il livello, il modello, il nome della sessione e, quando nessun agente è impostato, l'agente. Se invece clicchi tu stesso un livello non c'è nessuna richiesta: la sessione si apre subito sul modello a cui quel livello corrisponde.

06

La sessione si apre, già impostata

L'agente parte sul modello scelto, con il nome di sessione generato, e la tua descrizione arriva come primo messaggio attraverso l'argomento di avvio della CLI, invece di essere incollata nel terminale dopo l'avvio.

Nessun agente scelto

Non devi nemmeno scegliere l'agente

Se apri la schermata senza indicare un agente, la domanda si allarga. L'orbe mostra un punto interrogativo circondato da tre volti, e la frase che scrivi decide chi si prende l'attività: uno degli agenti già presenti nella tua room, uno dei quattordici ruoli integrati, oppure uno dei circa 260 esperti del catalogo.

È anche quello che ti dà adesso un progetto appena creato. Non crea più un agente full-stack in silenzio solo perché qualcosa andava creato. Chiede su cosa stai lavorando, poi sceglie l'agente che quella risposta richiede.

L'agente, il modello e il nome della sessione tornano dalla stessa unica chiamata, perché concatenare tre richieste triplicherebbe la latenza di una schermata il cui unico valore è essere più veloce che aprire il terminale e correggere il modello dopo.

Una domanda dopo l'apertura della sessione

Con l'agente ormai avviato, una barra sottile chiede una volta sola: il modello suggerito era quello giusto? Tre risposte: mi ha aiutato, troppo leggero, troppo pesante.

Tre e non due, perché «era sbagliato» non è utilizzabile. La direzione dell'errore invece lo è. Troppo leggero e troppo pesante sono correzioni opposte, e solo la direzione dice alla politica di dimensionamento da che parte spostarsi.

La barra non blocca mai nulla, la domanda arriva una volta per sessione, e la risposta viene inviata solo se hai attivato la condivisione dei dati di utilizzo.

Decidi tu, su tre livelli

Ignorala, saltala, o spegnila dove ti dà fastidio

Una schermata che si mette tra te e il tuo terminale deve essere banale da togliere di mezzo. Ci sono quattro vie d'uscita, e nessuna è sepolta in un menu.

Aprire direttamente

Un link in alto a destra della schermata apre la sessione esattamente come si sarebbe aperta prima che la funzionalità esistesse. Nessuna chiamata, nessuna analisi, nessuna attesa.

Decidere tu il livello

Cliccare un livello sulla barra lo trasforma nella tua decisione. Non parte nessuna richiesta, e la sessione si apre subito sul modello corrispondente.

Spenta per questo agente, questo progetto, o ovunque

L'impostazione si risolve prima sull'agente, poi sul progetto, poi sull'applicazione, così tieni la schermata per gli agenti in cui rende e la togli per quelli che apri sempre allo stesso modo.

Spenta da dove sei

I tre interruttori sono anche nel popover «Perché questa schermata?», sulla schermata stessa. La disattivi nel momento in cui ti dà fastidio, non tre menu più in là.

Gli agenti automatizzati non vedono mai la schermata: bot di QA, ticket del backlog, attività pianificate, mockup, step di team e agenti temporanei portano già il loro brief, e davanti a loro non è seduto nessuno.

Come funziona Adaptive Mode, passo per passo

Si esegue una volta, prima del tuo primo messaggio, e non ti intralcia mai.

01

Inizi a scrivere il tuo prompt

Apri una nuova conversazione con un agente qualsiasi e scrivi cosa vuoi che venga fatto. Adaptive Mode guarda solo le conversazioni nuove di zecca, quindi non interrompe mai una sessione già avviata.

02

Legge l'attività e la analizza

Non appena la tua bozza è abbastanza sostanziosa e fai una pausa, Adaptive Mode invia la prima parte della tua bozza a un modello di routing piccolo e veloce che valuta quanto è impegnativa l'attività.

03

Appare un suggerimento di modello

Un chip emerge sopra il composer: 'Passa a Haiku', 'Passa a Sonnet' o 'Passa a Opus', a seconda di quale sia la scelta più conveniente. Se il tuo modello attuale è già la scelta migliore, te lo dice invece.

04

Lo applichi con un clic

Clicca sul chip e il modello viene applicato. Se una sessione è già in corso, Adaptive Mode la cambia a caldo. La scelta viene anche salvata sull'agente, così il prossimo avvio parte sul modello giusto.

05

Oppure ricalcola, oppure ignora

Riformulato il tuo prompt? Premi aggiorna per ricalcolare la raccomandazione per la nuova bozza. Soddisfatto del tuo modello attuale? Ignora il chip e invia. Mantieni il controllo su ogni decisione.

06

Dopo resta in silenzio

Adaptive Mode suggerisce una volta per conversazione, quindi non ti assilla mai e non spende di nascosto la tua quota mensile mentre continui a modificare. Fa il suo lavoro, poi sparisce.

Routing dei modelli indipendente dal provider

Adaptive Mode legge la gamma di modelli del provider che stai usando e raccomanda da quel catalogo. Non è legato a nessun fornitore.

Claude

Instrada tra Haiku, Sonnet e Opus. Haiku per correzioni rapide, rinomini, traduzioni, test brevi e riassunti. Sonnet per revisioni di pull request, nuovi endpoint, debugging complesso e refactoring. Opus per architettura di sistema, audit di sicurezza, grandi refactoring legacy e lavoro approfondito sulle performance.

Codex

Instrada nella gamma Codex, dal modello mini veloce ed economico per piccoli bug e domande rapide, al modello equilibrato di default per funzionalità end-to-end e test, fino al modello di ragionamento flagship per la progettazione di sistemi complessi e la revisione del codice in profondità.

Antigravity

Instrada tra il modello Antigravity veloce per piccole correzioni, traduzioni e riassunti, e il modello Antigravity capace per implementare funzionalità, fare debugging e analisi più approfondite.

Altri provider

Per qualsiasi provider, Adaptive Mode ricade su una regola semplice: il modello più economico per il lavoro leggero, un modello equilibrato per il lavoro normale, il modello più capace per il lavoro difficile. Aggiungi un provider e instrada nei modelli di quel provider.

Funziona con il tuo provider
Claude, Codex, Antigravity e altri. I suggerimenti sono validati rispetto ai modelli che quel provider offre davvero, così non ricevi mai una raccomandazione che non puoi applicare.
Solo la tua bozza, solo quando serve
Per calcolare un suggerimento, la prima parte della tua bozza viene inviata ai server di AgentsRoom. Gira una volta per conversazione, su una conversazione nuova, e solo quando hai Adaptive Mode attivo.
Disattivato di default, attivo con un clic
Adaptive Mode arriva disattivato. Calcolare un suggerimento significa inviare la prima parte della tua bozza ai server di AgentsRoom, quindi la scelta spetta a te: attivalo dalle impostazioni di AgentsRoom, nelle opzioni del composer, e disattivalo dallo stesso posto quando vuoi.

FAQ

Cos'è Adaptive Mode in AgentsRoom?

Adaptive Mode è il routing intelligente dei modelli per i tuoi agenti di coding IA. Prima che tu invii il primo messaggio, legge il tuo prompt e suggerisce il modello più conveniente della gamma del tuo provider che riesce comunque a fare bene l'attività. Un'attività leggera riceve un modello leggero ed economico; un'attività pesante riceve un flagship. L'obiettivo è semplice: smettere di pagare troppo con un modello potente per lavoro che non ne ha bisogno.

Come fa Adaptive Mode a scegliere un modello?

Invia la prima parte della tua bozza a un modello di routing piccolo e veloce, guidato con esempi su quali tipi di attività si adattano a quale fascia di modello. Poi restituisce il modello più economico adatto all'attività, validato rispetto ai modelli che il tuo provider attuale offre davvero. Se il tuo modello attuale è già la scelta migliore, dice che il modello è ottimale invece di spingere un cambio.

Come mi fa risparmiare davvero?

I modelli più economici costano una frazione del flagship per la stessa attività semplice. Se fai girare correzioni di refusi, rinomini, traduzioni e test brevi sul modello di fascia alta, bruci il budget di utilizzo del tuo piano molte volte più in fretta del necessario. Adaptive Mode indirizza quel lavoro leggero verso un modello leggero, così ogni attività costa meno e puoi fare più attività prima di raggiungere un limite di utilizzo. Nell'arco di una giornata e con molti agenti in parallelo, questi risparmi si sommano.

Quali modelli può suggerire?

Quelli che offre il tuo provider. Su Claude sono Haiku, Sonnet e Opus. Su Codex copre il modello mini veloce, l'equilibrato di default e il modello di ragionamento flagship. Su Antigravity copre il modello veloce e quello capace. Per altri provider ricade su più economico, equilibrato e più capace. Adaptive Mode legge la lista dei modelli in tempo reale, così raccomanda sempre un modello che puoi davvero avviare.

Cambia il modello in automatico?

No. Adaptive Mode si limita a suggerire. Applichi il cambio con un singolo clic sul chip. Se una sessione è già in corso, cambia il modello a caldo; in ogni caso la scelta viene salvata sull'agente così il prossimo avvio parte sul modello giusto. Puoi anche ignorare il suggerimento e tenere il tuo modello attuale.

Quando appare il suggerimento?

Su una conversazione nuova di zecca, dopo che hai scritto un prompt sostanzioso e fatto una pausa. Gira una volta per conversazione, quindi non interrompe mai una sessione in corso e non spende mai di nascosto la tua quota mensile mentre continui a modificare.

Posso ricalcolare il suggerimento?

Sì. Se riscrivi il tuo prompt, premi il pulsante aggiorna sul chip per ricalcolare la raccomandazione per la nuova bozza. Un ricalcolo manuale usa uno dei tuoi suggerimenti mensili, così è lì quando ti serve senza girare a ogni battitura.

Il mio prompt è privato?

Per calcolare un suggerimento, solo la prima parte della tua bozza viene inviata ai server di AgentsRoom, una volta per conversazione e solo quando Adaptive Mode è attivo. Puoi disattivare la funzione del tutto dalle impostazioni se preferisci scegliere i modelli da solo.

Adaptive Mode funziona con Codex e Antigravity, non solo con Claude?

Sì. Adaptive Mode è indipendente dal provider. Legge il catalogo di modelli del provider che l'agente sta usando e raccomanda da quel catalogo, che sia Claude, Codex, Antigravity o un altro provider supportato. Il comando di cambio modello è costruito per il provider su cui ti trovi.

Come attivo o disattivo Adaptive Mode?

È disattivato di default. Apri le impostazioni di AgentsRoom, vai nelle opzioni del composer e spunta Adaptive Mode per attivarlo: la stessa casella lo disattiva. Finché è disattivato, nulla analizza la tua bozza e nulla che la riguardi lascia la tua macchina.

Che cos'è AI Suggestion in AgentsRoom?

AI Suggestion è una breve schermata mostrata prima che parta una sessione di agente. Descrivi l'attività in una frase, e una sola chiamata restituisce il modello più economico del catalogo del tuo provider in grado di fare il lavoro, un nome di sessione e, se non hai scelto un agente, quello che dovrebbe prenderselo. La sessione si apre poi già configurata, con la tua frase come primo messaggio.

E se so già quanto è difficile l'attività?

Clicca il livello sulla barra. Diventa la tua decisione, la chiamata viene saltata del tutto e la sessione si apre subito sul modello a cui quel livello corrisponde. La schermata è al massimo della velocità proprio quando conosci già la risposta.

Che succede se la chiamata fallisce o sono offline?

L'agente si apre comunque, sul modello che avrebbe usato senza la funzionalità. Rete morta, limite di utilizzo e risposta inutilizzabile finiscono tutti e tre allo stesso modo, perché una schermata capace di impedirti di aprire un agente sarebbe peggio di nessuna schermata. Quando la macchina è sicuramente offline, la schermata non viene proprio mostrata.

Può scegliere l'agente oltre al modello?

Sì, quando apri la schermata senza indicare un agente. L'attività viene confrontata con gli agenti già presenti nella tua room, i quattordici ruoli integrati e il catalogo di esperti. È anche quello che fa adesso un progetto appena creato, invece di creare in silenzio un agente full-stack perché qualcosa andava creato.

Va bene con

Approfondimenti

Smetti di pagare per potenza di modello IA che non ti serve

Scarica AgentsRoom e lascia che Adaptive Mode scelga il modello più conveniente per ogni attività. Modelli leggeri per il lavoro leggero, flagship per i problemi difficili, meno budget bruciato per attività, più attività consegnate al giorno.

GratisScarica AgentsRoom

App companion: monitora i tuoi agenti in movimento

Usa Claude, Codex, Antigravity CLI o un altro provider IA.

Installa l'estensione
Chrome Web Store

Invia bug e richieste direttamente nel tuo backlog pubblico.

Multi-progetto
Multi-provider
Multi-agente
Stato in tempo reale
Diff e commit
App mobile
Anteprima live
Team di agenti
Test browser
Dev guidata da backlog
Libreria di prompt
Libreria di skill
Vedi tutte le funzionalità