Adaptive Mode: slimme modelroutering

Het juiste AI-model voor elke taak,
automatisch gekozen, voordat je verzendt

Adaptive Mode leest de prompt die je wilt verzenden en stelt het meest kosteneffectieve model voor de taak voor. Een typefoutcorrectie of een vertaling wordt naar een licht, goedkoop model gerouteerd. Een grote herstructurering of een architectuurontwerp wordt naar een vlaggenschip gerouteerd. Je kiest alleen de kracht die je echt nodig hebt.

Kleinere modellen kosten een fractie van het vlaggenschip. Het juiste model kiezen voor elke taak betekent dat je veel minder van het budget van je plan per taak verbruikt, zodat je meer taken per dag kunt uitvoeren zonder een gebruiksgrens te bereiken. Eén klik past het voorstel toe en je blijft werken.

Adaptive Mode
Taak analyseren
Vertaal een UI-string
Beste match
Haiku
Sonnet
Opus
Kosten per taakMeer taken per dag

Adaptive Mode koppelt elke taak aan het goedkoopste model dat het goed kan doen: Haiku voor licht werk, Sonnet voor gebalanceerd werk, Opus voor zwaar werk. Minder kosten per taak, meer taken per dag.

Het intentiescherm van AI Suggestion in AgentsRoom: kandidaat-agents, het veld voor de taakbeschrijving, de provider, de betrokken mappen en de complexiteitsbalk van de taak met vijf niveaus, met Haiku, Sonnet, Opus en Fable en hun kosten
Eén zin bepaalt de agent, het model en de naam van de sessie, nog voordat de CLI start.

Hier is het geldprobleem met het uitvoeren van AI-coderingsagenten. Elk model heeft een prijs, en de kloof tussen de goedkope en de vlaggenschipmodellen is groot. Claude Opus is het meest capabele model, en het duurste. Claude Haiku is het goedkoopste. Claude Sonnet zit in het midden. De meeste mensen kiezen één model en laten het daarbij, zodat ze ofwel hun zware taken onderbelasten of, veel vaker, te veel betalen voor hun gemakkelijke taken.

Denk na over wat je een agent daadwerkelijk vraagt te doen op een dag. Corrigeer een typefout. Hernoem een variabele. Vertaal een UI-string. Schrijf een korte unittest. Vat een document samen. Geen van deze taken heeft een vlaggenschipmodel nodig. Voer alles uit op Opus en je verbruikt het gebruiksbudget van je plan veel sneller dan nodig is, voor een identiek resultaat. Die verspilling is onzichtbaar, wat precies de reden is waarom het optelt.

Adaptive Mode sluit die kloof. Voordat je je eerste bericht verzendt, leest het je concept, bepaalt hoe moeilijk de taak echt is, en stelt het goedkoopste model in de line-up van je provider voor dat de taak nog steeds goed kan uitvoeren. De zware modellen blijven gereserveerd voor het werk dat ze verdienen: architectuur, beveiligingsaudits, grote herstructureringen. Alles wat overblijft wordt gerouteerd naar een model dat een fractie kost.

Waarom het model aan de taak koppelen

Stop met te veel betalen voor gemakkelijke taken. Een vlaggenschipmodel voor een typefoutcorrectie is geld dat in brand wordt gestoken. Adaptive Mode stuurt licht werk naar een licht model, zodat elke triviale taak een fractie kost van wat het zou kosten op het hoogste niveau.

Bewaar het krachtige model voor de moeilijke problemen. Het juiste formaat kiezen gaat niet altijd om goedkoop gaan. Wanneer de taak een systeemontwerp of een beveiligingsaudit is, vertelt Adaptive Mode je om over te schakelen, zodat het werk dat diepte nodig heeft, het ook daadwerkelijk krijgt.

Meer taken per dag met hetzelfde plan. Minder budget per taak betekent dat je je gebruikslimiet later bereikt. Over een hele dag en een vloot van parallelle agenten, stapelen de besparingen zich op tot echte extra doorvoer.

Geen workflowwrijving. Het voorstel verschijnt als een kleine chip boven de composer voordat je verzendt. Eén klik past het toe. Geen menu's om door te zoeken, geen handmatige gokjes over welk model past, geen vertraging.

De economie: consumeer minder, doe meer

Dezelfde agents, hetzelfde plan. Het verschil is hoeveel van je budget elke taak opslokt.

Eén model voor alles

  • : Elke taak draait op welk model je ook geselecteerd hebt.
  • : Een vlaggenschipmodel voor een typefout of een vertaling kost vele malen meer dan zou moeten.
  • : Het gebruiksbudget van je plan raakt snel op door werk dat nooit de kracht nodig had.
  • : Je bereikt de gebruiksgrens eerder op de dag en de agents stagneren.
  • : Het handmatig wisselen van model is lastig, dus niemand doet het.

Adaptive Mode aan

  • : Elke taak wordt gekoppeld aan het goedkoopste model dat het goed kan uitvoeren.
  • : Licht werk wordt naar een licht model geleid en kost een fractie zoveel.
  • : Het vlaggenschip wordt bewaard voor refactors, audits en architectuur.
  • : Minder budget per taak betekent meer taken voordat er een gebruikslimiet is.
  • : Met één klik wordt het juiste model toegepast, zodat de juiste maatvoering daadwerkelijk gebeurt.

De routering zelf is bijna gratis: een klein, snel model doet de analyse voor minder dan een cent en gaat dan uit je weg.

AI Suggestion

Zeg wat er moet gebeuren.
De agent opent op het juiste model.

AI Suggestion haalt diezelfde beslissing naar voren, naar het ene moment waarop ze niets kost: voordat de sessie bestaat. Je opent een agent en in plaats van een terminal krijg je één veld dat vraagt wat deze agent gaat doen. Je antwoordt in één zin. Eén aanroep leest die zin en geeft het model terug, de sessienaam en, als je nog geen agent hebt gekozen, welke agent de taak moet oppakken.

Daarna opent de sessie, al ingesteld, met jouw zin als eerste bericht. Je hebt niets geplakt, je hebt niet gewacht tot de CLI was opgestart om het te corrigeren, en je hebt geen vlaggenschiptarief betaald voor een typefout.

AI Suggestion
Voordat de sessie opent
De typefout op de inlogknop herstellen
Complexiteit van de taak
Snel
Standaard
Complex
Extreem
ModelHaikuin plaats van Opus, je standaardmodel
SessieTypefout inlogknop

Er gaat één zin in. Eén complexiteitsniveau licht op. De agent opent op het model dat bij dat niveau hoort, met de sessie al benoemd.

Een echte sessie, van een leeg veld tot een draaiende agent: één zin beschrijft de taak, de complexiteitsbalk komt uit op Sonnet, de agent en de sessienaam komen daarmee mee, en de sessie opent met die zin al verstuurd.

Waarom de beslissing moet vallen voordat de sessie opent

Zelfde voorstel, zelfde model, twee totaal verschillende uitkomsten. De enige variabele is wanneer de vraag komt.

Gevraagd nadat de terminal is geopend

  • : De CLI is al opgestart op het model dat toevallig was ingesteld.
  • : Je prompt staat er en je bent één toets van verzenden verwijderd.
  • : Nu van model wisselen betekent de sessie weggooien die je net bent begonnen.
  • : Het voorstel voelt als een onderbreking, dus wordt het weggeklikt.
  • : Het vlaggenschip doet de triviale taak alsnog, en er wordt niets van geleerd.

Gevraagd voordat de sessie bestaat

  • : Er is nog niets gestart, dus valt er niets ongedaan te maken.
  • : Je bent de taak toch al aan het beschrijven, en dat is precies de invoer die de beslissing nodig heeft.
  • : Het model, de sessienaam en de agent worden in één aanroep vastgelegd.
  • : De sessie opent geconfigureerd, met jouw beschrijving als eerste bericht.
  • : Het goedkope model kiezen kost je niets, dus gebeurt het ook echt.

Dat is het hele idee. Geen slimmer voorstel: hetzelfde voorstel, gedaan op een moment waarop ja zeggen gratis is.

Vier niveaus, gekoppeld aan de echte modellen van je provider

De complexiteitsbalk is het zichtbare deel van de beslissing. Laat hem op Auto staan en de analyse laat één niveau oplichten. Klik zelf een niveau aan en het wordt jouw beslissing: er wordt niets verstuurd en de sessie opent meteen.

Snel

01

Tekst of configuratie aanpassen, zonder logica erachter. Een typefout, een label, een vertaalstring, een versienummer. Dit is het niveau dat een vlaggenschipmodel nooit zou moeten zien, en het is precies wat het het vaakst krijgt.

Standaard

02

Een kleine wijziging waarvan de oplossing al bekend is. Een status toevoegen aan een knop, een bestaand component aansluiten, een korte test schrijven. Er valt niets uit te zoeken, er is alleen werk te doen.

Complex

03

Een functie om te bouwen, een bug om uit te zoeken, een refactoring om door te voeren. De weg is aan het begin niet duidelijk, dus het model heeft ruimte nodig om te verkennen voordat het zich op een aanpak vastlegt.

Extreem

04

Architectuur, een audit, een probleem zonder bekende oorzaak. Hiervoor bestaat het vlaggenschipmodel, en juist door het voor dit soort taken te reserveren blijft het hier betaalbaar.

In de code van de functie staat geen enkele model-identifier. De vier niveaus worden afgeleid uit de catalogus van de provider waarop de agent draait, gesorteerd van meest naar minst capabel. Biedt die provider minder dan vier modellen, dan vouwt de tabel naar boven op: met drie modellen komen Complex en Extreem allebei op het vlaggenschip uit, nooit andersom. Te licht inschatten verpest een hele run; te zwaar inschatten kost het prijsverschil van één aanroep.

Hoe AI Suggestion werkt, stap voor stap

Zes stappen, waarvan vier optioneel, en één aanroep in totaal.

01

Je opent een agent

In plaats van een terminal krijg je het intentiescherm: het gezicht van de agent op een geanimeerde achtergrond, een pijl die naar één veld wijst, en rechtsboven een link om de sessie meteen te openen als je er geen zin in hebt.

02

Je beschrijft de taak in één zin

In gewone taal, in je eigen taal. Geen prompt en geen specificatie: gewoon wat deze agent gaat doen. Die zin is de enige verplichte invoer, en wordt het eerste bericht van de sessie.

03

Optioneel: de betrokken mappen aanwijzen

De mappen van het project verschijnen als kleine chips in de vorm van een map. Op een map klikken geeft de agent zijn bereik en scherpt de moeilijkheidsinschatting aan, want dezelfde bug in een mobiele app en op een website zijn niet dezelfde taak.

04

Optioneel: de geavanceerde opties openen

Opgevouwen onder het veld: de aard van het werk, voor wie het is, het verwachte resultaat, grenzen zoals niet committen of tests verplicht, en vrije context zoals een geplakte foutmelding of een ticketnummer. Ze reizen mee in dezelfde aanroep en worden vooraan de eerste prompt van de agent geplaatst.

05

Eén aanroep beslist, of helemaal geen aanroep

Laat je het op Auto staan, dan start verzenden één verzoek dat het niveau, het model, de sessienaam en, als er geen agent is vastgezet, de agent teruggeeft. Klik je zelf een niveau aan, dan is er geen verzoek: de sessie opent direct op het model dat bij dat niveau hoort.

06

De sessie opent, al ingesteld

De agent start op het gekozen model, onder de gegenereerde sessienaam, en jouw beschrijving komt binnen als eerste bericht via het eigen startargument van de CLI, in plaats van na het opstarten in de terminal te worden geplakt.

Geen agent gekozen

Je hoeft de agent niet eens te kiezen

Open je het scherm zonder een agent te noemen, dan wordt de vraag breder. De bol toont een vraagteken omringd door drie gezichten, en de zin die je typt bepaalt wie de taak oppakt: een van de agents die al in je room zitten, een van de veertien ingebouwde rollen, of een van de zo'n 260 experts uit de catalogus.

Dat is ook wat een gloednieuw project je nu geeft. Het maakt niet langer stilletjes een full-stack agent aan alleen omdat er iets aangemaakt moest worden. Het vraagt waar je aan werkt en kiest daarna de agent die bij dat antwoord past.

De agent, het model en de sessienaam komen uit diezelfde ene aanroep terug, want drie verzoeken achter elkaar zou de latentie verdrievoudigen van een scherm waarvan de hele waarde is dat het sneller is dan de terminal openen en het model achteraf corrigeren.

Eén vraag nadat de sessie is geopend

Zodra de agent draait, vraagt een dunne balk één keer: was het voorgestelde model het juiste? Drie antwoorden: het hielp, te licht, te zwaar.

Drie en niet twee, want 'dat was fout' is niet bruikbaar. De richting van de fout wel. Te licht en te zwaar zijn tegengestelde correcties, en alleen de richting vertelt het inschalingsbeleid welke kant het op moet.

De balk blokkeert nooit iets, de vraag komt één keer per sessie, en het antwoord wordt alleen verstuurd als je het delen van gebruiksgegevens hebt aanstaan.

Jij beslist, op drie niveaus

Negeer het, sla het over, of zet het uit waar het je stoort

Een scherm dat tussen jou en je terminal gaat staan, moet triviaal zijn om weg te krijgen. Er zijn vier uitgangen, en geen enkele ligt begraven in een menu.

Direct openen

Een link rechtsboven in het scherm opent de sessie precies zoals die geopend zou zijn voordat de functie bestond. Geen aanroep, geen analyse, geen vertraging.

Zelf het niveau bepalen

Een niveau op de balk aanklikken maakt er jouw beslissing van. Er gaat geen enkel verzoek uit, en de sessie opent meteen op het bijbehorende model.

Uit voor deze agent, dit project, of overal

De instelling wordt eerst op de agent opgelost, dan op het project, dan op de applicatie, zodat je het scherm houdt voor de agents waar het loont en het weglaat bij de agents die je altijd op dezelfde manier opent.

Uit vanaf waar je bent

De drie schakelaars zitten ook in de popover 'Waarom dit scherm?' op het scherm zelf. Je zet het uit op het moment dat het je stoort, niet drie menu's later.

Geautomatiseerde agents zien het scherm nooit: QA-bots, backlogtickets, geplande taken, mockups, teamstappen en tijdelijke agents dragen hun briefing al met zich mee, en er zit niemand voor te wachten.

Hoe Adaptive Mode werkt, stap voor stap

Het draait één keer, voordat je eerste bericht, en komt nooit in je weg.

01

Je begint je prompt te typen

Open een nieuw gesprek met een agent en schrijf wat je gedaan wilt hebben. Adaptive Mode kijkt alleen naar gloednieuwe gesprekken, zodat het nooit een sessie onderbreekt die al bezig is.

02

Het leest de taak en analyseert het

Zodra je concept substantieel genoeg is en je even pauzeert, stuurt Adaptive Mode het eerste deel van je concept naar een klein, snel routeringsmodel dat uitzoekt hoe veeleisend de taak is.

03

Een modelsuggestie verschijnt

Een chip verschijnt boven de composer: 'Schakel over naar Haiku', 'Schakel over naar Sonnet' of 'Schakel over naar Opus', welke de meest kosteneffectieve keuze is. Als je huidige model al de beste keuze is, vertelt het je dat in plaats daarvan.

04

Je past het toe met één klik

Klik op de chip en het model wordt toegepast. Als er al een sessie draait, schakelt Adaptive Mode live. De keuze wordt ook opgeslagen bij de agent, zodat de volgende start op het juiste model begint.

05

Of herbereken, of negeer

Heb je je prompt herschreven? Druk op vernieuwen om de aanbeveling voor het nieuwe concept te herberekenen. Tevreden met je huidige model? Negeer de chip en verzend. Je blijft de controle houden over elke oproep.

06

Daarna blijft het stil

Adaptive Mode doet één suggestie per gesprek, zodat het je nooit lastigvalt of stilletjes je maandelijkse budget uitgeeft terwijl je blijft bewerken. Het doet zijn werk en verdwijnt dan.

Provider-onafhankelijke modelroutering

Adaptive Mode leest de modellijn van welke provider je ook gebruikt en beveelt aan uit die catalogus. Het is niet gebonden aan één leverancier.

Claude

Routes over Haiku, Sonnet en Opus. Haiku voor snelle oplossingen, hernoemingen, vertalingen, korte tests en samenvattingen. Sonnet voor pull-request reviews, nieuwe eindpunten, complexe debugging en refactoren. Opus voor systeemarchitectuur, beveiligingsaudits, grote legacy refactoren en diepgaande prestatieverbeteringen.

Codex

Routes over de Codex-reeks, van het snelle, goedkope mini-model voor kleine bugs en snelle vragen, tot het gebalanceerde standaardmodel voor end-to-end functies en tests, tot het vlaggenschip redeneermodel voor complex systeemontwerp en diepgaande codebeoordeling.

Antigravity

Routes tussen het snelle Antigravity-model voor kleine oplossingen, vertalingen en samenvattingen, en het capabele Antigravity-model voor het implementeren van functies, debugging en diepere analyses.

Andere aanbieders

Voor elke aanbieder valt Adaptive Mode terug op een eenvoudige regel: het goedkoopste model voor licht werk, een gebalanceerd model voor normaal werk, het meest capabele model voor zwaar werk. Voeg een aanbieder toe en het routeert binnen de modellen van die aanbieder.

Werkt met jouw aanbieder
Claude, Codex, Antigravity en meer. Suggesties worden gevalideerd tegen de modellen die de aanbieder daadwerkelijk aanbiedt, zodat je nooit een aanbeveling krijgt die je niet kunt toepassen.
Alleen jouw concept, alleen wanneer nodig
Om een suggestie te berekenen, wordt het eerste deel van je concept naar AgentsRoom-servers gestuurd. Het draait één keer per gesprek, bij een nieuw gesprek, en alleen wanneer je Adaptive Mode hebt ingeschakeld.
Standaard uit, met één klik aan
Adaptive Mode staat standaard uit. Een suggestie berekenen betekent dat het eerste deel van je concept naar AgentsRoom-servers wordt gestuurd, dus die keuze is aan jou: schakel het in via de AgentsRoom-instellingen, bij de composer-opties, en zet het daar op elk moment weer uit.

FAQ

Wat is Adaptive Mode in AgentsRoom?

Adaptive Mode is slimme modelroutering voor je AI-coderingsagenten. Voordat je je eerste bericht verzendt, leest het je prompt en stelt het meest kosteneffectieve model in de reeks van je aanbieder voor dat de taak nog steeds goed kan uitvoeren. Een lichte taak krijgt een licht, goedkoop model; een zware taak krijgt een vlaggenschip. Het doel is eenvoudig: stop met te veel betalen met een krachtig model voor werk dat het niet nodig heeft.

Hoe kiest Adaptive Mode een model?

Het stuurt het eerste deel van je concept naar een klein, snel routeringsmodel dat is begeleid met voorbeelden van welke soorten taken bij welke modelcategorie passen. Het retourneert vervolgens het goedkoopste model dat bij de taak past, gevalideerd tegen de modellen die je huidige aanbieder daadwerkelijk aanbiedt. Als je huidige model al de beste keuze is, zegt het dat het model optimaal is in plaats van een wijziging door te voeren.

Hoe bespaart dit me daadwerkelijk geld?

Goedkopere modellen kosten een fractie van het vlaggenschip voor dezelfde eenvoudige taak. Als je typefouten, hernoemingen, vertalingen en korte tests uitvoert op het topmodel, verbruik je het gebruiksbudget van je plan veel sneller dan nodig is. Adaptive Mode routeert dat lichte werk naar een licht model, zodat elke taak minder kost en je meer taken kunt uitvoeren voordat je een gebruikslimiet bereikt. Gedurende een dag en met veel parallelle agenten stapelen die besparingen zich op.

Welke modellen kan het voorstellen?

Wat je aanbieder ook aanbiedt. Bij Claude zijn dat Haiku, Sonnet en Opus. Bij Codex omvat het het snelle mini-model, het gebalanceerde standaardmodel en het vlaggenschip redeneermodel. Bij Antigravity omvat het de snelle en de capabele modellen. Voor andere aanbieders valt het terug op goedkoopste, gebalanceerd en meest capabel. Adaptive Mode leest de live modellijst, zodat het altijd een model aanbeveelt dat je daadwerkelijk kunt uitvoeren.

Schakelt het model automatisch?

Nee. Adaptive Mode doet alleen suggesties. Je past de wijziging toe met een enkele klik op de chip. Als een sessie al draait, schakelt het model live; in elk geval wordt de keuze opgeslagen bij de agent, zodat de volgende start op het juiste model begint. Je kunt de suggestie ook negeren en je huidige model behouden.

Wanneer verschijnt de suggestie?

Bij een gloednieuw gesprek, nadat je een substantiële prompt hebt getypt en even hebt gepauzeerd. Het draait één keer per gesprek, zodat het nooit een lopende sessie onderbreekt en nooit stilletjes je maandelijkse tegoed uitgeeft terwijl je blijft bewerken.

Kan ik de suggestie opnieuw berekenen?

Ja. Als je je prompt herschrijft, druk je op de vernieuwknop op de chip om de aanbeveling voor het nieuwe concept opnieuw te berekenen. Een handmatige herberekening gebruikt een van je maandelijkse suggesties, zodat het er is wanneer je het wilt zonder bij elke toetsaanslag te draaien.

Is mijn prompt privé?

Om een suggestie te berekenen, wordt alleen het eerste deel van je concept naar AgentsRoom-servers gestuurd, één keer per gesprek, en alleen wanneer Adaptive Mode is ingeschakeld. Je kunt de functie volledig uitschakelen via de instellingen als je liever zelf modellen kiest.

Werkt Adaptive Mode met Codex en Antigravity, niet alleen met Claude?

Ja. Adaptive Mode is provider-onafhankelijk. Het leest de modelcatalogus van welke provider de agent ook gebruikt en beveelt aan uit die catalogus, of dat nu Claude, Codex, Antigravity of een andere ondersteunde provider is. Het model-switch commando is gebouwd voor de provider die je gebruikt.

Hoe schakel ik Adaptive Mode in of uit?

Het staat standaard uit. Open de AgentsRoom-instellingen, ga naar de composer-opties en vink Adaptive Mode aan om het in te schakelen: hetzelfde selectievakje schakelt het weer uit. Zolang het uit staat, analyseert niets je concept en verlaat niets daarvan je machine.

Wat is AI Suggestion in AgentsRoom?

AI Suggestion is een kort scherm dat verschijnt voordat een agentsessie start. Je beschrijft de taak in één zin, en één aanroep geeft het goedkoopste model uit de catalogus van je provider terug dat de klus aankan, een sessienaam en, als je nog geen agent hebt gekozen, de agent die de taak moet oppakken. Daarna opent de sessie al geconfigureerd, met jouw zin als eerste bericht.

En als ik al weet hoe zwaar de taak is?

Klik het niveau aan op de balk. Het wordt jouw beslissing, de aanroep wordt volledig overgeslagen en de sessie opent meteen op het model dat bij dat niveau hoort. Het scherm is op zijn snelst juist wanneer je het antwoord al weet.

Wat gebeurt er als de aanroep mislukt of ik offline ben?

De agent opent alsnog, op het model dat hij zonder de functie ook gebruikt zou hebben. Een dood netwerk, een gebruikslimiet en een onbruikbaar antwoord eindigen alle drie hetzelfde, want een scherm dat je kan tegenhouden bij het openen van een agent zou erger zijn dan helemaal geen scherm. Wanneer de machine aantoonbaar offline is, wordt het scherm sowieso niet getoond.

Kan het naast het model ook de agent kiezen?

Ja, wanneer je het scherm opent zonder een agent te noemen. De taak wordt afgezet tegen de agents die al in je room zitten, de veertien ingebouwde rollen en de expertcatalogus. Het is ook wat een gloednieuw project nu doet, in plaats van stilletjes een full-stack agent aan te maken omdat er iets aangemaakt moest worden.

Gaat goed samen met

Meer over dit onderwerp

Stop met te veel betalen voor AI-modelkracht die je niet nodig hebt

Download AgentsRoom en laat Adaptive Mode het meest kosteneffectieve model voor elke taak kiezen. Lichte modellen voor licht werk, vlaggenschepen voor de moeilijke problemen, minder budget verbrand per taak, meer taken per dag voltooid.

GratisDownload AgentsRoom

Companion-app: houd je agents onderweg in de gaten

Breng je eigen: Claude, Codex, Antigravity CLI of andere AI-provider.

Download de extensie
Chrome Web Store

Stuur bugs en verzoeken direct naar je openbare backlog.

Meerdere projecten
Multi-provider
Meerdere agenten
Live status
Bestandsverschil & commit
Mobiele metgezel
Live voorbeeld
Agententeams
Browserautomatisering
Backlog-gedreven ontwikkeling
Promptbibliotheek
Vaardighedenbibliotheek
Bekijk alle functies