Das richtige KI-Modell für jede Aufgabe,
automatisch gewählt, schon vor dem Absenden
Adaptive Mode liest den Prompt, den du gleich absenden willst, und schlägt das kosteneffizienteste Modell für die Aufgabe vor. Eine Tippfehler-Korrektur oder eine Übersetzung geht an ein leichtes, günstiges Modell. Ein großes Refactoring oder ein Architekturentwurf geht an ein Flaggschiff. Du wählst nur die Leistung, die du wirklich brauchst.
Kleinere Modelle kosten einen Bruchteil des Flaggschiffs. Wenn du das Modell pro Aufgabe richtig dimensionierst, verbrauchst du pro Aufgabe deutlich weniger von deinem Tarifbudget, also schaffst du mehr Aufgaben pro Tag, ohne an eine Nutzungsgrenze zu stoßen. Ein Klick übernimmt den Vorschlag und du arbeitest weiter.
Adaptive Mode ordnet jede Aufgabe dem günstigsten Modell zu, das sie gut erledigt: Haiku für leichte Arbeit, Sonnet für ausgewogene Arbeit, Opus für schwere Arbeit. Weniger Kosten pro Aufgabe, mehr Aufgaben pro Tag.
Hier ist das Geldproblem beim Betrieb von KI-Coding-Agenten. Jedes Modell hat einen Preis, und die Lücke zwischen dem günstigen und dem Flaggschiff ist groß. Claude Opus ist das leistungsstärkste Modell und das teuerste. Claude Haiku ist das günstigste. Claude Sonnet liegt dazwischen. Die meisten wählen ein Modell und lassen es dabei, also dimensionieren sie ihre schweren Aufgaben entweder zu schwach oder, weit häufiger, überzahlen für ihre leichten.
Denk daran, was du einen Agenten an einem Tag tatsächlich machen lässt. Einen Tippfehler beheben. Eine Variable umbenennen. Einen UI-Text übersetzen. Einen kurzen Unit-Test schreiben. Ein Dokument zusammenfassen. Nichts davon braucht ein Flaggschiff. Lässt du alles auf Opus laufen, verbrennst du dein Nutzungsbudget um ein Vielfaches schneller als nötig, für ein identisches Ergebnis. Diese Verschwendung ist unsichtbar, und genau deshalb summiert sie sich.
Adaptive Mode schließt diese Lücke. Bevor du deine erste Nachricht absendest, liest er deinen Entwurf, schätzt ein, wie schwer die Aufgabe wirklich ist, und schlägt das günstigste Modell aus der Reihe deines Providers vor, das die Arbeit trotzdem gut erledigt. Die schweren Modelle bleiben für die Arbeit reserviert, die sie verdient: Architektur, Sicherheitsaudits, große Refactorings. Alles andere geht an ein Modell, das einen Bruchteil kostet.
Warum das Modell zur Aufgabe passen sollte
Hör auf, für leichte Aufgaben zu überzahlen. Ein Flaggschiff für eine Tippfehler-Korrektur ist verbranntes Geld. Adaptive Mode lenkt leichte Arbeit zu einem leichten Modell, sodass jede triviale Aufgabe einen Bruchteil dessen kostet, was sie in der Oberklasse kosten würde.
Behalte das starke Modell für die harten Probleme. Richtig dimensionieren heißt nicht, immer günstig zu gehen. Wenn die Aufgabe ein Systementwurf oder ein Sicherheitsaudit ist, rät dir Adaptive Mode hochzuschalten, damit die Arbeit, die Tiefe braucht, sie auch bekommt.
Mehr Aufgaben pro Tag mit demselben Tarif. Weniger Budget pro Aufgabe bedeutet, dass du deine Nutzungsgrenze später erreichst. Über einen ganzen Tag und eine Flotte paralleler Agenten summieren sich die Einsparungen zu echtem zusätzlichen Durchsatz.
Null Reibung im Workflow. Der Vorschlag erscheint als kleiner Chip über dem Composer, bevor du absendest. Ein Klick übernimmt ihn. Keine Menüs zum Durchsuchen, kein manuelles Raten, welches Modell passt, kein Ausbremsen.
Die Ökonomie: weniger verbrauchen, mehr erledigen
Gleiche Agenten, gleicher Tarif. Der Unterschied ist, wie viel Budget jede Aufgabe frisst.
Ein Modell für alles
- : Jede Aufgabe läuft auf dem Modell, das du zuletzt ausgewählt hast.
- : Ein Flaggschiff für einen Tippfehler oder eine Übersetzung kostet ein Vielfaches dessen, was es sollte.
- : Dein Nutzungsbudget leert sich schnell bei Arbeit, die die Leistung nie gebraucht hat.
- : Du stößt früher am Tag an die Nutzungsgrenze und die Agenten stocken.
- : Das Modell von Hand zu wechseln ist umständlich, also macht es niemand.
Adaptive Mode an
- : Jede Aufgabe wird dem günstigsten Modell zugeordnet, das sie gut erledigt.
- : Leichte Arbeit geht an ein leichtes Modell und kostet einen Bruchteil.
- : Das Flaggschiff bleibt für Refactorings, Audits und Architektur reserviert.
- : Weniger Budget pro Aufgabe bedeutet mehr Aufgaben vor jeder Nutzungsgrenze.
- : Ein Klick übernimmt das richtige Modell, sodass das Dimensionieren wirklich passiert.
Das Routing selbst ist nahezu kostenlos: ein kleines, schnelles Modell erledigt die Analyse für deutlich weniger als einen Cent und geht dir dann aus dem Weg.
So funktioniert Adaptive Mode, Schritt für Schritt
Er läuft einmal, vor deiner ersten Nachricht, und steht dir nie im Weg.
Du fängst an, deinen Prompt zu tippen
Öffne eine frische Unterhaltung mit einem beliebigen Agenten und schreib, was erledigt werden soll. Adaptive Mode schaut nur auf brandneue Unterhaltungen, also unterbricht er nie eine Sitzung, die schon läuft.
Er liest die Aufgabe und analysiert sie
Sobald dein Entwurf umfangreich genug ist und du kurz innehältst, sendet Adaptive Mode den ersten Teil deines Entwurfs an ein kleines, schnelles Routing-Modell, das einschätzt, wie anspruchsvoll die Aufgabe ist.
Ein Modellvorschlag erscheint
Ein Chip taucht über dem Composer auf: 'Zu Haiku wechseln', 'Zu Sonnet wechseln' oder 'Zu Opus wechseln', je nachdem, was am kosteneffizientesten passt. Ist dein aktuelles Modell bereits die beste Wahl, sagt er dir stattdessen das.
Du übernimmst es mit einem Klick
Klick auf den Chip und das Modell wird übernommen. Läuft schon eine Sitzung, wechselt Adaptive Mode sie live. Die Wahl wird außerdem beim Agenten gespeichert, sodass der nächste Start mit dem richtigen Modell beginnt.
Oder neu berechnen, oder verwerfen
Deinen Prompt umformuliert? Tipp auf Aktualisieren, um die Empfehlung für den neuen Entwurf neu zu berechnen. Zufrieden mit deinem aktuellen Modell? Verwirf den Chip und sende ab. Du behältst die Kontrolle über jede Entscheidung.
Danach bleibt er still
Adaptive Mode schlägt einmal pro Unterhaltung vor, also nervt er dich nie und verbraucht nicht heimlich dein Monatskontingent, während du weiter editierst. Er macht seine Arbeit und verschwindet dann.
Provider-unabhängiges Modell-Routing
Adaptive Mode liest die Modellreihe des Providers, den du gerade nutzt, und empfiehlt aus diesem Katalog. Er ist an keinen Anbieter gebunden.
Claude
Routet zwischen Haiku, Sonnet und Opus. Haiku für schnelle Korrekturen, Umbenennungen, Übersetzungen, kurze Tests und Zusammenfassungen. Sonnet für Pull-Request-Reviews, neue Endpunkte, komplexes Debugging und Refactorings. Opus für Systemarchitektur, Sicherheitsaudits, große Legacy-Refactorings und tiefe Performance-Arbeit.
Codex
Routet durch die Codex-Reihe, vom schnellen, günstigen Mini-Modell für kleine Bugs und schnelle Fragen über das ausgewogene Standardmodell für End-to-End-Features und Tests bis zum Flaggschiff-Reasoning-Modell für komplexes Systemdesign und tiefe Code-Reviews.
Antigravity
Routet zwischen dem schnellen Antigravity-Modell für kleine Korrekturen, Übersetzungen und Zusammenfassungen und dem leistungsfähigen Antigravity-Modell für das Umsetzen von Features, Debugging und tiefere Analysen.
Andere Provider
Für jeden Provider greift Adaptive Mode auf eine einfache Regel zurück: das günstigste Modell für leichte Arbeit, ein ausgewogenes Modell für normale Arbeit, das leistungsstärkste Modell für schwere Arbeit. Füge einen Provider hinzu und er routet innerhalb der Modelle dieses Providers.
FAQ
Was ist Adaptive Mode in AgentsRoom?
Adaptive Mode ist intelligentes Modell-Routing für deine KI-Coding-Agenten. Bevor du deine erste Nachricht absendest, liest er deinen Prompt und schlägt das kosteneffizienteste Modell aus der Reihe deines Providers vor, das die Aufgabe trotzdem gut erledigt. Eine leichte Aufgabe bekommt ein leichtes, günstiges Modell; eine schwere Aufgabe bekommt ein Flaggschiff. Das Ziel ist einfach: hör auf, mit einem starken Modell für Arbeit zu überzahlen, die es nicht braucht.
Wie wählt Adaptive Mode ein Modell?
Er sendet den ersten Teil deines Entwurfs an ein kleines, schnelles Routing-Modell, das mit Beispielen angeleitet wurde, welche Arten von Aufgaben zu welcher Modellklasse passen. Dann liefert es das günstigste Modell zurück, das zur Aufgabe passt, geprüft gegen die Modelle, die dein aktueller Provider tatsächlich anbietet. Ist dein aktuelles Modell bereits die beste Wahl, sagt es, dass das Modell optimal ist, statt einen Wechsel zu erzwingen.
Wie spart mir das tatsächlich Geld?
Günstigere Modelle kosten für dieselbe einfache Aufgabe einen Bruchteil des Flaggschiffs. Wenn du Tippfehler-Korrekturen, Umbenennungen, Übersetzungen und kurze Tests auf dem Spitzenmodell laufen lässt, verbrennst du dein Nutzungsbudget um ein Vielfaches schneller als nötig. Adaptive Mode lenkt diese leichte Arbeit zu einem leichten Modell, sodass jede Aufgabe weniger kostet und du mehr Aufgaben erledigen kannst, bevor du an eine Nutzungsgrenze stößt. Über einen Tag und viele parallele Agenten summieren sich diese Einsparungen.
Welche Modelle kann er vorschlagen?
Was auch immer dein Provider anbietet. Bei Claude sind das Haiku, Sonnet und Opus. Bei Codex reicht es vom schnellen Mini-Modell über das ausgewogene Standardmodell bis zum Flaggschiff-Reasoning-Modell. Bei Antigravity umfasst es das schnelle und das leistungsfähige Modell. Für andere Provider greift er auf günstigstes, ausgewogenes und leistungsstärkstes Modell zurück. Adaptive Mode liest die Live-Modellliste, also empfiehlt er immer ein Modell, das du auch wirklich starten kannst.
Wechselt er das Modell automatisch?
Nein. Adaptive Mode schlägt nur vor. Du übernimmst die Änderung mit einem einzigen Klick auf den Chip. Läuft schon eine Sitzung, wechselt er das Modell live; in jedem Fall wird die Wahl beim Agenten gespeichert, sodass der nächste Start mit dem richtigen Modell beginnt. Du kannst den Vorschlag auch verwerfen und dein aktuelles Modell behalten.
Wann erscheint der Vorschlag?
Bei einer brandneuen Unterhaltung, nachdem du einen umfangreichen Prompt getippt und kurz innegehalten hast. Er läuft einmal pro Unterhaltung, also unterbricht er nie eine laufende Sitzung und verbraucht nie heimlich dein Monatskontingent, während du weiter editierst.
Kann ich den Vorschlag neu berechnen?
Ja. Wenn du deinen Prompt umschreibst, tipp auf den Aktualisieren-Button am Chip, um die Empfehlung für den neuen Entwurf neu zu berechnen. Eine manuelle Neuberechnung nutzt einen deiner monatlichen Vorschläge, also ist sie da, wenn du sie brauchst, ohne bei jedem Tastendruck zu laufen.
Ist mein Prompt privat?
Um einen Vorschlag zu berechnen, wird nur der erste Teil deines Entwurfs an die AgentsRoom-Server gesendet, einmal pro Unterhaltung und nur wenn Adaptive Mode aktiviert ist. Du kannst die Funktion in den Einstellungen ganz abschalten, wenn du Modelle lieber selbst wählst.
Funktioniert Adaptive Mode mit Codex und Antigravity, nicht nur mit Claude?
Ja. Adaptive Mode ist provider-unabhängig. Er liest den Modellkatalog des Providers, den der Agent gerade nutzt, und empfiehlt aus diesem Katalog, ob das nun Claude, Codex, Antigravity oder ein anderer unterstützter Provider ist. Der Befehl zum Modellwechsel ist für den Provider gebaut, auf dem du bist.
Wie schalte ich Adaptive Mode an oder aus?
Er ist standardmäßig an, weil das richtige Dimensionieren des Modells von Anfang an Geld spart. Du kannst ihn jederzeit in den AgentsRoom-Einstellungen unter Adaptive Model deaktivieren oder wieder aktivieren.
Passt gut zu
Claude Code Token-Verbrauch
Sieh Token-Verbrauch und Kosten pro Sitzung in Echtzeit. Passt zu Adaptive Mode: clever routen, dann zusehen, wie die Einsparungen landen.
Agenten-Delegation
Ein Dev-Agent gibt einen Test über MCP an einen günstigeren QA-Agenten ab. Dieselbe Idee wie Adaptive Mode, angewandt auf ganze Agenten.
Multi-Provider
Lass Claude, Codex und Antigravity nebeneinander laufen. Adaptive Mode routet innerhalb des Providers, auf dem jeder Agent gerade ist.
Projektstatistiken
Zeit, Prompts, Tokens und Kosten pro Projekt und pro Agent. Die Dashboard-Sicht auf das Budget, das Adaptive Mode dir schützen hilft.
Agenten-Status-Tracking
Live-Status für jeden Agenten über alle Projekte, sodass du immer weißt, wer arbeitet und wer dich braucht.
Sitzung wiederherstellen
Beende und komm zurück, mit jedem Agenten, Terminal und jeder Modellauswahl genau dort, wo du sie verlassen hast.
Hör auf, für KI-Modell-Leistung zu zahlen, die du nicht brauchst
Lade AgentsRoom herunter und lass Adaptive Mode für jede Aufgabe das kosteneffizienteste Modell wählen. Leichte Modelle für leichte Arbeit, Flaggschiffe für die harten Probleme, weniger verbranntes Budget pro Aufgabe, mehr ausgelieferte Aufgaben pro Tag.
Companion-App: Agenten auch unterwegs im Blick behalten
Nutzen Sie Claude, Codex, Antigravity CLI oder einen anderen AI-Anbieter.
Bugs und Wünsche direkt in dein öffentliches Backlog schicken.
Ein Blick auf AgentsRoom in Aktion.