Adaptive Mode: intelligentes Modell-Routing

Das richtige KI-Modell für jede Aufgabe,
automatisch gewählt, schon vor dem Absenden

Adaptive Mode liest den Prompt, den du gleich absenden willst, und schlägt das kosteneffizienteste Modell für die Aufgabe vor. Eine Tippfehler-Korrektur oder eine Übersetzung geht an ein leichtes, günstiges Modell. Ein großes Refactoring oder ein Architekturentwurf geht an ein Flaggschiff. Du wählst nur die Leistung, die du wirklich brauchst.

Kleinere Modelle kosten einen Bruchteil des Flaggschiffs. Wenn du das Modell pro Aufgabe richtig dimensionierst, verbrauchst du pro Aufgabe deutlich weniger von deinem Tarifbudget, also schaffst du mehr Aufgaben pro Tag, ohne an eine Nutzungsgrenze zu stoßen. Ein Klick übernimmt den Vorschlag und du arbeitest weiter.

Adaptive Mode
Aufgabe wird analysiert
Einen UI-Text übersetzen
Beste Wahl
Haiku
Sonnet
Opus
Kosten pro AufgabeMehr Aufgaben pro Tag

Adaptive Mode ordnet jede Aufgabe dem günstigsten Modell zu, das sie gut erledigt: Haiku für leichte Arbeit, Sonnet für ausgewogene Arbeit, Opus für schwere Arbeit. Weniger Kosten pro Aufgabe, mehr Aufgaben pro Tag.

Hier ist das Geldproblem beim Betrieb von KI-Coding-Agenten. Jedes Modell hat einen Preis, und die Lücke zwischen dem günstigen und dem Flaggschiff ist groß. Claude Opus ist das leistungsstärkste Modell und das teuerste. Claude Haiku ist das günstigste. Claude Sonnet liegt dazwischen. Die meisten wählen ein Modell und lassen es dabei, also dimensionieren sie ihre schweren Aufgaben entweder zu schwach oder, weit häufiger, überzahlen für ihre leichten.

Denk daran, was du einen Agenten an einem Tag tatsächlich machen lässt. Einen Tippfehler beheben. Eine Variable umbenennen. Einen UI-Text übersetzen. Einen kurzen Unit-Test schreiben. Ein Dokument zusammenfassen. Nichts davon braucht ein Flaggschiff. Lässt du alles auf Opus laufen, verbrennst du dein Nutzungsbudget um ein Vielfaches schneller als nötig, für ein identisches Ergebnis. Diese Verschwendung ist unsichtbar, und genau deshalb summiert sie sich.

Adaptive Mode schließt diese Lücke. Bevor du deine erste Nachricht absendest, liest er deinen Entwurf, schätzt ein, wie schwer die Aufgabe wirklich ist, und schlägt das günstigste Modell aus der Reihe deines Providers vor, das die Arbeit trotzdem gut erledigt. Die schweren Modelle bleiben für die Arbeit reserviert, die sie verdient: Architektur, Sicherheitsaudits, große Refactorings. Alles andere geht an ein Modell, das einen Bruchteil kostet.

Warum das Modell zur Aufgabe passen sollte

Hör auf, für leichte Aufgaben zu überzahlen. Ein Flaggschiff für eine Tippfehler-Korrektur ist verbranntes Geld. Adaptive Mode lenkt leichte Arbeit zu einem leichten Modell, sodass jede triviale Aufgabe einen Bruchteil dessen kostet, was sie in der Oberklasse kosten würde.

Behalte das starke Modell für die harten Probleme. Richtig dimensionieren heißt nicht, immer günstig zu gehen. Wenn die Aufgabe ein Systementwurf oder ein Sicherheitsaudit ist, rät dir Adaptive Mode hochzuschalten, damit die Arbeit, die Tiefe braucht, sie auch bekommt.

Mehr Aufgaben pro Tag mit demselben Tarif. Weniger Budget pro Aufgabe bedeutet, dass du deine Nutzungsgrenze später erreichst. Über einen ganzen Tag und eine Flotte paralleler Agenten summieren sich die Einsparungen zu echtem zusätzlichen Durchsatz.

Null Reibung im Workflow. Der Vorschlag erscheint als kleiner Chip über dem Composer, bevor du absendest. Ein Klick übernimmt ihn. Keine Menüs zum Durchsuchen, kein manuelles Raten, welches Modell passt, kein Ausbremsen.

Die Ökonomie: weniger verbrauchen, mehr erledigen

Gleiche Agenten, gleicher Tarif. Der Unterschied ist, wie viel Budget jede Aufgabe frisst.

Ein Modell für alles

  • : Jede Aufgabe läuft auf dem Modell, das du zuletzt ausgewählt hast.
  • : Ein Flaggschiff für einen Tippfehler oder eine Übersetzung kostet ein Vielfaches dessen, was es sollte.
  • : Dein Nutzungsbudget leert sich schnell bei Arbeit, die die Leistung nie gebraucht hat.
  • : Du stößt früher am Tag an die Nutzungsgrenze und die Agenten stocken.
  • : Das Modell von Hand zu wechseln ist umständlich, also macht es niemand.

Adaptive Mode an

  • : Jede Aufgabe wird dem günstigsten Modell zugeordnet, das sie gut erledigt.
  • : Leichte Arbeit geht an ein leichtes Modell und kostet einen Bruchteil.
  • : Das Flaggschiff bleibt für Refactorings, Audits und Architektur reserviert.
  • : Weniger Budget pro Aufgabe bedeutet mehr Aufgaben vor jeder Nutzungsgrenze.
  • : Ein Klick übernimmt das richtige Modell, sodass das Dimensionieren wirklich passiert.

Das Routing selbst ist nahezu kostenlos: ein kleines, schnelles Modell erledigt die Analyse für deutlich weniger als einen Cent und geht dir dann aus dem Weg.

So funktioniert Adaptive Mode, Schritt für Schritt

Er läuft einmal, vor deiner ersten Nachricht, und steht dir nie im Weg.

01

Du fängst an, deinen Prompt zu tippen

Öffne eine frische Unterhaltung mit einem beliebigen Agenten und schreib, was erledigt werden soll. Adaptive Mode schaut nur auf brandneue Unterhaltungen, also unterbricht er nie eine Sitzung, die schon läuft.

02

Er liest die Aufgabe und analysiert sie

Sobald dein Entwurf umfangreich genug ist und du kurz innehältst, sendet Adaptive Mode den ersten Teil deines Entwurfs an ein kleines, schnelles Routing-Modell, das einschätzt, wie anspruchsvoll die Aufgabe ist.

03

Ein Modellvorschlag erscheint

Ein Chip taucht über dem Composer auf: 'Zu Haiku wechseln', 'Zu Sonnet wechseln' oder 'Zu Opus wechseln', je nachdem, was am kosteneffizientesten passt. Ist dein aktuelles Modell bereits die beste Wahl, sagt er dir stattdessen das.

04

Du übernimmst es mit einem Klick

Klick auf den Chip und das Modell wird übernommen. Läuft schon eine Sitzung, wechselt Adaptive Mode sie live. Die Wahl wird außerdem beim Agenten gespeichert, sodass der nächste Start mit dem richtigen Modell beginnt.

05

Oder neu berechnen, oder verwerfen

Deinen Prompt umformuliert? Tipp auf Aktualisieren, um die Empfehlung für den neuen Entwurf neu zu berechnen. Zufrieden mit deinem aktuellen Modell? Verwirf den Chip und sende ab. Du behältst die Kontrolle über jede Entscheidung.

06

Danach bleibt er still

Adaptive Mode schlägt einmal pro Unterhaltung vor, also nervt er dich nie und verbraucht nicht heimlich dein Monatskontingent, während du weiter editierst. Er macht seine Arbeit und verschwindet dann.

Provider-unabhängiges Modell-Routing

Adaptive Mode liest die Modellreihe des Providers, den du gerade nutzt, und empfiehlt aus diesem Katalog. Er ist an keinen Anbieter gebunden.

Claude

Routet zwischen Haiku, Sonnet und Opus. Haiku für schnelle Korrekturen, Umbenennungen, Übersetzungen, kurze Tests und Zusammenfassungen. Sonnet für Pull-Request-Reviews, neue Endpunkte, komplexes Debugging und Refactorings. Opus für Systemarchitektur, Sicherheitsaudits, große Legacy-Refactorings und tiefe Performance-Arbeit.

Codex

Routet durch die Codex-Reihe, vom schnellen, günstigen Mini-Modell für kleine Bugs und schnelle Fragen über das ausgewogene Standardmodell für End-to-End-Features und Tests bis zum Flaggschiff-Reasoning-Modell für komplexes Systemdesign und tiefe Code-Reviews.

Antigravity

Routet zwischen dem schnellen Antigravity-Modell für kleine Korrekturen, Übersetzungen und Zusammenfassungen und dem leistungsfähigen Antigravity-Modell für das Umsetzen von Features, Debugging und tiefere Analysen.

Andere Provider

Für jeden Provider greift Adaptive Mode auf eine einfache Regel zurück: das günstigste Modell für leichte Arbeit, ein ausgewogenes Modell für normale Arbeit, das leistungsstärkste Modell für schwere Arbeit. Füge einen Provider hinzu und er routet innerhalb der Modelle dieses Providers.

Funktioniert mit deinem Provider
Claude, Codex, Antigravity und mehr. Vorschläge werden gegen die Modelle geprüft, die der Provider tatsächlich anbietet, sodass du nie eine Empfehlung bekommst, die du nicht übernehmen kannst.
Nur dein Entwurf, nur bei Bedarf
Um einen Vorschlag zu berechnen, wird der erste Teil deines Entwurfs an die AgentsRoom-Server gesendet. Das läuft einmal pro Unterhaltung, bei einer neuen Unterhaltung, und nur wenn du Adaptive Mode aktiviert hast.
Standardmäßig an, mit einem Tipp aus
Adaptive Mode ist standardmäßig aktiv, weil das richtige Dimensionieren von Anfang an Geld spart. Schalte ihn jederzeit in den Einstellungen aus, wenn du Modelle lieber selbst wählst.

FAQ

Was ist Adaptive Mode in AgentsRoom?

Adaptive Mode ist intelligentes Modell-Routing für deine KI-Coding-Agenten. Bevor du deine erste Nachricht absendest, liest er deinen Prompt und schlägt das kosteneffizienteste Modell aus der Reihe deines Providers vor, das die Aufgabe trotzdem gut erledigt. Eine leichte Aufgabe bekommt ein leichtes, günstiges Modell; eine schwere Aufgabe bekommt ein Flaggschiff. Das Ziel ist einfach: hör auf, mit einem starken Modell für Arbeit zu überzahlen, die es nicht braucht.

Wie wählt Adaptive Mode ein Modell?

Er sendet den ersten Teil deines Entwurfs an ein kleines, schnelles Routing-Modell, das mit Beispielen angeleitet wurde, welche Arten von Aufgaben zu welcher Modellklasse passen. Dann liefert es das günstigste Modell zurück, das zur Aufgabe passt, geprüft gegen die Modelle, die dein aktueller Provider tatsächlich anbietet. Ist dein aktuelles Modell bereits die beste Wahl, sagt es, dass das Modell optimal ist, statt einen Wechsel zu erzwingen.

Wie spart mir das tatsächlich Geld?

Günstigere Modelle kosten für dieselbe einfache Aufgabe einen Bruchteil des Flaggschiffs. Wenn du Tippfehler-Korrekturen, Umbenennungen, Übersetzungen und kurze Tests auf dem Spitzenmodell laufen lässt, verbrennst du dein Nutzungsbudget um ein Vielfaches schneller als nötig. Adaptive Mode lenkt diese leichte Arbeit zu einem leichten Modell, sodass jede Aufgabe weniger kostet und du mehr Aufgaben erledigen kannst, bevor du an eine Nutzungsgrenze stößt. Über einen Tag und viele parallele Agenten summieren sich diese Einsparungen.

Welche Modelle kann er vorschlagen?

Was auch immer dein Provider anbietet. Bei Claude sind das Haiku, Sonnet und Opus. Bei Codex reicht es vom schnellen Mini-Modell über das ausgewogene Standardmodell bis zum Flaggschiff-Reasoning-Modell. Bei Antigravity umfasst es das schnelle und das leistungsfähige Modell. Für andere Provider greift er auf günstigstes, ausgewogenes und leistungsstärkstes Modell zurück. Adaptive Mode liest die Live-Modellliste, also empfiehlt er immer ein Modell, das du auch wirklich starten kannst.

Wechselt er das Modell automatisch?

Nein. Adaptive Mode schlägt nur vor. Du übernimmst die Änderung mit einem einzigen Klick auf den Chip. Läuft schon eine Sitzung, wechselt er das Modell live; in jedem Fall wird die Wahl beim Agenten gespeichert, sodass der nächste Start mit dem richtigen Modell beginnt. Du kannst den Vorschlag auch verwerfen und dein aktuelles Modell behalten.

Wann erscheint der Vorschlag?

Bei einer brandneuen Unterhaltung, nachdem du einen umfangreichen Prompt getippt und kurz innegehalten hast. Er läuft einmal pro Unterhaltung, also unterbricht er nie eine laufende Sitzung und verbraucht nie heimlich dein Monatskontingent, während du weiter editierst.

Kann ich den Vorschlag neu berechnen?

Ja. Wenn du deinen Prompt umschreibst, tipp auf den Aktualisieren-Button am Chip, um die Empfehlung für den neuen Entwurf neu zu berechnen. Eine manuelle Neuberechnung nutzt einen deiner monatlichen Vorschläge, also ist sie da, wenn du sie brauchst, ohne bei jedem Tastendruck zu laufen.

Ist mein Prompt privat?

Um einen Vorschlag zu berechnen, wird nur der erste Teil deines Entwurfs an die AgentsRoom-Server gesendet, einmal pro Unterhaltung und nur wenn Adaptive Mode aktiviert ist. Du kannst die Funktion in den Einstellungen ganz abschalten, wenn du Modelle lieber selbst wählst.

Funktioniert Adaptive Mode mit Codex und Antigravity, nicht nur mit Claude?

Ja. Adaptive Mode ist provider-unabhängig. Er liest den Modellkatalog des Providers, den der Agent gerade nutzt, und empfiehlt aus diesem Katalog, ob das nun Claude, Codex, Antigravity oder ein anderer unterstützter Provider ist. Der Befehl zum Modellwechsel ist für den Provider gebaut, auf dem du bist.

Wie schalte ich Adaptive Mode an oder aus?

Er ist standardmäßig an, weil das richtige Dimensionieren des Modells von Anfang an Geld spart. Du kannst ihn jederzeit in den AgentsRoom-Einstellungen unter Adaptive Model deaktivieren oder wieder aktivieren.

Passt gut zu

Hör auf, für KI-Modell-Leistung zu zahlen, die du nicht brauchst

Lade AgentsRoom herunter und lass Adaptive Mode für jede Aufgabe das kosteneffizienteste Modell wählen. Leichte Modelle für leichte Arbeit, Flaggschiffe für die harten Probleme, weniger verbranntes Budget pro Aufgabe, mehr ausgelieferte Aufgaben pro Tag.

KostenlosAgentsRoom herunterladen

Companion-App: Agenten auch unterwegs im Blick behalten

Nutzen Sie Claude, Codex, Antigravity CLI oder einen anderen AI-Anbieter.

Erweiterung installieren
Chrome Web Store

Bugs und Wünsche direkt in dein öffentliches Backlog schicken.

Ein Blick auf AgentsRoom in Aktion.

Multi-Projekte
Multi-Provider
Multi-Agenten
Live-Status
Diff & Commit
Mobile App
Live-Vorschau
Agent-Teams
Browser-Tests
Backlog-getriebene Entwicklung
Prompt-Bibliothek
Skills-Bibliothek
Alle Funktionen ansehen