Spraakmodus: praat met je agent, hoor het terugpraten

Stop met het lezen van de terminal.
Praat met je agent.

Spraakmodus is een tweerichtings stemgesprek met een draaiende AI-coderingsagent. Tik eenmaal, spreek je beurt, en de agent antwoordt hardop in een natuurlijke stem. Geen prompt typen, geen terminaluitvoer doorscrollen om te ontdekken wat er is gebeurd.

Zet handsfree aan en het blijft luisteren tussen antwoorden door, zodat je door de kamer kunt lopen, de build kunt bekijken, of je koffie kunt drinken terwijl je het plan bespreekt. Vraag waar de refactor staat, het vertelt je. Zeg voer de tests uit en rapporteer terug, het doet het, en spreekt dan het resultaat uit.

AgentsRoom Spraakmodus: een tweerichtings stemgesprek met een AI-coderingsagent, een luisterstatus met een live-indicator, een handsfree-schakelaar, een pieptoon, een selecteerbare antwoordstem en automatische taalherkenning

Spraakmodus in actie: de agent luistert, handsfree is aan, de antwoordstem is ingesteld, en de agent antwoordt hardop tussen je beurten door.

Hier is de verschuiving waar Spraakmodus op reageert. Je agent draait langer en doet meer zelfstandig: het bewerkt bestanden, voert commando's uit, schrijft tests, repareert wat het heeft gebroken. De bottleneck is niet langer het schrijven van code, het is op de hoogte blijven terwijl de agent werkt. Regel na regel terminaluitvoer lezen, of nog een prompt typen om te vragen wat er aan de hand is, trekt je terug naar het toetsenbord voor elke enkele beurt.

Spraakmodus verandert die lus in een gesprek. Je spreekt je beurt hardop, de agent antwoordt hardop. Je stelt een vraag, geeft een correctie, keurt een plan goed, allemaal met je stem, en je hoort het antwoord teruggesproken in een natuurlijke stem in plaats van het op het scherm te ontcijferen. Het is het verschil tussen een proces superviseren en met een teamgenoot praten.

Dit is niet hetzelfde als stemdictatie. Dictatie is eenrichtings: je spreekt, het transcribeert je woorden in de composer, en je leest nog steeds het antwoord van de agent. Spraakmodus is tweerichtings: spraak in, spraak uit, een live heen-en-weer. Dictatie helpt je een prompt sneller te schrijven. Spraakmodus laat je het toetsenbord en het scherm volledig overslaan terwijl je een agent in beweging houdt.

Waarom praten met je agent in plaats van typen en lezen

Blijf op de hoogte, handsfree. Een capabele agent kan minutenlang draaien op een enkele instructie. Met Spraakmodus in handsfree blijf je de hele tijd in contact zonder op het toetsenbord te zitten. Vraag om een status, stuur de volgende stap, bevestig een beslissing, allemaal terwijl je bij het whiteboard staat of de app opnieuw laadt.

Een natuurlijke heen-en-weer. Een prompt typen, wachten, de uitvoer lezen, opnieuw typen is een stroeve lus. Je beurt spreken en het antwoord horen is een gesprek. Het is sneller voor korte beurten (een snel ja, een kleine correctie, nog een vraag) en veel minder vermoeiend dan het lezen van muren van terminaltekst voor elke update.

Ogen vrij, scherm vrij. Het antwoord van de agent horen betekent dat je niet naar de terminal hoeft te kijken om te weten wat het deed. Kijk naar de build, je tests, je ontwerp, of helemaal niets, en laat de gesproken update je vertellen waar dingen staan. De agent vertelt, jij houdt je ogen waar het echte werk is.

Op dezelfde stemcredits. Spraakmodus gebruikt de AgentsRoom stem-backend, spraak-naar-tekst op de weg in en tekst-naar-spraak op de weg uit, puttend uit hetzelfde stemcredit-saldo als dictatie. Eén saldo voedt zowel het dicteren van prompts als volledige gesproken gesprekken, dus er is niets extra's om aan te sluiten.

Hoe Spraakmodus werkt

Open het op een draaiende agent, spreek, luister, herhaal. Een gesproken lus in plaats van typen en lezen.

01

Open Spraakmodus op een draaiende agent

Spraakmodus start voor een agent die al draait in zijn terminal, vanuit de composer van die agent. Het heeft een live sessie nodig omdat het gesprek met die specifieke agent is, in zijn huidige context, niet een nieuw gesprek.

02

Tik om te praten

Tik eenmaal en spreek je beurt: een vraag, een instructie, een correctie. De status schakelt naar luisteren met een live-indicator, zodat je kunt zien dat de microfoon opneemt. Kies handsfree om het tussen beurten door te laten luisteren, of tik-om-te-praten om één beurt tegelijk te nemen.

03

Het transcribeert en stuurt naar de agent

Wanneer je klaar bent, wordt je spraak getranscribeerd en als je bericht naar de draaiende agent gestuurd, precies alsof je het had getypt. De status beweegt door transcriberen en verzenden, zodat je altijd weet waar je beurt zich in de pijplijn bevindt.

04

De agent werkt

De agent verwerkt jouw beurt in zijn eigen sessie: hij kan bestanden lezen, opdrachten uitvoeren, code bewerken, tests uitvoeren, wat je bericht ook vroeg. Spraakmodus toont een werkende status met de naam van de agent terwijl hij de taak uitvoert, net als een normale beurt in de terminal.

05

Hoor het antwoord hardop uitgesproken

Wanneer de agent antwoordt, wordt zijn antwoord hardop voorgelezen in de stem die je hebt gekozen. Je hoort de status, het resultaat, de volgende vraag, zonder de terminal te lezen. Een optionele piep markeert de grens tussen beurten, zodat je weet wanneer het weer jouw beurt is.

06

Neem je volgende beurt

In handsfree modus luistert hij al weer, dus je blijft gewoon praten. In tik-om-te-praten modus tik je om je volgende beurt te starten. Het gesprek gaat door zolang je wilt, dan sluit je de spraakmodus en de agent is precies waar je hem hebt achtergelaten in zijn terminal.

Handsfree, zodat je in de lus blijft zonder het toetsenbord

Het doel van de spraakmodus is niet nieuwigheid. Het is bijhouden met een snelle agent zonder aan je bureau gekluisterd te zijn.

Een moderne codeeragent doet veel per beurt, en de gaten tussen je beurten zijn waar je normaal gesproken context zou verliezen: je loopt weg, de agent is klaar, en je komt terug bij een scherm vol uitvoer die je nu moet lezen. Handsfree spraakmodus sluit die kloof. De agent vertelt je wat hij deed als hij klaar is, hardop, en je antwoordt zonder weer te gaan zitten.

Handsfree houdt de microfoon open tussen beurten, zodat het gesprek vloeit als een telefoongesprek: jij praat, hij werkt, hij spreekt, jij praat weer. Liever elke beurt controleren? Tik-om-te-praten neemt één beurt tegelijk, wat handig is in een lawaaierige ruimte of wanneer je alleen af en toe wilt deelnemen.

De piep is een klein ding dat in de praktijk belangrijk is. Wanneer je niet naar het scherm kijkt, vertelt een korte piep je dat de agent klaar is met spreken en het jouw beurt is, zodat je niet door hem heen praat of in stilte wacht, je afvragend of hij klaar is.

Dit is wat spraakmodus nuttig maakt voor echt werk en niet alleen een demo. Het is gebouwd voor de momenten waarop de agent het zware werk doet en jij wilt sturen, controleren en goedkeuren, terwijl je handen en ogen vrij zijn voor alles anders.

Kies je stem, volg het gesprek

Spraakmodus geeft je de bedieningselementen die een gesproken gesprek comfortabel maken, en laat je precies zien waar elke beurt is.

Stemmen en signalen

  • Antwoordstem: alloy en andere natuurlijke stemmen
  • Handsfree: blijf luisteren tussen beurten
  • Tik-om-te-praten: neem één beurt tegelijk
  • Piep: een korte toon markeert elke beurtgrens
  • Automatische taal: spreek in je eigen woorden, het detecteert de taal

Gesprekstoestanden

  • Luisteren: de microfoon vangt je beurt op
  • Transcriberen: je spraak wordt omgezet in tekst
  • Verzenden: je bericht gaat naar de agent
  • Werken: de agent voert de taak uit
  • Spreken: het antwoord van de agent wordt hardop voorgelezen

Automatische taalherkenning betekent dat je geen taal hoeft te kiezen om te beginnen met praten, en de zichtbare toestanden betekenen dat je nooit hoeft te raden of de agent je heeft gehoord, aan het werk is, of op het punt staat te antwoorden.

Wat spraakmodus eigenlijk onder de motorkap doet

Spraakmodus is een full-duplex laag bovenop een normale agentsessie. Tijdens jouw beurt neemt het je stem op en stuurt de audio naar de AgentsRoom backend, die spraak-naar-tekst uitvoert en de transcriptie terugstuurt. Die transcriptie wordt in de lopende agent geïnjecteerd als jouw bericht, dus vanuit het perspectief van de agent is het gewoon een andere beurt in het gesprek dat hij al met je heeft.

Tijdens de beurt van de agent wordt zijn tekstuele antwoord teruggestuurd naar de AgentsRoom backend voor tekst-naar-spraak in de stem die je hebt geselecteerd, en de resulterende audio wordt aan jou afgespeeld. Spraak-naar-tekst in, tekst-naar-spraak uit, met het echte werk van de agent dat daartussen plaatsvindt. Daarom heeft spraakmodus een account en een lopende agent nodig: de spraakbackend fungeert als proxy voor de spraakmodellen en het gesprek is gebonden aan een live sessie.

Omdat de agent alleen tekst ziet, is spraakmodus provider-neutraal van constructie. Of de agent nu Claude Code, Codex, Antigravity CLI, OpenCode, Aider, Grok Build, Mistral Vibe of Kimi Code is, jouw getranscribeerde beurt komt aan als een bericht en zijn antwoord wordt op dezelfde manier teruggesproken. Niets in de spraaklaag hangt af van welke CLI eronder draait.

Spraakmodus en spraakdictatie delen hetzelfde stemkredietsaldo, aangezien beide gebruikmaken van dezelfde spraakbackend. Dictatie verbruikt credits om eenrichtingsverkeer te transcriberen; Spraakmodus besteedt ze aan de heen-en-terugreis van transcriptie plus gesproken antwoorden, wat open-eindig is van aard omdat een gesprek zo lang kan doorgaan als je blijft praten.

Waar Spraakmodus werkt

Een tweerichtingsgesprek met een actieve desktopagent, spraak in en spraak uit.

Desktop, op een live agent

Spraakmodus draait op macOS, gestart vanuit de composer van een agent die al actief is. Het praat met die specifieke agent in zijn huidige sessie, zodat het gesprek de volledige context heeft die de agent heeft opgebouwd, niet een blanco blad.

Spraak in

Je beurt wordt vastgelegd door de microfoon en getranscribeerd door de AgentsRoom spraakbackend, en vervolgens als je bericht naar de agent gestuurd. Handsfree houdt de microfoon open tussen beurten; tik-om-te-praten neemt één beurt tegelijk. Taal wordt automatisch gedetecteerd.

Spraak uit

Het antwoord van de agent wordt hardop voorgelezen met tekst-naar-spraak in de stem die je kiest (legering en anderen). Een optionele piep markeert het einde van elk gesproken antwoord, zodat je weet dat het jouw beurt is, zelfs als je niet naar het scherm kijkt.

Spraakdictatie versus Spraakmodus

Beide gebruiken je stem. De een schrijft een prompt voor je, de ander houdt een gesprek.

Spraakdictatie (eenrichtingsverkeer)

  • : Je spreekt, het transcribeert je woorden in de composer.
  • : Je leest het antwoord van de agent zelf op het scherm.
  • : Geweldig om snel een lange, precieze prompt te schrijven.
  • : Je blijft aan het toetsenbord om te verzenden en het resultaat te lezen.
  • : Eén richting: spraak in, tekst in het concept, jij neemt het vanaf daar over.

Spraakmodus (tweerichtingsverkeer)

  • : Je spreekt je beurt, de agent antwoordt hardop.
  • : Je hoort het antwoord, geen noodzaak om de terminal te lezen.
  • : Geweldig om te sturen en in te checken terwijl de agent werkt.
  • : Handsfree houdt het gesprek gaande zonder het toetsenbord.
  • : Beide richtingen: spraak in, de agent werkt, spraak uit.

Gebruik dictatie om in seconden een geweldige prompt te schrijven, en Spraakmodus om met de agent te praten terwijl hij de prompt uitvoert.

Hoe een gesproken beurt klinkt

Je typt hiervan niets. Je zegt je beurt hardop, de agent doet het werk, en het spreekt het antwoord terug. Hier is een ronde van een Spraakmodusgesprek.

Een ronde van het gesprek

Jij: Waar staan we met de login refactor?
Agent: De snelheidsbegrenzer is geïmplementeerd en het succespad is onaangetast. Twee tests zijn nog steeds rood.
Jij: Los de twee mislukte tests op, voer dan de hele suite uit en vertel me het aantal.
Agent: Klaar. Beide slagen nu. Volledige suite: 142 geslaagd, 0 mislukt.
Jij: Goed. Commit het met een kort bericht en stop daar.
Je begint elke beurt
Spraakmodus handelt niet op eigen initiatief. Je tikt of spreekt om een beurt te nemen, en de agent doet alleen wat je gesproken bericht vroeg. Tik-om-te-praten geeft je beurt-voor-beurt controle; handsfree blijft alleen luisteren terwijl Spraakmodus open is.
Account en live agent
Voice Mode vereist een ingelogd account, omdat de voice backend de spraakmodellen proxy't en voice credits factureert, en een actieve agent, omdat het gesprek gebonden is aan die live sessie en de context ervan.
Werkt met elke agent
De agent ziet alleen tekst, dus Voice Mode gedraagt zich hetzelfde met Claude Code, Codex, Antigravity CLI, OpenCode, Aider, Grok Build, Mistral Vibe en Kimi Code. De voice layer omhult de sessie en is nooit afhankelijk van welke CLI eronder ligt.

FAQ

Wat is Voice Mode in AgentsRoom?

Voice Mode is een tweerichtingsgesprek met een actieve AI-coderingsagent. Je tikt en spreekt je beurt, je spraak wordt getranscribeerd en naar de agent gestuurd, de agent doet het werk, en het antwoord wordt hardop aan je voorgelezen in een natuurlijke stem. Het stelt je in staat om met een agent te praten en zijn antwoorden te horen in plaats van prompts te typen en terminaluitvoer te lezen.

Hoe verschilt Voice Mode van spraakdictatie?

Spraakdictatie is eenrichtingsverkeer: je spreekt en je woorden worden als een prompt in de composer getranscribeerd, waarna je het antwoord van de agent op het scherm leest. Voice Mode is tweerichtingsverkeer: je spreekt je beurt en de agent antwoordt hardop, een live gesproken heen-en-weer. Dictatie helpt je sneller een prompt te schrijven; Voice Mode laat je een handsfree gesprek voeren terwijl de agent werkt.

Praat de agent echt terug?

Ja. Het antwoord van de agent wordt omgezet in spraak met tekst-naar-spraak en hardop afgespeeld in de stem die je kiest. Je hoort de status, het resultaat en de volgende vraag, zodat je de terminal niet hoeft te lezen om te weten wat de agent heeft gedaan.

Wat is handsfree modus?

Handsfree houdt de microfoon open tussen beurten, zodat het gesprek verloopt als een telefoongesprek: je praat, de agent werkt, hij spreekt, en hij luistert al naar je volgende beurt. Als je liever elke beurt wilt controleren, neemt tik-om-te-praten één beurt tegelijk, wat handig is in een rumoerige kamer.

Kan ik de stem kiezen?

Ja. Je kiest de antwoordstem (legering en andere stemmen) die wordt gebruikt voor de gesproken antwoorden van de agent. Je kunt ook een optionele pieptoon inschakelen, die een korte toon afspeelt bij de grens tussen beurten, zodat je weet wanneer de agent klaar is met spreken en het jouw beurt is.

Welke talen ondersteunt Voice Mode?

Voice Mode detecteert automatisch de taal die je spreekt, zodat je in je eigen woorden kunt praten zonder eerst een taal te kiezen. De transcriptie wordt afgehandeld door de AgentsRoom voice backend, dezelfde spraakstack die voor dictatie wordt gebruikt.

Heb ik een account en een actieve agent nodig?

Ja, beide. Voice Mode vereist een ingelogd account omdat de voice backend de spraakmodellen proxy't en je voice credits gebruikt, en het vereist een agent die al actief is, omdat het gesprek gebonden is aan die live sessie en de huidige context gebruikt.

Gebruikt Voice Mode credits?

Ja. Voice Mode draait op hetzelfde voice credit saldo als dictatie. Dictatie besteedt credits om je spraak eenrichtingsverkeer te transcriberen; Voice Mode besteedt ze aan de volledige ronde van transcriptie plus gesproken antwoorden, wat open-eindig is omdat een gesprek kan doorgaan zolang je blijft praten.

Is het beschikbaar in de live webdemo?

Nee. De openbare webdemo simuleert de backend, dus het realtime voice gesprek kan daar niet draaien. Klikken op Voice Mode in de demo toont een melding die je uitnodigt om AgentsRoom te downloaden, waar Voice Mode met je echte agents praat.

Werkt Voice Mode met Claude Code, Codex en Antigravity?

Ja, met allemaal, plus OpenCode, Aider, Grok Build, Mistral Vibe en Kimi Code. De agent ziet alleen tekst, dus je gesproken beurt komt als een bericht aan en het antwoord wordt op dezelfde manier teruggesproken, ongeacht welke agent CLI eronder draait.

Past goed bij

Praat met je agents, hoor ze terugpraten

Download AgentsRoom en open Spraakmodus op een actieve agent. Spreek je beurt, hoor het antwoord, en blijf handsfree op de hoogte terwijl de agent het werk doet. Een tweerichtingsgesprek met spraak ingebouwd in je AI-coding IDE.

GratisDownload AgentsRoom

Companion-app: houd je agents onderweg in de gaten

Breng je eigen: Claude, Codex, Antigravity CLI of andere AI-provider.

Download de extensie
Chrome Web Store

Stuur bugs en verzoeken direct naar je openbare backlog.

Een glimp van AgentsRoom in actie.

Meerdere projecten
Multi-provider
Meerdere agenten
Live status
Bestandsverschil & commit
Mobiele metgezel
Live voorbeeld
Agententeams
Browserautomatisering
Backlog-gedreven ontwikkeling
Promptbibliotheek
Vaardighedenbibliotheek
Bekijk alle functies