Smetti di leggere tutto.
Ascoltalo.
Read Aloud è la sintesi vocale integrata in AgentsRoom. Un clic sull'altoparlante e un file markdown, una selezione del terminale o l'ultima risposta del tuo agente viene letta ad alta voce con una voce sintetica naturale, con barra di avanzamento, pausa e stop.
Non hai voglia del documento intero? Lo stesso pulsante ti legge una versione condensata, e scegli tu quanto parla: dieci secondi, trenta o un minuto. Un changelog da quaranta minuti risolto in dieci secondi.
Con l'audio: seleziona la risposta dell'agente, fai clic su Ascolta e una voce sintetica la legge. Il chip nella barra di stato mostra l'avanzamento e il tempo rimasto, con pausa e stop.
Programmare vuol dire leggere. Un README che non hai scritto tu, un changelog da trecento righe, una specifica arrivata nella tua casella, una risposta dell'agente che spiega una migrazione in quattro paragrafi. I tuoi occhi si prendono tutto, tutto il giorno, e alle sei di sera non ce la fanno più. Read Aloud gli toglie questo carico.
L'idea è arrivata da un utente. È dislessico, usa AgentsRoom tutti i giorni e copiava e incollava l'anteprima markdown in uno strumento di sintesi vocale separato per venire a capo della documentazione. Copiare, cambiare app, incollare, ascoltare, tornare, ritrovare il punto. Così la voce è entrata nell'app: il pulsante dell'altoparlante sta proprio accanto al pulsante Source nell'anteprima del file, e il documento viene letto dov'è già.
Non è uno screen reader e non è una certificazione di accessibilità. Legge ad alta voce un testo che hai scelto tu, con barra di avanzamento e pausa. Questa promessa stretta è tutto il senso: è l'unica cosa che fa, e su quella puoi contare.
I crediti vocali ora sono condivisi tra dettatura, Voice Mode e lettura ad alta voce.
Il pannello di selezione del terminale guadagna un pulsante Ascolta per tutto quello che evidenzi.
La barra di stato tiene una pastiglia di controllo finché una lettura è in corso.
L'anteprima markdown che legge un changelog ad alta voce, e poi lo stesso documento condensato in un riassunto parlato.
Quattro posti dove premere play
Lo stesso lettore ovunque, una lettura alla volta. Avviarne una seconda ferma la prima, perché due voci che si parlano sopra non le ha mai volute nessuno.
Un file markdown, intero
Apri un file markdown qualsiasi nell'anteprima e accanto a Source compare un pulsante altoparlante. Clicchi e il documento viene letto dall'inizio. Un README, un CLAUDE.md, una specifica, un changelog, una nota di architettura. Questo è il punto di ingresso per cui la funzione è stata costruita.
Quello che hai evidenziato nel terminale
Seleziona del testo in un terminale agente e si apre il pannello di selezione con un pulsante Ascolta. Legge esattamente quello che hai evidenziato: un paragrafo di una risposta, la spiegazione di un errore, la parte di un output lungo che ti interessa davvero. Il pannello si chiude da solo e la lettura va avanti.
L'ultima risposta del tuo agente
Clic destro in un terminale agente e scegli la voce di lettura. La risposta arriva dalla trascrizione della conversazione che l'agente lascia su disco, non da uno scraping del terminale, quindi senti il messaggio vero e non una schermata di fronzoli della CLI. L'agente ha finito mentre eri in un'altra finestra: ascoltalo invece di risalire lo scroll.
Un riassunto o una spiegazione dell'IA
Il pannello di selezione sa già riassumere o spiegare un blocco evidenziato. Quando arriva la risposta, un pulsante altoparlante sulla bolla del risultato te la legge ad alta voce. Chiedi cosa vuol dire uno stack trace ostile, poi ascolta la spiegazione mentre continui a scrivere.

Legge prosa, non punteggiatura
Il markdown mandato grezzo a un motore text to speech è inascoltabile. Read Aloud lo pulisce prima.
Release 1.14.
The reader now shares its credits.
Pause and resume anytime.
Quello che arriva alla voce: prosa e basta. Il codice, le tabelle e i percorsi di file isolati vengono scartati prima che venga pronunciata una sola parola.
Manda un documento tecnico così com'è a un motore vocale e ottieni «backtick barra src barra services barra foo punto ts backtick», poi una tabella markdown letta cella per cella, e poi una riga di separazione annunciata come una raffica di trattini. Nessuno lo ascolta due volte. Quindi, prima che venga pronunciata una parola, il testo passa da una pulizia.
I blocchi di codice delimitati spariscono interi. Le tabelle markdown, le righe orizzontali e le righe che sono solo un percorso di file se ne vanno anche loro. I marcatori di grassetto, corsivo e codice inline vengono tolti e le parole restano. Un link diventa la sua etichetta, un'immagine sparisce. I titoli e le voci di elenco ricevono un punto quando non ce l'hanno, altrimenti la voce incolla un elenco intero in una frase sola, senza respirare.
- I paragrafi e la prosa
- I titoli e le voci di elenco, come frasi vere
- Le etichette dei link, senza l'URL
- Le parole in grassetto e in corsivo, senza i marcatori
- I blocchi di codice
- Le tabelle markdown
- Le righe che sono solo un percorso di file
- Le righe orizzontali e i separatori
Oppure ascolta la versione corta
Stesso pulsante, seconda opzione: viene scritto un riassunto IA che sta nella durata parlata che scegli tu, ed è quel riassunto a essere letto ad alta voce.
Certi documenti non meritano una lettura integrale. Un changelog di cui vuoi solo la forma generale. Una specifica di cui ti serve il succo prima di una riunione. Una risposta dell'agente che ci ha messo quattro paragrafi per dire una cosa. La lettura condensata serve a questo: AgentsRoom riassume il testo nella durata che hai chiesto, poi legge quel riassunto ad alta voce.
Compri secondi, non parole. La durata parlata è l'unica unità che conta davvero per chi ascolta, e guarda caso è anche l'unità in cui paghi, visto che la sintesi vocale si paga a carattere. Dieci secondi di succo al posto di ventidue minuti di documento sono un errore di arrotondamento sui tuoi crediti.
Tre durate, un clic
Dieci secondi. Il titolo: di cosa parla il documento e cosa è cambiato. È il valore predefinito.
Trenta secondi. Il succo con le sue ragioni, quanto basta per decidere se la lettura completa vale il tuo tempo.
Un minuto. Un vero briefing: la struttura del documento, i suoi punti principali e le sue riserve.
La lettura condensata in un clic usa la durata che hai scelto nelle impostazioni di AgentsRoom. Dieci secondi appena installato.
- ·Il riassunto è scritto nella lingua della tua interfaccia: un utente italiano riceve un recap in italiano di un documento in inglese.
- ·Attinge alla tua quota mensile di riassunti IA per il testo, e poi ai crediti vocali per l'audio.
- ·Il markdown viene tolto prima che il riassunto venga scritto, così chi riassume spende il suo budget sulla prosa e non sui blocchi di codice.
Un player che si comporta bene
Tutto quello che ti aspetti da una cosa che parla per venti minuti.
A chi serve davvero
Niente grandi dichiarazioni. Quattro situazioni in cui si preme il pulsante.
Gli sviluppatori dislessici, e chiunque legga piano. L'inglese tecnico scritto è il più difficile da decodificare, e una voce sintetica toglie il passaggio della decodifica. Da qui è nata la funzione ed è il caso che serve meglio.
Gli occhi che ne hanno abbastanza. Metà pomeriggio, terza schermata di documentazione, concentrazione andata. Ascoltare una specifica mentre ti alzi e ti stiracchi non è un trucco di produttività, fa solo meno male.
L'agente che gira a lungo. Ha lavorato undici minuti, alla fine ha risposto, e la risposta è di quattro paragrafi. Clic destro, ascolti, e continui quello che stavi facendo.
Rileggere la tua prosa. Un README, una nota di rilascio, una risposta al supporto: sentirla letta acchiappa la frase storta che i tuoi occhi non vedono più.
Quello che non fa
L'elenco onesto, così niente ti sorprende dopo l'installazione.
- Non è uno screen reader. Non racconta l'interfaccia, non segue il tuo focus da tastiera e non rivendica nessuna conformità di accessibilità. Legge un testo che hai scelto tu.
- Una singola lettura è limitata a 20.000 caratteri, più o meno ventidue minuti di parlato. Oltre, la lettura viene troncata e l'interfaccia lo dice, perché la voce si paga a carattere e un clic su un file enorme non deve svuotare un mese di crediti in silenzio.
- Leggere un file, una selezione o un riassunto funziona con qualsiasi provider di agenti. Leggere l'ultima risposta dell'agente richiede una trascrizione della conversazione indirizzabile, che oggi vuol dire Claude Code e Codex; gli altri provider dicono che non c'è niente da leggere invece di tirare a indovinare.
- Serve una connessione. La voce viene sintetizzata sul server, quindi non c'è lettura offline, e un documento che contiene solo codice o solo percorsi di file non ha più niente da dire una volta ripulito.
Pro, sui tuoi crediti vocali
Lo stesso portafoglio di Voice Mode e della dettatura, nessuna quota nuova da tenere d'occhio.
Read Aloud è una funzione Pro. Voice Mode e la dettatura sono aperti a qualsiasi account con la sessione attiva perché una risposta parlata è corta, circa novecento caratteri. Un documento ne ha decine di migliaia. Questa differenza di consumo è tutta la ragione del limite di piano, e ha la sua riga nella tabella comparativa Free/Plus/Pro.
La fatturazione passa dai crediti vocali che hai già sull'account, condivisi con Voice Mode e la dettatura, ricaricati all'inizio di ogni mese. I crediti vengono controllati prima che la richiesta vocale parta, quindi non viene mai fatta una chiamata su un saldo vuoto. Puoi anche collegare la tua chiave API OpenAI: a quel punto le letture girano sul tuo account e non costano nessun credito.
I crediti vocali sono condivisi tra la lettura ad alta voce, Voice Mode e la dettatura vocale.
FAQ
Cos'è esattamente Read Aloud?
Un lettore text to speech dentro AgentsRoom. Scegli un testo scritto (un file markdown, una selezione del terminale, l'ultima risposta del tuo agente) e viene letto ad alta voce con una voce sintetica naturale, con barra di avanzamento, pausa e stop. È il verso opposto della dettatura vocale, che trasforma la tua voce in testo.
Posso ascoltare un file markdown, tipo un README?
Sì, è il punto di ingresso principale. Apri il file nell'anteprima di AgentsRoom e clicca il pulsante altoparlante accanto a Source. Il documento intero viene letto dall'inizio: README, CLAUDE.md, changelog, nota di architettura, specifica. La sintassi markdown viene ripulita prima, così senti il testo e non il markup.
Legge il codice ad alta voce?
No, ed è voluto. I blocchi di codice vengono tolti prima che venga pronunciata qualsiasi cosa, insieme alle tabelle markdown, alle righe orizzontali e alle righe che sono solo un percorso di file. Il codice letto a voce è inascoltabile, quindi Read Aloud tiene la prosa e butta il resto.
Posso ascoltare un riassunto invece del documento intero?
Sì. Ogni punto di ingresso offre una lettura condensata: prima viene scritto un riassunto IA, calibrato sulla durata parlata che hai scelto, ed è quel riassunto a essere pronunciato. Le durate disponibili sono tre, più o meno dieci secondi, trenta secondi e un minuto, con dieci secondi come valore predefinito. Trasforma un changelog lungo in un recap audio corto e costa molti meno crediti vocali della lettura integrale. Il riassunto è scritto nella lingua della tua interfaccia.
Serve se sono dislessico?
Da lì è nata la funzione. Un utente dislessico copiava e incollava l'anteprima markdown di AgentsRoom in uno strumento di sintesi vocale esterno, così la voce è stata portata dentro l'app. Toglie il passaggio della decodifica sulla documentazione tecnica. Non è uno screen reader e non rivendica nessuna conformità, ma per leggere documenti fa esattamente il lavoro che gli è stato chiesto.
Quanto può essere lungo un documento da leggere?
Una singola lettura è limitata a 20.000 caratteri di testo pronunciabile, più o meno ventidue minuti. Oltre, la lettura viene troncata e l'interfaccia ti dice che è stata accorciata. Il tetto esiste perché la voce si paga a carattere: senza, un clic su un file enorme potrebbe svuotare un mese di crediti prima che tu reagisca.
Cosa succede se chiudo il file mentre sta leggendo?
La lettura va avanti. Il player vive fuori dalla finestra che l'ha avviato, e nella barra di stato compare una pastiglia di controllo con l'avanzamento, il tempo rimasto, la pausa e lo stop. È il comando sempre disponibile, e sparisce quando la lettura finisce.
Funziona con tutti gli agenti?
Leggere un file, una selezione o un riassunto IA funziona con qualsiasi provider, perché il testo arriva dal tuo schermo. Leggere l'ultima risposta dell'agente richiede una trascrizione della conversazione indirizzabile su disco, che oggi vuol dire Claude Code e Codex. Con gli altri provider quel punto di ingresso dice che non c'è niente da leggere.
Quanto costa?
Read Aloud è una funzione Pro, fatturata sui crediti vocali già condivisi con Voice Mode e la dettatura, ricaricati ogni mese. Non c'è una quota separata. I crediti vengono controllati prima della richiesta, quindi non si spende niente su un saldo vuoto, e puoi collegare la tua chiave API OpenAI per far girare le letture sul tuo account senza consumare crediti.
In che lingua legge?
Nella lingua del documento. Il modello vocale legge quello che ha davanti, quindi un README in inglese resta in inglese anche quando la tua interfaccia AgentsRoom è in italiano. La lettura condensata è l'eccezione: il riassunto viene scritto nella lingua della tua interfaccia, e poi pronunciato.
Posso scegliere la voce?
Sì. Read Aloud usa la voce che hai già scelto per Voice Mode nelle impostazioni di AgentsRoom, così la imposti una volta e la usano tutte e due le funzioni.
Si possono leggere due cose insieme?
No, ed è voluto. C'è un solo lettore per tutta l'app: avviare una lettura nuova ferma quella in corso. Due voci sintetiche che si parlano sopra non le ha mai volute nessuno.
Ti potrebbe piacere anche
Voice Mode
Una conversazione parlata nei due sensi con un agente in esecuzione. Read Aloud legge un testo scritto; Voice Mode tiene un botta e risposta dal vivo, a mani libere.
Dettatura vocale
Il verso opposto: detti il tuo prompt e la trascrizione atterra nel campo di composizione, pronta da rileggere e inviare.
Memoria del progetto
La base di conoscenza condivisa in cui i tuoi agenti scrivono e da cui leggono. Un sacco di note che conviene ascoltare invece di leggere.
Commit Context
Il succo della conversazione con l'agente allegato a ogni commit, così il ragionamento dietro una modifica sopravvive al diff.
Dev Terminals
I tuoi server di sviluppo e i tuoi processi lunghi nello stesso centro di comando dei tuoi agenti, con i loro log a un clic.
Dai una pausa ai tuoi occhi
Scarica AgentsRoom e fatti leggere il prossimo changelog.
App companion: monitora i tuoi agenti in movimento
Usa Claude, Codex, Antigravity CLI o un altro provider IA.
Invia bug e richieste direttamente nel tuo backlog pubblico.
Uno sguardo ad AgentsRoom in azione.