Lecture à voix haute

Arrêtez de tout lire.
Écoutez-le.

Read Aloud, c'est la synthèse vocale intégrée à AgentsRoom. Un clic sur le haut-parleur et un fichier markdown, une sélection du terminal ou la dernière réponse de votre agent est lu à voix haute avec une voix de synthèse naturelle : barre de progression, pause, stop.

Pas envie du document entier ? Le même bouton vous en lit un condensé, et vous choisissez la durée : dix secondes, trente, ou une minute. Un changelog de quarante minutes réglé en dix secondes.

Avec le son : sélectionne la réponse de l'agent, clique sur Écouter, et une voix de synthèse la lit. La pastille de la barre d'état affiche la progression et le temps restant, avec pause et arrêt.

Développer, c'est lire. Un README que vous n'avez pas écrit, un changelog de trois cents lignes, une spec tombée dans votre boîte, une réponse d'agent qui explique une migration en quatre paragraphes. Vos yeux encaissent tout, toute la journée, et à dix-huit heures ils ne suivent plus. Read Aloud leur enlève cette charge.

L'idée vient d'un utilisateur. Il est dyslexique, il utilise AgentsRoom tous les jours, et il copiait-collait l'aperçu markdown dans un outil de synthèse vocale externe pour venir à bout de la documentation. Copier, changer d'app, coller, écouter, revenir, retrouver où on en était. Alors la voix est entrée dans l'app : le bouton haut-parleur est juste à côté du bouton Source dans l'aperçu de fichier, et le document est lu là où il est déjà.

Ce n'est pas un lecteur d'écran et ce n'est pas une certification d'accessibilité. Ça lit à voix haute un texte que vous avez choisi, avec une barre de progression et une pause. Cette promesse étroite est tout l'intérêt : c'est la seule chose sur laquelle vous pouvez compter, et elle est tenue.

CHANGELOG.md
ÉcouterCondensé

Les crédits vocaux sont désormais partagés entre dictée, Voice Mode et lecture à voix haute.

Le panneau de sélection du terminal gagne un bouton Écouter pour tout ce que vous surlignez.

La barre de statut garde une pastille de contrôle tant qu'une lecture tourne.

3:20

L'aperçu markdown qui lit un changelog à voix haute, puis le même document condensé en résumé vocal.

Quatre endroits où appuyer sur lecture

Le même lecteur partout, une lecture à la fois. En démarrer une deuxième arrête la première, parce que deux voix qui se parlent dessus n'ont jamais été le but.

Un fichier markdown, en entier

Ouvrez n'importe quel fichier markdown dans l'aperçu : un bouton haut-parleur apparaît à côté de Source. Cliquez, le document est lu depuis le début. Un README, un CLAUDE.md, une spec, un changelog, une note d'architecture. C'est le point d'entrée pour lequel la feature a été construite.

Ce que vous avez surligné dans le terminal

Sélectionnez du texte dans un terminal d'agent : le panneau de sélection s'ouvre avec un bouton Écouter. Il lit exactement ce que vous avez surligné, un paragraphe d'une réponse, une explication d'erreur, la partie d'une longue sortie qui vous intéresse vraiment. Le panneau se referme tout seul et la lecture continue.

La dernière réponse de votre agent

Clic droit dans un terminal d'agent, puis l'entrée de lecture. La réponse vient du transcript de conversation posé sur le disque, pas d'un scrape du terminal : vous entendez le vrai message et pas un écran de décorum de CLI. L'agent a terminé pendant que vous étiez ailleurs : écoutez-le au lieu de remonter le scroll.

Un résumé ou une explication IA

Le panneau de sélection sait déjà résumer ou expliquer un bloc surligné. Quand la réponse arrive, un bouton haut-parleur sur la bulle de résultat vous la lit. Demandez ce que raconte une stack trace hostile, puis écoutez l'explication pendant que vous continuez à taper.

Lecture à voix haute dans AgentsRoom : le bouton Écouter du panneau de sélection du terminal ouvre un menu de synthèse vocale à quatre niveaux, Tout lire mot pour mot, ou un résumé IA parlé d'environ 10, 30 ou 60 secondes, sur la réponse d'un agent Claude Code.
Un clic sur Écouter et la réponse sélectionnée est lue à voix haute, mot pour mot. Le chevron à côté ouvre les trois lectures condensées : un résumé écrit par l'IA pour durer environ dix, trente ou soixante secondes, puis prononcé.

Ça lit de la prose, pas de la ponctuation

Du markdown envoyé brut à un moteur de synthèse vocale est inécoutable. Read Aloud le nettoie avant.

Retiré avant lecture
## Release 1.14
The reader now shares its credits.
```ts
export const MAX = 20000;
```
| Plan | Voice |
src/services/readAloud.ts
---
- Pause and **resume** anytime.
Prononcé

Release 1.14.

The reader now shares its credits.

Pause and resume anytime.

Ce qui arrive jusqu'à la voix : de la prose. Le code, les tableaux et les chemins de fichiers sautent avant qu'un seul mot soit prononcé.

Envoyez un document technique tel quel à un moteur vocal et vous obtenez « backtick slash src slash services slash foo point ts backtick », puis un tableau markdown lu cellule par cellule, puis une ligne de séparation annoncée comme une rafale de tirets. Personne n'écoute ça deux fois. Donc avant qu'un mot soit prononcé, le texte passe par une passe de nettoyage.

Les blocs de code entre triples backticks disparaissent entièrement. Les tableaux markdown, les règles horizontales et les lignes qui ne sont qu'un chemin de fichier partent aussi. Les marqueurs de gras, d'italique et de code inline sautent en gardant les mots. Un lien devient son libellé, une image s'efface. Les titres et les puces reçoivent un point quand ils n'en ont pas, sinon la voix enchaîne toute une liste en une seule phrase sans respirer.

Prononcé
  • Les paragraphes et la prose
  • Les titres et les puces, comme de vraies phrases
  • Les libellés de liens, sans l'URL
  • Les mots en gras et en italique, sans les marqueurs
Retiré avant lecture
  • Les blocs de code
  • Les tableaux markdown
  • Les lignes qui ne sont qu'un chemin de fichier
  • Les règles horizontales et les séparateurs

Ou écoutez la version courte

Même bouton, deuxième option : un résumé IA est écrit pour tenir dans une durée de lecture que vous choisissez, et c'est ce résumé qui est prononcé.

Certains documents ne méritent pas une lecture intégrale. Un changelog dont vous voulez la forme générale. Une spec dont il vous faut l'essentiel avant une réunion. Une réponse d'agent qui a pris quatre paragraphes pour dire une chose. Le condensé est fait pour ça : AgentsRoom résume le texte à la durée demandée, puis lit ce résumé à voix haute.

Vous achetez des secondes, pas des mots. La durée parlée est la seule unité qui compte pour quelqu'un qui écoute, et c'est aussi celle que vous payez, puisque la synthèse vocale est facturée au caractère. Dix secondes d'essentiel au lieu de vingt-deux minutes de document, vos crédits ne le sentent même pas passer.

Trois durées, un clic

10s

Dix secondes. Le titre : de quoi parle le document et ce qui a changé. C'est la valeur par défaut.

30s

Trente secondes. L'essentiel avec ses raisons, de quoi décider si la lecture complète vaut votre temps.

60s

Une minute. Un vrai briefing : la structure du document, ses points principaux et ses réserves.

Le condensé en un clic utilise la durée que vous avez réglée dans les paramètres d'AgentsRoom. Dix secondes à l'installation.

  • ·Le résumé est écrit dans la langue de votre interface : un utilisateur français obtient un récap en français d'un document en anglais.
  • ·Il puise dans votre quota mensuel de résumés IA pour le texte, puis dans les crédits vocaux pour l'audio.
  • ·Le markdown est retiré avant l'écriture du résumé, pour que le résumeur dépense son budget sur la prose et pas sur des blocs de code.

Un lecteur qui se tient bien

Tout ce qu'on attend d'un truc qui parle pendant vingt minutes.

Progression et temps restant
Une barre se remplit à mesure que la lecture avance, pondérée par les caractères, à côté du temps restant en minutes et secondes. Vous savez s'il vous reste deux minutes ou douze.
Pause, reprise, stop
Mettez en pause en plein milieu d'une phrase et reprenez exactement là. Le stop tue la lecture immédiatement, y compris le morceau en cours de téléchargement.
Une pastille de contrôle dans la barre de statut
Une lecture survit à la fenêtre qui l'a lancée. Fermez l'aperçu de fichier, la voix continue : une pastille apparaît alors dans la barre de statut avec la progression, la pause et le stop. C'est le contrôle qui est toujours là, et il disparaît dès que la lecture se termine.
Lu dans la langue où c'est écrit
C'est le document qui décide de la langue, pas votre interface. Un README en anglais reste en anglais pour un utilisateur français, parce que la voix lit ce qu'elle a réellement sous les yeux.

À qui ça sert vraiment

Pas de grandes déclarations. Quatre situations où on appuie sur le bouton.

Les développeurs dyslexiques, et tous ceux qui lisent lentement. L'anglais technique écrit est le plus dur à décoder, et une voix de synthèse supprime l'étape du décodage. C'est de là que vient la feature et c'est le cas qu'elle sert le mieux.

Les yeux qui ont leur compte. Fin d'après-midi, troisième écran de documentation, concentration partie. Écouter une spec debout en s'étirant, ce n'est pas une astuce de productivité, c'est juste moins douloureux.

L'agent qui tourne longtemps. Il a bossé onze minutes, il a fini par répondre, et la réponse fait quatre paragraphes. Clic droit, écoute, vous continuez ce que vous faisiez.

Relire sa propre prose. Un README, une note de version, une réponse au support : s'entendre lire attrape la phrase bancale que vos yeux ne voient plus.

Ce que ça ne fait pas

La liste honnête, pour que rien ne vous surprenne après l'installation.

  • Ce n'est pas un lecteur d'écran. Il ne raconte pas l'interface, ne suit pas votre focus clavier, et ne revendique aucune conformité d'accessibilité. Il lit un texte que vous avez choisi.
  • Une lecture est plafonnée à 20 000 caractères, environ vingt-deux minutes de parole. Au-delà, la lecture est tronquée et l'interface le dit, parce que la synthèse vocale est facturée au caractère et qu'un clic sur un énorme fichier ne doit pas vider un mois de crédits en silence.
  • Lire un fichier, une sélection ou un résumé fonctionne avec tous les fournisseurs d'agents. Lire la dernière réponse de l'agent demande un transcript de conversation adressable, ce qui veut dire aujourd'hui Claude Code et Codex ; les autres fournisseurs annoncent qu'il n'y a rien à lire plutôt que de deviner.
  • Il faut une connexion. La voix est synthétisée côté serveur, donc pas de lecture hors ligne, et un document qui ne contient que du code ou que des chemins de fichiers n'a plus rien à dire une fois nettoyé.

Pro, sur vos crédits vocaux

Le même portefeuille que Voice Mode et la dictée, aucun nouveau quota à suivre.

Read Aloud est une fonctionnalité Pro. Voice Mode et la dictée sont ouverts à tout compte connecté parce qu'une réponse parlée est courte, environ neuf cents caractères. Un document en fait des dizaines de milliers. Cet écart de consommation est toute la raison de la garde de plan, et elle a sa ligne dédiée dans le tableau comparatif Free/Plus/Pro.

La facturation passe par les crédits vocaux déjà présents sur votre compte, partagés avec Voice Mode et la dictée, rechargés au début de chaque mois. Les crédits sont vérifiés avant l'envoi de la requête vocale, donc aucun appel n'est lancé sur un solde vide. Vous pouvez aussi rattacher votre propre clé API OpenAI : les lectures tournent alors sur votre compte et ne coûtent aucun crédit.

Free
Non inclus
Plus
Non inclus
Pro
Crédits vocaux mensuels

Les crédits vocaux sont partagés entre la lecture à voix haute, Voice Mode et la dictée vocale.

FAQ

C'est quoi exactement Read Aloud ?

Un lecteur vocal intégré à AgentsRoom. Vous choisissez un texte écrit (un fichier markdown, une sélection du terminal, la dernière réponse de votre agent) et il est lu à voix haute avec une voix de synthèse naturelle, avec barre de progression, pause et stop. C'est le sens inverse de la dictée vocale, qui transforme votre parole en texte.

Je peux écouter un fichier markdown, genre un README ?

Oui, c'est le point d'entrée principal. Ouvrez le fichier dans l'aperçu AgentsRoom et cliquez le bouton haut-parleur à côté de Source. Le document entier est lu depuis le début : README, CLAUDE.md, changelog, note d'architecture, spec. La syntaxe markdown est nettoyée d'abord, vous entendez le texte et pas le balisage.

Est-ce que ça lit le code à voix haute ?

Non, et c'est volontaire. Les blocs de code sont retirés avant toute lecture, avec les tableaux markdown, les règles horizontales et les lignes qui ne sont qu'un chemin de fichier. Du code prononcé est inécoutable, donc Read Aloud garde la prose et jette le reste.

Je peux écouter un résumé plutôt que le document entier ?

Oui. Chaque point d'entrée propose l'écoute d'un condensé : un résumé IA est écrit d'abord, calibré sur la durée de lecture que vous avez choisie, et c'est ce résumé qui est prononcé. Trois durées sont disponibles, environ dix secondes, trente secondes et une minute, dix secondes par défaut. Ça transforme un long changelog en court récap audio et ça coûte bien moins de crédits vocaux que la lecture intégrale. Le résumé est écrit dans la langue de votre interface.

C'est utile si je suis dyslexique ?

C'est de là que vient la feature. Un utilisateur dyslexique copiait-collait l'aperçu markdown d'AgentsRoom dans un outil de synthèse vocale externe, alors la voix a été amenée dans l'app. Ça supprime l'étape de décodage sur la documentation technique. Ce n'est pas un lecteur d'écran et ça ne revendique aucune conformité, mais pour lire des documents ça fait exactement le travail demandé.

Quelle longueur de document peut-il lire ?

Une lecture est plafonnée à 20 000 caractères de texte prononçable, environ vingt-deux minutes. Au-delà, la lecture est tronquée et l'interface vous dit qu'elle a été raccourcie. Ce plafond existe parce que la synthèse vocale est facturée au caractère : sans lui, un clic sur un énorme fichier pourrait vider un mois de crédits avant que vous ne réagissiez.

Que se passe-t-il si je ferme le fichier pendant la lecture ?

La lecture continue. Le lecteur vit en dehors de la fenêtre qui l'a lancé, et une pastille de contrôle apparaît dans la barre de statut avec la progression, le temps restant, la pause et le stop. C'est le contrôle toujours disponible, et il disparaît à la fin de la lecture.

Ça marche avec tous les agents ?

Lire un fichier, une sélection ou un résumé IA fonctionne avec n'importe quel fournisseur, parce que le texte vient de votre écran. Lire la dernière réponse de l'agent demande un transcript de conversation adressable sur le disque, ce qui veut dire aujourd'hui Claude Code et Codex. Avec les autres fournisseurs, ce point d'entrée annonce qu'il n'y a rien à lire.

Combien ça coûte ?

Read Aloud est une fonctionnalité Pro, facturée sur les crédits vocaux déjà partagés avec Voice Mode et la dictée, rechargés chaque mois. Il n'y a pas de quota séparé. Les crédits sont vérifiés avant la requête, donc rien n'est dépensé sur un solde vide, et vous pouvez rattacher votre propre clé API OpenAI pour lire sur votre compte sans consommer de crédit.

Dans quelle langue lit-il ?

Celle du document. La voix lit ce qu'elle a sous les yeux, donc un README en anglais reste en anglais même quand votre interface AgentsRoom est en français. Le condensé est l'exception : le résumé est écrit dans la langue de votre interface, puis prononcé.

Je peux choisir la voix ?

Oui. Read Aloud utilise la voix que vous avez déjà choisie pour Voice Mode dans les réglages AgentsRoom : vous la réglez une fois et les deux fonctionnalités s'en servent.

Deux textes peuvent-ils être lus en même temps ?

Non, et c'est exprès. Il y a un seul lecteur pour toute l'app : démarrer une nouvelle lecture arrête celle en cours. Deux voix de synthèse qui se parlent dessus, personne n'a jamais voulu ça.

Ça pourrait aussi vous plaire

Offrez une pause à vos yeux

Téléchargez AgentsRoom et faites-vous lire votre prochain changelog.

GratuitTélécharger AgentsRoom

App companion : suivez vos agents en déplacement

Utilisez Claude, Codex, Antigravity CLI ou un autre fournisseur IA.

Installer l'extension
Chrome Web Store

Remontez bugs et demandes directement dans votre backlog public.

Aperçu d'AgentsRoom en action.

Multi-projets
Multi-provider
Multi-agents
Statut en direct
Diff & commit
App mobile
Aperçu live
Équipes d'agents
Tests navigateur
Dev pilotée par backlog
Bibliothèque de prompts
Bibliothèque de skills
Voir toutes les fonctionnalités