Lectura en voz alta

Deja de leerlo todo.
Escúchalo.

Read Aloud es la síntesis de voz integrada en AgentsRoom. Un clic en el altavoz y un archivo markdown, una selección del terminal o la última respuesta de tu agente se lee en voz alta con una voz sintética natural, con barra de progreso, pausa y parada.

¿No te apetece el documento entero? El mismo botón te lee un condensado, y tú eliges cuánto habla: diez segundos, treinta o un minuto. Un changelog de cuarenta minutos resuelto en diez segundos.

Con sonido: selecciona la respuesta del agente, haz clic en Escuchar y una voz sintética la lee. La pastilla de la barra de estado muestra el progreso y el tiempo restante, con pausa y parada.

Programar es leer. Un README que no has escrito tú, un changelog de trescientas líneas, una especificación que ha caído en tu bandeja, una respuesta del agente que explica una migración en cuatro párrafos. Tus ojos se lo tragan todo, todo el día, y a las seis de la tarde ya no dan más de sí. Read Aloud les quita esa carga.

La idea vino de un usuario. Es disléxico, usa AgentsRoom a diario y copiaba y pegaba la vista previa markdown en una herramienta de texto a voz aparte para poder con la documentación. Copiar, cambiar de aplicación, pegar, escuchar, volver, buscar por dónde ibas. Así que la voz se mudó a la aplicación: el botón del altavoz está justo al lado del botón Source en la vista previa de archivo, y el documento se lee donde ya está.

No es un lector de pantalla y no es una certificación de accesibilidad. Lee en voz alta un texto que has elegido tú, con barra de progreso y pausa. Esa promesa estrecha es justo lo bueno: es lo único que hace, y puedes contar con ello.

CHANGELOG.md
EscucharResumen

Los créditos de voz ahora se comparten entre el dictado, Voice Mode y la lectura en voz alta.

El panel de selección del terminal gana un botón Escuchar para todo lo que marques.

La barra de estado mantiene una pastilla de control mientras haya una lectura en marcha.

3:20

La vista previa markdown leyendo un changelog en voz alta, y luego el mismo documento condensado en un resumen hablado.

Cuatro sitios donde darle a leer

El mismo lector en todas partes, una lectura cada vez. Empezar una segunda detiene la primera, porque dos voces hablando a la vez nunca fue el objetivo.

Un archivo markdown, entero

Abre cualquier archivo markdown en la vista previa y aparecerá un botón de altavoz junto a Source. Haz clic y el documento se lee desde arriba. Un README, un CLAUDE.md, una especificación, un changelog, una nota de arquitectura. Este es el punto de entrada para el que se construyó la función.

Lo que hayas marcado en el terminal

Selecciona texto en un terminal de agente y se abre el panel de selección con un botón Escuchar. Lee exactamente lo que has marcado: un párrafo de una respuesta, la explicación de un error, la parte de una salida larga que de verdad te importa. El panel se cierra solo y la lectura sigue.

La última respuesta de tu agente

Haz clic derecho en un terminal de agente y elige la entrada de lectura. La respuesta sale de la transcripción de conversación que el agente deja en disco, no de un raspado del terminal, así que oyes el mensaje real y no una pantalla de adornos de la CLI. El agente terminó mientras estabas en otra ventana: escúchalo en lugar de subir por el scroll.

Un resumen o una explicación de la IA

El panel de selección ya sabe resumir o explicar un fragmento marcado. Cuando llega la respuesta, un botón de altavoz en la burbuja del resultado te la lee en voz alta. Pregunta qué significa una traza de error hostil y escucha la explicación mientras sigues tecleando.

Lectura en voz alta en AgentsRoom: el botón Escuchar del panel de selección del terminal abre un menú de texto a voz con cuatro niveles, Leerlo todo palabra por palabra, o un resumen de IA hablado de unos 10, 30 o 60 segundos, sobre la respuesta de un agente Claude Code.
Un clic en Escuchar y la respuesta seleccionada se lee en voz alta, palabra por palabra. La flecha de al lado abre las tres lecturas condensadas: un resumen escrito por la IA para durar unos diez, treinta o sesenta segundos, y luego pronunciado.

Lee prosa, no puntuación

El markdown enviado en crudo a un motor de texto a voz es inescuchable. Read Aloud lo limpia antes.

Se descarta antes de leer
## Release 1.14
The reader now shares its credits.
```ts
export const MAX = 20000;
```
| Plan | Voice |
src/services/readAloud.ts
---
- Pause and **resume** anytime.
Se pronuncia

Release 1.14.

The reader now shares its credits.

Pause and resume anytime.

Lo que llega hasta la voz: prosa y nada más. El código, las tablas y las rutas de archivo sueltas se descartan antes de pronunciar una sola palabra.

Manda un documento técnico tal cual a un motor de voz y obtienes «comilla invertida barra src barra services barra foo punto ts comilla invertida», luego una tabla markdown leída celda a celda, y luego una línea de separación anunciada como una ráfaga de guiones. Nadie escucha eso dos veces. Así que antes de pronunciar nada, el texto pasa por una limpieza.

Los bloques de código delimitados desaparecen enteros. Las tablas markdown, las líneas horizontales y las líneas que solo son una ruta de archivo también se van. Los marcadores de negrita, cursiva y código en línea se quitan y las palabras se quedan. Un enlace se convierte en su etiqueta, una imagen desaparece. Los títulos y los elementos de lista reciben un punto cuando no lo tienen, porque si no la voz encadena una lista entera en una sola frase sin respirar.

Se pronuncia
  • Los párrafos y la prosa
  • Los títulos y los elementos de lista, como frases de verdad
  • Las etiquetas de los enlaces, sin la URL
  • Las palabras en negrita y cursiva, sin los marcadores
Se descarta antes de leer
  • Los bloques de código
  • Las tablas markdown
  • Las líneas que solo son una ruta de archivo
  • Las líneas horizontales y los separadores

O escucha la versión corta

Mismo botón, segunda opción: se escribe un resumen con IA que cabe en la duración hablada que elijas, y es ese resumen el que se lee en voz alta.

Hay documentos que no merecen una lectura íntegra. Un changelog del que solo quieres la forma general. Una especificación de la que necesitas lo esencial antes de una reunión. Una respuesta del agente que ha tardado cuatro párrafos en decir una cosa. La lectura condensada es para eso: AgentsRoom resume el texto a la duración que has pedido, y luego lee ese resumen en voz alta.

Compras segundos, no palabras. La duración hablada es la única unidad que le importa a quien escucha, y da la casualidad de que es también la unidad en la que pagas, porque la síntesis de voz se factura por carácter. Diez segundos de lo esencial en lugar de veintidós minutos de documento es un error de redondeo en tus créditos.

Tres duraciones, un clic

10s

Diez segundos. El titular: de qué va el documento y qué ha cambiado. Es el valor por defecto.

30s

Treinta segundos. Lo esencial con sus porqués, suficiente para decidir si la lectura completa merece tu tiempo.

60s

Un minuto. Un briefing de verdad: la estructura del documento, sus puntos principales y sus salvedades.

La lectura condensada en un clic usa la duración que hayas puesto en los ajustes de AgentsRoom. Diez segundos recién instalado.

  • ·El resumen se escribe en el idioma de tu interfaz: un usuario español recibe un repaso en español de un documento en inglés.
  • ·Tira de tu cupo mensual de resúmenes con IA para el texto, y luego de los créditos de voz para el audio.
  • ·El markdown se quita antes de escribir el resumen, para que el resumidor gaste su presupuesto en la prosa y no en bloques de código.

Un reproductor que se porta bien

Todo lo que esperas de algo que va a hablar durante veinte minutos.

Progreso y tiempo restante
Una barra se llena a medida que avanza la lectura, ponderada por caracteres, junto al tiempo restante en minutos y segundos. Sabes si te quedan dos minutos o doce.
Pausa, reanudar, parar
Pon la pausa en mitad de una frase y retómala exactamente donde la dejaste. Parar mata la lectura al instante, incluido el trozo que se estaba descargando.
Una pastilla de control en la barra de estado
Una lectura sobrevive a la ventana que la lanzó. Cierra la vista previa del archivo y la voz sigue, así que aparece una pastilla en la barra de estado con el progreso, la pausa y la parada. Es el control que siempre está ahí, y desaparece en cuanto termina la lectura.
Se lee en el idioma en el que está escrito
El idioma lo decide el documento, no tu interfaz. Un README en inglés sigue en inglés para un usuario español, porque el modelo de voz lee lo que tiene delante de verdad.

Para quién es esto de verdad

Sin grandes declaraciones. Cuatro situaciones en las que la gente le da al botón.

Los desarrolladores disléxicos, y cualquiera que lea despacio. El inglés técnico escrito es lo más difícil de descodificar, y una voz sintética elimina el paso de la descodificación. De ahí salió la función y es el caso al que mejor sirve.

Los ojos que ya han tenido bastante. Media tarde, tercera pantalla de documentación, concentración perdida. Escuchar una especificación mientras te levantas y estiras las piernas no es un truco de productividad, simplemente duele menos.

El agente que lleva mucho rato trabajando. Ha estado once minutos, por fin ha respondido, y la respuesta son cuatro párrafos. Clic derecho, escuchas, y sigues con lo tuyo.

Repasar tu propia prosa. Un README, una nota de versión, una respuesta de soporte: oírlo leído en voz alta caza la frase torpe que tus ojos ya han dejado de ver.

Lo que no hace

La lista honesta, para que nada te sorprenda después de instalarlo.

  • No es un lector de pantalla. No narra la interfaz, no sigue tu foco de teclado y no reclama ninguna conformidad de accesibilidad. Lee un texto que has elegido tú.
  • Una lectura está limitada a 20.000 caracteres, unos veintidós minutos de habla. A partir de ahí la lectura se trunca y la interfaz lo dice, porque la voz se factura por carácter y un clic en un archivo enorme no debería vaciar un mes de créditos en silencio.
  • Leer un archivo, una selección o un resumen funciona con cualquier proveedor de agentes. Leer la última respuesta del agente necesita una transcripción de conversación direccionable, lo que hoy significa Claude Code y Codex; el resto de proveedores avisan de que no hay nada que leer en vez de adivinar.
  • Necesita conexión. La voz se sintetiza en el servidor, así que no hay lectura sin conexión, y un documento que solo contiene código o rutas de archivo se queda sin nada que decir una vez limpiado.

Pro, con tus créditos de voz

La misma cartera que Voice Mode y el dictado, ningún cupo nuevo del que estar pendiente.

Read Aloud es una función Pro. Voice Mode y el dictado están abiertos a cualquier cuenta con sesión iniciada porque una respuesta hablada es corta, unos novecientos caracteres. Un documento tiene decenas de miles. Esa diferencia de consumo es toda la razón de la barrera de plan, y tiene su propia fila en la tabla comparativa Free/Plus/Pro.

La facturación va con los créditos de voz que ya tienes en la cuenta, compartidos con Voice Mode y el dictado, y recargados al principio de cada mes. Los créditos se comprueban antes de enviar la petición de voz, así que nunca se lanza una llamada contra un saldo vacío. También puedes enlazar tu propia clave de API de OpenAI: entonces las lecturas van por tu cuenta y no gastan ningún crédito.

Free
No incluido
Plus
No incluido
Pro
Créditos de voz mensuales

Los créditos de voz se comparten entre la lectura en voz alta, Voice Mode y el dictado por voz.

FAQ

¿Qué es exactamente Read Aloud?

Un lector de texto a voz dentro de AgentsRoom. Eliges un texto escrito (un archivo markdown, una selección del terminal, la última respuesta de tu agente) y se lee en voz alta con una voz sintética natural, con barra de progreso, pausa y parada. Es el sentido contrario del dictado por voz, que convierte tu habla en texto.

¿Puedo escuchar un archivo markdown, por ejemplo un README?

Sí, ese es el punto de entrada principal. Abre el archivo en la vista previa de AgentsRoom y haz clic en el botón de altavoz junto a Source. El documento entero se lee desde arriba: README, CLAUDE.md, changelog, nota de arquitectura, especificación. La sintaxis markdown se limpia antes, así que oyes el texto y no el marcado.

¿Lee el código en voz alta?

No, y es a propósito. Los bloques de código se quitan antes de pronunciar nada, junto con las tablas markdown, las líneas horizontales y las líneas que solo son una ruta de archivo. El código dicho en voz alta es inescuchable, así que Read Aloud se queda con la prosa y tira el resto.

¿Puedo escuchar un resumen en vez del documento entero?

Sí. Todos los puntos de entrada ofrecen una lectura condensada: primero se escribe un resumen con IA, calibrado a la duración hablada que hayas elegido, y es ese resumen el que se pronuncia. Hay tres duraciones disponibles, más o menos diez segundos, treinta segundos y un minuto, con diez segundos por defecto. Convierte un changelog largo en un repaso de audio corto y cuesta muchos menos créditos de voz que leer el texto completo. El resumen se escribe en el idioma de tu interfaz.

¿Sirve si soy disléxico?

De ahí salió la función. Un usuario disléxico copiaba y pegaba la vista previa markdown de AgentsRoom en una herramienta de texto a voz externa, así que la voz se trajo a la aplicación. Elimina el paso de descodificación en la documentación técnica. No es un lector de pantalla y no reclama ninguna conformidad, pero para leer documentos hace exactamente el trabajo que se le pidió.

¿Qué longitud de documento puede leer?

Una lectura está limitada a 20.000 caracteres de texto pronunciable, unos veintidós minutos. A partir de ahí la lectura se trunca y la interfaz te dice que se ha acortado. El tope existe porque la voz se factura por carácter: sin él, un clic en un archivo enorme podría vaciar un mes de créditos antes de que reaccionaras.

¿Qué pasa si cierro el archivo mientras está leyendo?

La lectura sigue. El reproductor vive fuera de la ventana que lo lanzó, y aparece una pastilla de control en la barra de estado con el progreso, el tiempo restante, la pausa y la parada. Es el control que siempre está disponible, y desaparece cuando termina la lectura.

¿Funciona con todos los agentes?

Leer un archivo, una selección o un resumen con IA funciona con cualquier proveedor, porque el texto viene de tu pantalla. Leer la última respuesta del agente necesita una transcripción de conversación direccionable en disco, lo que hoy significa Claude Code y Codex. Con el resto de proveedores, ese punto de entrada avisa de que no hay nada que leer.

¿Cuánto cuesta?

Read Aloud es una función Pro, facturada con los créditos de voz que ya compartes con Voice Mode y el dictado, recargados cada mes. No hay ningún cupo aparte. Los créditos se comprueban antes de la petición, así que no se gasta nada contra un saldo vacío, y puedes enlazar tu propia clave de API de OpenAI para que las lecturas vayan por tu cuenta sin gastar créditos.

¿En qué idioma lee?

En el del documento. El modelo de voz lee lo que tiene delante, así que un README en inglés sigue en inglés aunque tu interfaz de AgentsRoom esté en español. La lectura condensada es la excepción: el resumen se escribe en el idioma de tu interfaz y luego se pronuncia.

¿Puedo elegir la voz?

Sí. Read Aloud usa la voz que ya elegiste para Voice Mode en los ajustes de AgentsRoom, así que la configuras una vez y las dos funciones tiran de ella.

¿Se pueden leer dos cosas a la vez?

No, y es a propósito. Hay un solo lector para toda la aplicación: empezar una lectura nueva detiene la que está en curso. Nadie ha querido nunca dos voces sintéticas hablando una encima de la otra.

También te puede interesar

Dale un respiro a tus ojos

Descarga AgentsRoom y haz que te lean el próximo changelog.

GratisDescargar AgentsRoom

App complementaria: supervisa tus agentes en movimiento

Usa Claude, Codex, Antigravity CLI u otro proveedor de IA.

Instalar la extensión
Chrome Web Store

Envía bugs y peticiones directamente a tu backlog público.

Un vistazo a AgentsRoom en acción.

Multi-proyectos
Multi-proveedor
Multi-agentes
Estado en vivo
Diff y commit
App móvil
Vista previa
Equipos de agentes
Pruebas en navegador
Dev guiada por backlog
Biblioteca de prompts
Biblioteca de skills
Ver todas las funcionalidades