tools / tts
tts/
Texto a voz con la síntesis de voz integrada en tu navegador. El texto largo se pone en cola frase a frase, con la frase actual resaltada.
Texto
Progreso
La API de síntesis de voz del navegador no ofrece datos de audio, por lo que no se pueden exportar archivos de audio. Para conservar el audio, grábalo con la grabadora del sistema. Las voces disponibles dependen de tu sistema operativo y de tu navegador. Las voces marcadas con «(en línea)» se sintetizan en la nube del fabricante del navegador, por lo que el texto se envía a sus servidores; elige una voz local para contenido sensible.
Preguntas frecuentes
¿Puedo exportar la lectura como MP3 u otro archivo de audio?
No. La herramienta usa la interfaz de síntesis de voz integrada en el navegador, que solo reproduce el sonido y no entrega ningún dato de audio, así que no hay nada que exportar. Si necesitas un archivo de audio, la única opción es grabar la reproducción con la función de grabación de audio o de pantalla de tu sistema.
¿Qué hago si la lista de voces no tiene ninguna voz en español o no tiene la que quiero?
Las voces de la lista vienen por completo de tu sistema operativo y de tu navegador, y la herramienta no puede añadir ninguna. Si el sistema no tiene ninguna voz en español, la página muestra «No se encontró ninguna voz en español en este sistema». Descarga una en los ajustes de voz o de accesibilidad de tu sistema y vuelve a abrir la página. La lista no separa voces masculinas y femeninas, así que pruébalas una por una si te importa.
¿Qué hago si el menú de voces se queda en «Cargando…» o dice que no se admite la síntesis de voz?
En el primer caso suele significar que el navegador aún no ha devuelto su lista de voces. La herramienta espera hasta unos 5 segundos y luego recurre a la voz predeterminada del sistema con un aviso, y al reproducir normalmente funciona. El segundo caso significa que este navegador no tiene síntesis de voz en absoluto; cambia a la última versión de Chrome, Edge o Safari.
¿Qué significa «(en línea)» junto a una voz y se sube mi texto?
Las voces marcadas con «(en línea)» se sintetizan en la nube del fabricante del navegador, por lo que el texto que se lee se envía a sus servidores; las voces sin la marca son locales y el texto se queda en tu dispositivo. La herramienta en sí no sube ni guarda lo que escribes. Para texto privado, elige una voz sin la marca «(en línea)».
¿Por qué un cambio de velocidad o de tono no surte efecto de inmediato?
Un cambio en un control deslizante durante la reproducción se aplica desde la frase siguiente: cada frase se entrega al navegador por separado y sus ajustes se fijan cuando esa frase empieza. Para oírlo enseguida, haz clic en «Reproducir desde el principio» o en una frase del panel «Progreso» para reiniciar desde ahí. La velocidad va de 0.5 a 2 veces, el tono de 0 a 2 y el volumen de 0 a 100%. Si editas el texto durante la reproducción, esta se detiene.
¿Cómo se divide el texto largo en frases y por qué las pausas suenan poco naturales?
La herramienta divide el texto en los signos de puntuación de fin de frase y en los saltos de línea (。!?;… y también . ! ? ;, y el punto solo cuenta si va seguido de un espacio o del final) y entrega las frases al navegador de una en una. Una frase de más de 160 caracteres se divide de nuevo en comas, dos puntos o espacios; una frase larga sin un buen punto de corte se corta a una longitud fija, lo que suena poco natural, así que añadir puntuación al texto ayuda mucho. Esto se hace porque algunos navegadores cortan una lectura individual tras unos 15 segundos.
¿Cómo empiezo desde la mitad y cómo reanudo después de una pausa?
Haz clic en cualquier frase del panel «Progreso» de la derecha y la lectura empieza desde esa frase. Mientras se reproduce, «Pausar» pone en pausa y el botón pasa a ser «Reanudar»; «Detener» vuelve al estado inactivo y «Reproducir» empieza entonces desde el principio. Si una frase no se puede leer, la página muestra el error y salta a la siguiente frase.