Texto a Voz Online Gratis

Convierte texto en voz con la síntesis del navegador. Varias voces disponibles. Gratis, rápido y funciona totalmente en tu navegador, sin registro.

Actualizado

Share:
Home/Text Tools/Text to Speech

Text to Speech

Convert text to speech using your browser's built-in speech synthesis. Choose from multiple voices and languages.

Text Input

0 words, 0 characters, 0 sentences

1.0x

Reading Statistics

Words

0

Characters

0

Sentences

0

Paragraphs

0

Unique Words

0

Syllables

0

Avg Word Length

0

characters

Vocabulary Richness

0%

unique/total

Speed (WPM)

180

Est. Duration

0s

Readability

-

N/A

Syllables/Word

0

Available Voices

0

Languages

0

Voice Browser
0 voices

Saved Bookmarks (0)

No bookmarks yet. Save text and voice settings for quick access later.

Tip: Use Ctrl+Shift+B to quickly save a bookmark.

Pronunciation Dictionary

Define custom pronunciations for words. The replacement text will be spoken instead of the original.

Keyboard Shortcuts

About Text to Speech

This tool uses the Web Speech API built into modern browsers to convert text to speech. The available voices depend on your browser and operating system.

Features:

  • Multiple voices and languages with preview, filtering, favorites, and voice comparison
  • Adjustable speed (0.5x to 2x) with presets, pitch presets (deep to chipmunk), and volume
  • Four highlight modes: word, sentence, paragraph, and karaoke with custom colors
  • SSML support for pauses, emphasis, and character spelling
  • Queue multiple texts to speak in sequence with reordering, shuffle, and auto-play
  • Batch mode with clipboard import, pause/resume, export, and progress tracking
  • Bookmarks with tags, sorting, search, export/import for backup and sharing
  • Auto-detect language with confidence indicator and auto voice selection
  • Custom pronunciation dictionary persisted in localStorage
  • Record and download audio (requires microphone permission)
  • Detailed reading statistics: word count, syllables, vocabulary richness, readability, duration at all speeds
  • 16 keyboard shortcuts for playback, volume, pitch, tabs, highlights, bookmarks, and settings
  • Settings persistence across sessions via localStorage
  • Inline speed adjuster in playback controls
  • Works offline after page load

SSML Tags Supported:

  • <break time="500ms"/> - Insert a pause
  • <emphasis>text</emphasis> - Emphasize text
  • <say-as interpret-as="characters">ABC</say-as> - Spell out characters

Browser Support:

  • Chrome, Edge, Safari, Firefox (latest versions)
  • Voice availability varies by browser and OS
  • Mobile browsers may have limited voice options

Privacy First: All speech synthesis happens locally in your browser using built-in APIs. Your text is never sent to any server. Bookmarks, pronunciation dictionaries, favorite voices, and settings are stored in your browser's localStorage.

Preguntas Frecuentes

¿Qué es Texto a Voz?

Texto a Voz es una herramienta online gratuita que convierte texto en voz mediante la síntesis del navegador, con múltiples voces disponibles. Funciona íntegramente en tu navegador, sin necesidad de instalación ni registro.

¿Puedo elegir distintas voces?

Sí, la herramienta Texto a Voz ofrece múltiples voces e idiomas según lo que admitan tu navegador y tu sistema operativo.

¿Es gratis usar Texto a Voz?

Sí, Texto a Voz es 100 % gratis, sin registro, sin tarifas ocultas y sin límites de uso. Todo el procesamiento se realiza localmente en tu navegador, garantizando una privacidad total.

¿Están seguros mis datos con esta herramienta?

Por supuesto. Texto a Voz procesa todo del lado del cliente, en tu navegador. No se sube ni se almacena ningún dato en ningún servidor. Tu contenido permanece siempre privado en tu dispositivo.

¿Funciona Texto a Voz en dispositivos móviles?

Sí, Texto a Voz es totalmente adaptable y funciona en smartphones y tablets. Puedes usarlo en cualquier dispositivo con un navegador web moderno, sin necesidad de descargar ninguna app.

¿Necesito crear una cuenta para usar esta herramienta?

No se necesita cuenta ni registro. Simplemente abre Texto a Voz en tu navegador y empieza a usarlo de inmediato. No hay muros de registro ni restricciones de uso.

¿Puedo procesar grandes cantidades de texto?

Sí, Texto a Voz gestiona texto de cualquier longitud con un procesamiento rápido y en tiempo real. Como todo se ejecuta en tu navegador, el rendimiento depende de tu dispositivo, pero funciona bien en la mayoría de los casos.

¿Cómo uso Texto a Voz?

Simplemente introduce tu texto en el campo proporcionado, ajusta los parámetros a tu gusto y la herramienta lo procesará al instante. Después podrás copiar el resultado al portapapeles o descargarlo.

¿Qué navegadores son compatibles?

Texto a Voz funciona en todos los navegadores modernos, incluidos Chrome, Firefox, Safari, Edge y Opera. Para una mejor experiencia, usa la última versión de tu navegador preferido.

¿Cuánto tiempo tardará en leer mi texto en voz alta?

A la velocidad natural de 1x, esta herramienta lee a un ritmo aproximado de 180 palabras por minuto, así que un párrafo de 180 palabras tarda alrededor de un minuto, un artículo de 900 palabras unos cinco minutos, y un texto de 1800 palabras cerca de diez. El ajuste de velocidad escala esa estimación directamente: 2x reduce el tiempo aproximadamente a la mitad, mientras que 0.5x lo duplica, y la herramienta muestra una estimación de duración en vivo basada en tu número de palabras y la velocidad elegida antes de que pulses reproducir. El tiempo real varía ligeramente porque la puntuación añade pausas naturales y algunas voces hablan un poco más rápido o más lento que otras. Si solo necesitas una cifra aproximada, divide tu número de palabras entre 180 para obtener los minutos a velocidad normal. Pega tu texto arriba para ver la duración estimada exacta según la voz y la velocidad que elijas.

¿Por qué las voces disponibles son diferentes en mi teléfono y en mi portátil?

Esta herramienta utiliza la API Web Speech integrada en tu navegador, lo que significa que las voces que ofrece son las que ya están instaladas en tu dispositivo y sistema operativo concretos, y no una biblioteca fija alojada en la nube. Por eso la lista cambia entre Chrome, Safari y Edge, y entre Windows, macOS, Android e iOS: cada plataforma incluye su propio conjunto. Un portátil con Windows puede mostrar una docena de voces, mientras que un iPhone presenta una selección completamente distinta, e instalar paquetes de idioma adicionales en los ajustes del sistema puede añadir más. La calidad también varía, ya que algunas plataformas incluyen voces de mayor fidelidad que otras. Como la síntesis ocurre de forma local, no se descarga ninguna voz desde este sitio. Abre la herramienta en el dispositivo que vayas a usar, explora la lista de voces filtrada, marca tus favoritas y compara dos en paralelo para encontrar la que mejor te suene.

¿Puedo descargar el audio hablado como archivo?

Sí. Además de la reproducción en vivo, la herramienta puede grabar el resultado hablado y guardarlo como archivo de audio .webm que puedes descargar y conservar, lo cual resulta práctico para convertir un guion, un apunte de estudio o un borrador en un clip escuchable. La grabación utiliza el grabador multimedia integrado en tu navegador, por lo que solicita permiso de micrófono para capturar el flujo de audio mientras se reproduce la voz. El archivo .webm resultante se reproduce en la mayoría de los navegadores y reproductores multimedia modernos, y puedes convertirlo a otro formato más tarde con un conversor aparte si una aplicación concreta necesita MP3 o WAV. Todo sigue ocurriendo en tu propio dispositivo, así que la grabación nunca se sube a ningún sitio. Escribe tu texto, elige una voz y una velocidad, y luego inicia la grabación para capturar la narración y descargar el archivo cuando termine.

¿Por qué la herramienta pronuncia mal nombres o siglas, y cómo lo soluciono?

Los sintetizadores de voz calculan la pronunciación a partir de reglas ortográficas, por lo que nombres poco comunes, términos de marca, palabras extranjeras y siglas suelen salir mal porque no siguen los patrones habituales del idioma. Para solucionarlo, la herramienta incluye un diccionario de pronunciación: asocias una palabra complicada con una reescritura fonética que la voz pronuncia correctamente, y esa sustitución se aplica cada vez que aparece la palabra. Por ejemplo, puedes reescribir una sigla para que se lea letra por letra, o reescribir un nombre tal como suena realmente. Un interruptor opcional de SSML ofrece un control más fino sobre el énfasis y las pausas para casos avanzados, y a veces cambiar a otra voz también ayuda a resolver una palabra concreta. Añade tus palabras problemáticas al diccionario de pronunciación de arriba y vuelve a reproducir el pasaje para confirmar que cada una suena ahora como querías, antes de grabarlo o compartirlo.

¿Cuál es la diferencia entre los ajustes de velocidad y tono?

La velocidad, también llamada rate, controla lo rápido que habla la voz —cuántas palabras salen por minuto— sin cambiar lo grave o aguda que suena. Esta herramienta ofrece seis niveles predefinidos, desde 0.5x para una escucha muy lenta y cuidadosa hasta 2x para revisar rápidamente un texto largo, con 1x como valor natural predeterminado que lee a unas 180 palabras por minuto. El tono es algo distinto: sube o baja el timbre de la voz a través de cinco niveles, desde un registro más grave hasta uno más agudo, mientras la velocidad de habla se mantiene igual. En resumen, la velocidad cambia el tempo y el tono cambia el timbre. Puedes ajustar ambos de forma independiente, e incluso modificarlos a mitad de la reproducción para afinar el sonido. Prueba una velocidad más lenta para revisar textos o practicar idiomas, y una más rápida para escanear por encima, y luego ajusta el tono de arriba hasta que la voz te resulte cómoda.

Embed This Tool

Add a free, live version of this widget to your own website or blog post — it runs entirely in your visitors' browsers, with a credit link back to The Toolbox.

Copy & paste this HTML
<iframe src="https://getthetoolbox.com/embed/text-to-speech" title="Free Text to Speech Online — The Toolbox" width="100%" height="280" style="max-width:480px;border:1px solid #e2e8f0;border-radius:12px" loading="lazy"></iframe>
<p style="font-size:12px;margin:4px 0 0"><a href="https://getthetoolbox.com/text-tools/text-to-speech?utm_source=embed&utm_medium=widget" target="_blank" rel="noopener">Free Text to Speech Online</a> by The Toolbox</p>

Acerca de la herramienta Conversor de Texto a Voz

El Conversor de Texto a Voz lee en voz alta cualquier texto con una voz de sonido natural, directamente en tu navegador. Pega un artículo, un capítulo, un correo electrónico o tu propio borrador, elige una voz y pulsa reproducir. Está pensado para quienes prefieren escuchar antes que leer: personas que aprovechan el trayecto al trabajo para ponerse al día con lecturas largas, escritores que revisan un borrador de oído, estudiantes de idiomas que comprueban la pronunciación, y cualquiera que encuentre el audio más accesible que el texto en una pantalla.

Todo ocurre de forma local. La herramienta utiliza la API Web Speech integrada en el navegador para la síntesis de voz, así que tu texto nunca se sube a ningún servidor, no hace falta registrarse y no existe límite de uso. Las voces disponibles son las que ya están instaladas en tu propio dispositivo y sistema operativo, por eso la lista exacta varía entre Chrome, Safari, Edge, y entre Windows, macOS o Android.

Cómo controlar la voz

Tres ajustes determinan cómo suena la lectura, y puedes modificarlos mientras se está reproduciendo:

  • Voz — elige entre las voces que ofrece tu sistema. Puedes filtrar la lista, marcar favoritas y comparar dos voces en paralelo antes de decidirte por una.
  • Velocidad (rate) — seis niveles predefinidos, desde 0.5x (muy lenta) hasta 2x (muy rápida), con 1x como valor natural predeterminado. A velocidad normal, la herramienta lee a un ritmo aproximado de 180 palabras por minuto, y la estimación en vivo se ajusta según la velocidad que elijas.
  • Tono (pitch) — cinco niveles, desde un registro grave y profundo hasta un tono agudo tipo "ardilla", para poder suavizar o agudizar la misma voz.

Un control de volumen independiente ajusta la intensidad del sonido sin depender del volumen de tu sistema, y las opciones de reproducir, pausar y reanudar te permiten detenerte a mitad de una frase y retomarla exactamente donde la dejaste.

Resaltado en tiempo real y textos más largos

Mientras la voz habla, la herramienta resalta el texto en sincronía para que tus ojos puedan seguir el audio. Puedes resaltar palabra por palabra, cambiar a un modo estilo karaoke y elegir el color del resaltado. Esto resulta realmente útil para revisar textos: escuchar cada palabra mientras la ves hace que las palabras omitidas, las frases torpes y las oraciones demasiado largas sean mucho más fáciles de detectar que con una lectura silenciosa.

Para trabajos más grandes existen tres modos de funcionamiento. El modo Individual lee un solo bloque de texto. El modo Cola encadena varios pasajes para reproducirlos uno tras otro. El modo Lote procesa una lista de elementos independientes en secuencia, con el progreso de cada uno visible, para que puedas procesar muchos fragmentos cortos en una sola pasada. Cada modo muestra una duración estimada basada en el número de palabras y la velocidad elegida.

Pronunciación, idioma y guardado del audio

Un diccionario de pronunciación integrado te permite sustituir una palabra complicada por una grafía que el sintetizador pronuncie correctamente, algo muy útil para nombres, marcas y siglas que la voz predeterminada suele destrozar. La detección automática de idioma, opcional, puede hacer coincidir la voz con el idioma de tu texto, y hay un interruptor de SSML disponible para un control más fino de cómo se lee el texto.

También puedes guardar el resultado hablado como archivo de audio. La herramienta graba la reproducción en un archivo .webm que puedes descargar y conservar, lo cual resulta práctico para convertir un guion en un clip escuchable. La grabación utiliza el grabador multimedia de tu navegador y solicita permiso de micrófono para capturar el audio. Los marcadores completan el conjunto: guarda un fragmento de texto junto con su voz y su configuración, etiquétalo y vuelve a cargarlo más tarde sin necesidad de escribir nada de nuevo.

Por qué conviene un conversor de texto a voz en el navegador

Una aplicación de narración dedicada o un servicio de TTS en la nube pueden sonar más pulidos, pero eso suele implicar una instalación, una cuenta o un cobro por carácter. Esta herramienta de Texto a Voz cambia un poco de pulido vocal por acceso instantáneo y privacidad total: sin cuenta, sin subir archivos y sin límite de uso. Como la síntesis se ejecuta en tu propio dispositivo, sigue funcionando incluso con una conexión inestable una vez que la página ha cargado, y los textos confidenciales —un contrato, una publicación aún no publicada, notas privadas— nunca salen de tu ordenador.