TEXTO A VOZ EN ESPAÑOL WAV GRATIS

Texto a Voz en Español Gratis

Spanish text to speech con tres voces neuronales, pronunciación castellana o latinoamericana y descarga WAV. Escribe tu texto y genera el audio directamente en el navegador.

0 car.0 pal.~—
Voz
0:00—
GratisSin registroProcesamiento en tu navegadorDescarga WAV
¿Qué hace esta herramienta? Convierte texto en español a un archivo de voz WAV directamente en tu navegador. Elige Dora, Alex o Santa; selecciona pronunciación castellana o latinoamericana cuando esté disponible; ajusta la velocidad y genera el audio gratis, sin crear una cuenta. La primera vez se descarga el modelo de voz; el navegador puede reutilizarlo desde su caché en usos posteriores.

Cómo convertir texto a voz en español

Usa el convertidor online de texto a voz en cinco pasos. No hace falta instalar una aplicación; la primera vez, el navegador descarga el modelo de voz y muestra el progreso.

  1. Escribe o pega el textoIntroduce el texto en español que quieres escuchar o carga uno de los ejemplos. Para una pronunciación más natural, revisa nombres propios, abreviaturas y números antes de generar el audio.
  2. Elige una voz y pronunciaciónSelecciona Dora, Alex o Santa. Dora y Alex ofrecen pronunciación castellana o latinoamericana; Santa está disponible con pronunciación latinoamericana.
  3. Ajusta la velocidadUsa el control de velocidad, de 0,5× a 1,8×. El ajuste inicial es 1,0×.
  4. Genera y escucha el audioPulsa «Generar y escuchar». En el primer uso, el navegador descarga el modelo de voz. Verás el progreso y la generación empezará cuando termine la carga.
  5. Descarga el archivo WAVReproduce el resultado y, cuando esté listo, selecciona «Descargar Audio» para guardar el archivo WAV en tu dispositivo.

Voces y pronunciación en español

Elige entre tres perfiles de voz. Dora y Alex están disponibles con pronunciación castellana o latinoamericana; Santa está disponible con pronunciación latinoamericana. La pronunciación modifica algunos sonidos, pero no crea una voz específica para cada país.

Perfiles de voz y variantes de pronunciación disponibles
PerfilPronunciaciónTipo de voz
🇪🇸 DoraCastellanoFemenina
🌎 DoraLatinoamericanoFemenina
🇪🇸 AlexCastellanoMasculina
🌎 AlexLatinoamericanoMasculina
🌎 SantaLatinoamericanoMasculina

¿Qué es el texto a voz (Text to Speech)?

El texto a voz, también llamado TTS (Text to Speech) o síntesis de voz, convierte palabras escritas en audio hablado. Este generador usa Kokoro-82M para sintetizar la voz en tu navegador y exportar el resultado como WAV.

Puedes usarlo para escuchar un borrador, preparar una narración de prueba, practicar la comprensión auditiva o crear una referencia de pronunciación. Revisa el audio antes de publicarlo: nombres propios, siglas y palabras poco comunes pueden pronunciarse de forma distinta.

Velocidad de voz: de 0,5× a 1,8×

Ajusta la velocidad después de elegir la voz. Estas son ideas para empezar; el ritmo que funciona mejor depende del texto y de quien lo escucha.

Rango de velocidad y usos habituales
VelocidadPuede ser útil para
0,5×–0,7×Repasar frases y escuchar con más pausa
0,8×–0,9×Escuchar una narración con un ritmo más pausado
1,0×Velocidad inicial para probar el texto
1,1×–1,8×Comparar un ritmo más rápido para textos breves

Síntesis de voz en el navegador y caché del modelo

La herramienta ejecuta Kokoro-82M en un Web Worker del navegador: aprovecha WebGPU cuando está disponible y recurre a WebAssembly como alternativa. Tu texto se procesa en el dispositivo y no se envía al servicio de síntesis de SonicLab.

La primera generación necesita descargar los archivos del modelo y requiere conexión a Internet. El navegador puede guardarlos en su caché para acelerar usos posteriores. Si borras los datos del sitio o el navegador elimina esa caché, puede ser necesario descargarlos otra vez. La velocidad también depende del dispositivo y de la longitud del texto.

Preguntas frecuentes sobre el convertidor de texto a voz

¿Cómo convierto texto a voz en español?

Escribe o pega el texto, elige una voz, ajusta la velocidad y pulsa «Generar y escuchar». Cuando el audio esté listo, puedes reproducirlo y descargarlo como WAV.

¿El convertidor de texto a voz es gratis?

Sí. Puedes generar y descargar audio sin crear una cuenta ni pagar una suscripción. La velocidad de generación depende del dispositivo, el navegador y la longitud del texto.

¿Qué voces y pronunciaciones están disponibles?

Hay tres perfiles de voz de Kokoro: Dora (femenina), Alex (masculina) y Santa (masculina). Dora y Alex ofrecen pronunciación castellana y latinoamericana; Santa ofrece pronunciación latinoamericana. Son perfiles de voz y variantes de pronunciación, no voces distintas para cada país.

¿Mi texto se envía a un servidor?

No. El texto se procesa en el navegador mediante el modelo de voz local. La descarga inicial del modelo y sus archivos sí requiere conexión a Internet; el contenido que escribes no se envía al servicio de síntesis de SonicLab.

¿Por qué tarda más la primera vez?

Antes de la primera generación, el navegador descarga los archivos del modelo de voz. La herramienta muestra el progreso y guarda los archivos en la caché del navegador cuando está disponible. En usos posteriores puede reutilizar esa caché, aunque el almacenamiento del navegador puede borrarse.

¿En qué formato puedo descargar el audio?

El audio se descarga como WAV sin comprimir. Puedes escucharlo en la herramienta o guardarlo para editarlo en otro programa compatible con WAV.

¿Puedo cambiar la velocidad de la voz?

Sí. El control permite elegir entre 0,5× y 1,8×; 1,0× es la velocidad inicial. Una velocidad menor puede ayudar a seguir el audio mientras estudias o revisas un texto.

¿Funciona en móviles?

La página se adapta a teléfonos, tabletas y ordenadores. La generación local puede tardar más o estar limitada por la memoria y las capacidades del dispositivo móvil.

Genera tu audio en español

Pega un texto, prueba las voces y descarga el resultado en WAV cuando esté listo. La primera carga del modelo puede tardar más que las siguientes.

Probar el convertidor