Texto a Voz Cuándo Usarlo
Merece la pena abrir Texto a Voz cuando necesitas locución sin instalar nada y sin entregar el texto a un servicio. Esta guía cubre cuándo encaja y cuándo no.
Equipo editorial de freetoolonline.comCuándo encaja
Encaja cuando el texto es sensible y no debe salir del dispositivo, cuando necesitas un MP3 o WAV para un vídeo o un podcast, y cuando una serie de clips debe sonar igual: las diez voces vienen del modelo descargado, no del sistema operativo, así que el mismo fragmento generado en Windows suena idéntico en Mac o en Android.
Cuándo no encaja
No encaja bien con conexiones medidas o lentas, porque el modelo de unos 380 MB se descarga una vez, ni en equipos con poca memoria, donde el modelo puede no cargar; en esos casos la página lo dice y ofrece la voz rápida del dispositivo, que cambia de un equipo a otro. Tampoco hay reproducción instantánea: cada segmento se renderiza antes de oírse, así que un texto muy largo tarda en empezar.
Qué esperar
Los controles de voz, idioma, velocidad y calidad están sobre la caja de texto. La generación usa la GPU mediante WebGPU cuando el navegador lo permite y la CPU mediante WebAssembly en caso contrario; la página indica cuál está en uso, porque el modo CPU es más lento con textos largos.
Cifras que importan
| Voces disponibles | 10 (M1-M5, F1-F5) |
| Idiomas del modelo | 31 |
| Descarga única del modelo | unos 380 MB |
| Calidad del audio | 44,1 kHz, mono |
| Velocidad | 0,8x a 1,5x |
| Pasos de calidad | 4, 8 o 16 |
| Límite de texto por generación | 20.000 caracteres |
Preguntas frecuentes
¿Las voces suenan igual en todos los dispositivos?
Sí. Las diez voces forman parte del modelo descargado y no del sistema operativo, así que el resultado es el mismo en Windows, macOS o Android.
¿Y si mi dispositivo no puede ejecutar el modelo?
La página lo indica y muestra la voz rápida del dispositivo, además de un generador de archivo compacto. Es el camino alternativo: la voz varía según el equipo y suena más sintética.