Comparativa de servicios TTS online: 5 herramientas gratuitas de texto a voz
Comparamos TTSMaker, TTSFree, Luvvoice, TTS.ai y ElevenLabs por registro, cuota gratuita, límite de caracteres, modelos, guardado y uso comercial, además de la alternativa local de DORODORA en el navegador.
Los momentos en los que necesitas una voz — doblaje de vídeo, narración, anuncios o alertas de donaciones en directo — aparecen más a menudo de lo que parece. Cuando no tienes un estudio ni un locutor, los servicios online de texto a voz (Text to Speech, TTS) son la forma más rápida de convertir texto en audio.
Pero cada servicio tiene reglas distintas de registro, cuota gratuita, modelos disponibles y uso comercial, así que es difícil elegir solo por el nombre. En este artículo analizamos cinco servicios online representativos a través de los factores que realmente importan en el uso real.
Si los comparas, verás que los servicios en la nube comparten limitaciones similares, como el registro o los límites de caracteres. Por eso, al final también presentamos una herramienta que rompe con ese patrón: el TTS de DORODORA. No convierte en un servidor en la nube. Descarga los archivos del modelo a tu navegador y se ejecuta directamente en tu dispositivo, lo que resuelve de forma natural algunas frustraciones habituales del TTS online.
Prueba el TTS Playground ahora
¿Qué TTS elegir?
Lo que hay que comprobar es sorprendentemente sencillo.
- ¿Se puede usar sin registrarse?
- ¿Cuánto se puede generar gratis?
- ¿Qué modelos y voces ofrece?
- ¿Se puede usar el audio generado de forma comercial?
- ¿Se puede guardar el resultado como archivo?
- ¿Cuál es el número máximo de caracteres por petición?
A continuación, presentamos cada servicio con estos seis puntos de control.
TTSMaker
TTSMaker destaca por su generosa cuota gratuita.
- Registro: No requerido
- Cuota gratuita: 20.000 caracteres por semana (algunas voces ilimitadas)
- Máx. caracteres: 1.000 por petición (20.000+ con Pro)
- Modelos y voces: Múltiples voces de IA por idioma
- Guardado: Descarga en MP3 · WAV · OGG · AAC · OPUS
- Uso comercial: Permitido (sin atribución)
La mayor ventaja son los derechos comerciales. Obtienes el 100% de derechos de uso comercial para el audio generado y no necesitas atribuir la fuente, por lo que puedes usarlo directamente en YouTube, TikTok o podcasts. Los controles de velocidad, tono, volumen, pausas entre frases y mezcla de música de fondo (BGM) también están bien cubiertos.
Puntos a tener en cuenta
- El audio generado se elimina automáticamente tras 30 minutos, así que descárgalo de inmediato.
- Algunos ajustes avanzados son solo para Pro.
Una primera opción sólida para creadores que convierten guiones largos en audio de forma regular.
TTSFree
TTSFree permite empezar a convertir sin iniciar sesión.
- Registro: No requerido para conversión gratuita
- Cuota gratuita: 50 conversiones al día como invitado (500.000 caracteres al mes al registrarse)
- Máx. caracteres: 500 por petición (2.000 al registrarse)
- Modelos y voces: Voces neuronales de Google/Microsoft, 700+ voces en 140+ idiomas
- Guardado: Descarga en MP3
- Uso comercial: Permitido
Utiliza las últimas voces neuronales de Google y Microsoft, por lo que la pronunciación es nítida y estable. Voces de nivel superior como Wavenet o Neural2 también están disponibles gratis en cierta medida. Admite velocidad, tono, volumen, SSML y música de fondo.
Puntos a tener en cuenta
- Las voces premium requieren un plan de pago.
- Los archivos generados se eliminan en 24 horas.
Una opción ligera y rápida cuando quieres convertir una frase corta en audio sin registrarte.
Luvvoice
Luvvoice ofrece la selección de voces más amplia.
- Registro: Uso gratuito disponible (más funciones al iniciar sesión)
- Cuota gratuita: 20.000 caracteres al mes
- Máx. caracteres: 3.000 por petición (20.000 para usuarios de pago conectados)
- Modelos y voces: 200+ voces en 70+ idiomas + voces personalizadas
- Guardado: Descarga en MP3
- Uso comercial: Incluido en planes Premium
Una función destacada es la conversión de archivos. Puedes subir documentos PDF y TXT y convertirlos a voz de una vez, útil para artículos largos o guiones. Los controles de velocidad y tono vienen por defecto, y los usuarios conectados también pueden insertar pausas entre frases. Además gestiona un mercado de voces personalizadas muy variado.
Puntos a tener en cuenta
- Los derechos comerciales están ligados a planes Premium, así que revisa el plan según tu caso.
- El audio generado se conserva solo 72 horas.
Especialmente bueno para trabajos voluminosos como la narración de documentos.
TTS.ai
TTS.ai es un poco diferente. En lugar de vender un solo modelo, reúne modelos de código abierto en un mismo lugar.
- Registro: No requerido para modelos gratuitos
- Cuota gratuita: 5.000 caracteres al día (10.000 al mes + 15.000 de bono al registrarse)
- Máx. caracteres: 500 por petición (5.000 al registrarse)
- Modelos y voces: 36+ modelos open source, 314+ voces, 55+ idiomas
- Guardado: Descarga en WAV (convertible a MP3 etc. con conversor integrado)
- Uso comercial: Permitido
Desde modelos ligeros como Kokoro, Piper y MeloTTS hasta modelos de clonación de voz como Chatterbox y GPT-SoVITS, puedes renderizar la misma frase con varios modelos y comparar. También ofrece una API compatible con OpenAI desde el plan gratuito, cómoda para desarrolladores.
Puntos a tener en cuenta
- Los idiomas admitidos y el coste por carácter varían según el modelo.
- El uso serio probablemente requerirá un plan de pago desde $9/mes.
Ideal si quieres comparar muchos modelos de TTS lado a lado.
ElevenLabs
ElevenLabs es abrumador en calidad de voz.
- Registro: Requerido (plan gratuito disponible)
- Cuota gratuita: 10.000 créditos al mes (unos 10 minutos)
- Máx. caracteres: Varía por modelo (Eleven v3: 5.000, Multilingual v2: 10.000)
- Modelos y voces: Eleven v3, Multilingual v2, Flash v2.5, Turbo v2.5 / 11.000+ voces
- Guardado: Descarga en MP3 · WAV
- Uso comercial: Solo planes de pago (gratis requiere atribución)
Se presenta como voces que ajustan la entrega a la emoción y el contexto, con gran naturalidad. También ofrece clonación instantánea de voz con alrededor de un minuto de muestra. Compatible con más de 32 idiomas (70+ con Eleven v3).
Puntos a tener en cuenta
- El uso comercial y la clonación de voz empiezan con planes de pago ($5–$6/mes en adelante).
- Los créditos se agotan rápido, así que calcula el presupuesto para guiones largos.
Vale la pena considerarlo primero para proyectos comerciales donde la calidad final de la voz decide el resultado.
Frustraciones comunes del TTS online
Mirando los cinco servicios lado a lado, cada uno tiene puntos fuertes claros, pero también comparten rasgos estructurales similares.
- Tu texto se envía a un servidor para la conversión.
- Las cuotas semanales/mensuales de caracteres pueden encarecer las pruebas repetidas.
- Los archivos resultantes se conservan poco tiempo (de 30 minutos a 72 horas), así que debes guardarlos de inmediato.
En la mayoría de los casos no es un gran problema. Pero si quieres vocalizar texto sensible, o probar la misma frase decenas de veces en distintos modelos, esta estructura puede estorbar.
Ahí es cuando merece la pena probar un TTS que funcione directamente en tu navegador.
El TTS de DORODORA
El TTS que proporciona DORODORA también usa modelos open source, similar a TTS.ai. Pero en lugar de procesar en un servidor en la nube, descarga los archivos del modelo a tu navegador y se ejecuta directamente en tu dispositivo.
Resumido con los mismos puntos de control anteriores:
- Registro: No requerido
- Cuota gratuita: Ilimitada
- Máx. caracteres: 1.000 por petición
- Modelos y voces: 4 modelos locales siguientes
- Guardado: Descarga en WAV
- Uso comercial: Permitido
Por eso, tu texto y el audio generado nunca se envían a los servidores de DORODORA y no tienes que preocuparte por cuotas. Solo abre la página y úsalo, luego guarda el resultado como WAV también para uso comercial.
Modelos
- SuperTonic — 399MB · 10 voces · 31+ idiomas
- Pocket — 199MB · 8 voces · inglés, alemán, italiano, portugués, español
- Kokoro — 92MB · 28 voces · inglés
- Kitten — 28MB · 8 voces · inglés
Gracias a que SuperTonic cubre más de 31 idiomas, puedes probar emisiones y contenidos multilingües con una sola herramienta.
Los modelos Pocket también incluyen clonación de voz. Sube un clip limpio de 1–3 segundos y genera TTS con esa misma voz. Las voces personalizadas se guardan en tu navegador y pueden reutilizarse en tu próxima visita.
También admite un divertido efecto Animalese, un interruptor que convierte el audio generado en una voz de personaje rápida y adorable.
¿Para quién es?
- Streamers que quieren previsualizar una voz de IA para alertas de donaciones antes de salir en directo
- Usuarios que prefieren no enviar su texto a un servidor externo
- Usuarios que quieren comparar modelos y voces sin preocuparse por cuotas
- Creadores que quieren guardar resultados como WAV y usarlos directamente en edición
Por otro lado, necesitas descargar los archivos del modelo por adelantado (28MB–399MB) y algunos modelos son solo en inglés.
Combinaciones recomendadas por caso de uso
En la práctica, es mejor combinar herramientas según el propósito que aferrarse a una sola.
Guiones largos y narración de documentos
La conversión de archivos de Luvvoice o la generosa cuota semanal de TTSMaker es útil cuando necesitas vocalizar un manuscrito entero.
Locuciones comerciales
Si la calidad final decide el resultado, el plan de pago de ElevenLabs es la opción por defecto. Si quieres mantenerte en lo gratuito, una combinación de TTSMaker, TTS.ai y DORODORA, que permiten claramente el uso comercial, cubre la mayoría de necesidades.
Comparación de modelos y experimentos
Compara modelos open source en la nube con TTS.ai y modelos locales con el TTS de DORODORA; acotarás candidatos rápidamente.
Configuración de alertas de donación
Cuando quieres que los mensajes de donación sean leídos por una voz de IA, necesitas escuchar cómo suenan realmente. Prueba combinaciones de modelo y voz en el TTS de DORODORA y luego conecta tu favorita a través de los ajustes de TTS en la consola de DORODORA. También admite Voice Cloning TTS, por lo que puedes hacer que los mensajes se lean con tu propia voz.
FAQ
¿Dónde puedo usar el audio comercialmente y gratis?
TTSMaker, TTS.ai y DORODORA cumplen. ElevenLabs y Luvvoice vinculan los derechos comerciales a planes de pago, así que revisa el plan según tu caso.
¿Dónde puedo usarlo sin registrarme?
TTSFree y TTS.ai (modelos gratuitos), y DORODORA se pueden usar sin registrarse.
¿Hay algún servicio que no envíe mi texto a un servidor?
Solo DORODORA. Descarga modelos a tu navegador y procesa todo en el dispositivo, por lo que el texto y el audio nunca se envían a un servidor. Otros servicios en la nube envían tu texto a un servidor para la conversión.
¿Cómo preparo el TTS para alertas de donación?
Encuentra primero un modelo y una voz que te gusten en el TTS de DORODORA. Luego activa el TTS en la consola de DORODORA y los mensajes de donación serán leídos por una voz de IA y mostrados en el directo vía fuente de navegador de OBS.
Referencia al momento de escribir
Este artículo se redactó con base en las páginas públicas de cada servicio a 26 de agosto de 2026. Las cuotas gratuitas, el número de voces y las condiciones de uso comercial pueden cambiar en cualquier momento, así que consulta la información más reciente antes del uso real.
- TTSMaker: https://ttsmaker.com/es
- TTSFree: https://ttsfree.com/es
- Luvvoice: https://luvvoice.com/es
- TTS.ai: https://tts.ai/
- ElevenLabs Text to Speech: https://elevenlabs.io/es/text-to-speech
- DORODORA TTS: https://dorodora.com/playground
Uso comercial de los modelos que proporciona DORODORA
Los cuatro modelos que se ejecutan en el TTS de DORODORA se basan todos en proyectos públicos de código abierto. Su usabilidad comercial a nivel del proyecto original es la siguiente.
- SuperTonic (Supertone): El código es MIT y los pesos del modelo son OpenRAIL-M. El uso comercial está permitido con atribución y restricciones basadas en el uso.
- Pocket (Kyutai): Las licencias varían por voz. Algunas voces que pueden usarse comercialmente (CC0, CC BY 4.0) coexisten con voces del dataset Expresso que son CC BY-NC 4.0 (solo no comercial).
DORODORAsolo proporciona voces que pueden usarse comercialmente, por lo que puedes usarlas en contenido monetizado sin comprobaciones adicionales. - Kokoro (hexgrad): Los pesos son Apache 2.0, por lo que no hay restricciones para uso comercial.
- KittenTTS (KittenML): Apache 2.0, por lo que no hay restricciones para uso comercial.
Los cuatro modelos pueden usarse sin restricciones comerciales. En cambio, cuando clonas tu propia voz con una voz Custom, no hay problema de licencia de datos de terceros.
En cualquier caso, la clonación no autorizada de la voz de otra persona o el uso engañoso está prohibido para todos los modelos, por lo que es prudente verificar la licencia más reciente de cada modelo y voz antes de publicar o monetizar resultados.
Conclusión
La elección de TTS online ya es lo suficientemente amplia. TTSMaker es fuerte en cuota y flexibilidad, TTSFree en uso rápido sin registro, Luvvoice en narración de documentos, TTS.ai en experimentos con modelos y ElevenLabs en calidad de primer nivel.
Si además necesitas "sin transferencia al servidor, sin cuota, sin registro", DORODORA, que funciona localmente en tu navegador, es un buen complemento. Es gratuito y permite uso comercial, así que pruébalo cuando necesites una voz para alertas de donación o contenido.
Puedes probar el TTS ahora mismo en dorodora.com/playground.