¿Por qué es 100% gratuito y sin restricciones?
Las plataformas de IA tradicionales cobran suscripciones costosas porque procesan el audio en servidores en la nube muy caros. Nuestra herramienta cambia las reglas del juego.
Gracias a las tecnologías WebGPU y WASM, el modelo de IA se ejecuta directamente con el hardware de TU ordenador (CPU/GPU).
Como no pagamos facturas de servidores por tu síntesis de voz, disfrutas de un servicio ilimitado, gratuito y privado para siempre.
Comparación de motores TTS
Cuatro motores, cuatro niveles de calidad. Elige el que mejor se adapte a tu equipo y a tu uso.
| Característica | Kokoro TTS | Piper TTS | Kitten TTS | eSpeak NG |
|---|---|---|---|---|
| Calidad de voz | Ultra-realista AI | Natural, limpia | Ligera, fluida | Robótica, clásica |
| Requisitos de hardware | Medios (requiere WebGPU) | Bajos (CPU rápida) | Muy bajos | Mínimos (funciona en todo) |
| Tamaño del modelo | ~325 MB | ~60 MB | ~23 MB | Sin descarga |
| Uso ideal | Audiolibros, voz para vídeo | Mensajes, asistentes | Móviles débiles | Accesibilidad (lectores de pantalla) |
Preguntas frecuentes (FAQ)
¿Existe un límite de palabras o caracteres?
No. Al realizarse la conversión por completo en tu propio dispositivo, puedes procesar libros enteros, guiones largos o artículos sin que nadie te pida créditos ni una cuenta premium.
¿Puedo usar los audios para monetizar en YouTube, TikTok o proyectos comerciales?
Sí. Los cuatro motores integrados (Kokoro, Piper, Kitten y eSpeak) poseen licencias de código abierto que permiten el uso comercial libre. El archivo .wav o .mp3 resultante es 100% tuyo.
¿Por qué tarda unos segundos la primera generación?
La primera vez que seleccionas una voz específica, tu navegador descarga el archivo del modelo (aprox. 60-325 MB) y lo guarda en tu caché local. Las siguientes generaciones son instantáneas y funcionan incluso sin conexión.