Elige un idioma abajo, pega cualquier texto y escúchalo hablado - todo en tu navegador. El modelo de voz se descarga una vez (~60 MB) y se almacena en caché localmente, por lo que las ejecuciones posteriores son instantáneas y funcionan sin conexión.
La síntesis se ejecuta localmente. Tu texto nunca abandona tu dispositivo.
Los modelos de voz se almacenan en caché en tu navegador. Las ejecuciones posteriores funcionan sin conexión.
Sin cuenta, sin créditos, sin límite de uso. Ábrelo y úsalo.
Este es un modelo neuronal real de texto a voz que se ejecuta en su propia máquina, no un cliente ligero para una API alojada. Esto es lo que lo hace posible en una pestaña del navegador.
Nada aquí necesita un servidor, por eso la herramienta es gratuita y no tiene límite de uso. La contrapartida es la calidad: los modelos en el dispositivo son una fracción del tamaño de los alojados, por lo que suenan más sintéticos que la Síntesis de Voz de pago que se muestra a continuación.
Las herramientas gratuitas anteriores, basadas en el navegador, son ideales para borradores y vistas previas, pero las voces de código abierto suenan notablemente sintéticas. La síntesis de voz de pago de Subformer produce audio natural de calidad broadcast con clonación de voz opcional.
Prueba Subformer Voice Synthesis