Subformer
Gratuït · Sense registre · S'executa al teu navegador

Gratuït Nepali Text a veu

नेपाली

Escriu o enganxa text Nepali i escolta'l parlat - tot al teu navegador, sense registre. El model de veu es descarrega una vegada (~73 MB) i es guarda a la memòria cau local, així que les execucions posteriors són instantànies i funcionen sense connexió.

Com funciona

  1. 1. Escriu el teu text

    Enganxa o escriu qualsevol Nepali text - la puntuació i els salts de línia es respecten.

  2. 2. Genera

    El primer clic descarrega el model de veu d’aproximadament 73 MB al teu navegador. A partir d’aquí, la síntesi és instantània.

  3. 3. Descarrega o reprodueix

    Reprodueix l’àudio en línia o desa’l com a fitxer WAV. L’àudio mai no surt del teu dispositiu.

El teu text es queda al teu dispositiu

La síntesi s'executa completament al navegador mitjançant WebAssembly. Les úniques sol·licituds de xarxa són per obtenir el model de veu i el temps d'execució d'inferència; tots dos són actius públics i estàtics. No veiem el vostre text ni l'àudio generat.

Com s'executa la veu Nepali al navegador

Aquest és un model TTS neuronal real que s'executa a la vostra pròpia màquina, no un client lleuger per a una API allotjada. Quatre elements ho fan possible en una pestanya.

Open-source neural voice
El model Nepali està entrenat amb un sol parlant, per això l'accent i la dicció es mantenen constants en tot el que sintetitzeu.
WebAssembly
Tant el temps d'execució del model com el pas que converteix el text नेपाली en fonemes es compilen a WebAssembly, de manera que el codi originalment escrit per a l'escriptori s'executa a una velocitat gairebé nativa dins de l'entorn aïllat del navegador.
On-device inference
La xarxa neuronal del model s'executa localment, fixada en mode d'un sol fil perquè la pàgina mai necessiti aïllament entre orígens i funcioni en tots els navegadors moderns.
Origin Private File System
El model de veu de ~73 MB es desa a la memòria cau en un emmagatzematge privat per origen després de la primera execució. Les visites posteriors ometen la descàrrega i sintetitzen sense cap xarxa.
Necessites veus de qualitat broadcast?

Subformer Voice Synthesis - de qualitat d'estudi Nepali TTS

L'eina gratuïta en el navegador que hi ha més amunt és ideal per a esborranys i previsualitzacions, però la veu de codi obert sona notablement sintètica. La síntesi de veu de pagament de Subformer produeix àudio natural, de qualitat broadcast, amb clonació de veu opcional.

Prova Subformer Voice Synthesis
Premium - també de Subformer

Preguntes freqüents

Prova altres idiomes TTS gratuïts

Veus alimentades per Piper. Els pesos de veu estan llicenciats amb MIT (rhasspy/piper-voices). El phonemizer wasm es carrega des d’un CDN públic en temps d’execució i no forma part de la distribució d’aquest lloc.