Subformer
Besplatno · Bez registracije · Radi u vašem pregledniku

Besplatno pretvaranje govora u tekst za Catalan

Català

Spustite Catalan audio ili video datoteku i dobijte potpuni transkript s vremenskim oznakama - sve u vašem pregledniku, bez registracije. Model se preuzima jednom (~75 MB) i kešira lokalno, tako da su naredna pokretanja trenutna i rade offline.

Provjerava se podrška preglednika…

Trebate veću preciznost ili više jezika?

Govor u tekst baziran na oblaku za Catalan

Besplatni alat u pregledniku pokreće mali model otvorenog koda - dobar za čist zvuk, ali može imati poteškoća s jakim Catalan akcentima, bukom ili preklapajućim govornicima, i pokriva samo ograničen skup jezika. Za preciznost emitiranja, mnogo širu jezičnu podršku i preuzimanja SRT/VTT/TXT, koristite naš plaćeni govor u tekst baziran na oblaku.

Isprobajte govor u tekst baziran na oblaku

Kako to funkcioniše

  1. 1. Spustite datoteku

    Spustite bilo koji Catalan audio ili video - MP3, WAV, M4A, MP4 i WEBM su podržani.

  2. 2. Transkribuj

    Prvi klik preuzme model (~75 MB) u vaš preglednik. Nakon toga, prepoznavanje je trenutno i radi offline.

  3. 3. Preuzmi

    Sačuvajte transkript kao TXT, SRT ili VTT. Vaš audio i rezultat nikada ne napuštaju uređaj.

Vaš audio ostaje na vašem uređaju

Prepoznavanje se izvršava potpuno u vašem pregledniku koristeći WebAssembly. Jedini mrežni zahtjevi su za preuzimanje modela i WebAssembly runtime-a - oboje su javni, statični resursi. Ne vidimo vaš audio i ne vidimo transkript.

Kako Catalan transkripcija radi u vašem pregledniku

Prepoznavanje govora obično znači učitavanje vašeg zvuka na tuđi GPU. Ovdje model radi na vašem vlastitom stroju, što ovo čini besplatnim i privatnim u isto vrijeme.

Open-source recognition model
Neuralni model otvorenog koda obučen na višejezičnom zvuku - zbog čega jedno preuzimanje obrađuje Catalan bez potrebe za preuzimanjem modela specifičnog za jezik.
WebAssembly
Izvršno okruženje za inferenciju je kompajlirano u WebAssembly, tako da numerički kod radi skoro nativnom brzinom unutar izolirane kartice bez dodataka i instalacije.
On-device inference
Učitava se kvantizirani model od ~75 MB i petlja dekodiranja se u potpunosti pokreće na strani klijenta. Nijedan dio cjevovoda ne poziva server nakon što se stranica učita.
Web Audio API
Vaša datoteka se dekodira i ponovo uzorkuje na 16 kHz mono što model očekuje koristeći vlastiti audio cjevovod preglednika, tako da je prihvaćen bilo koji format koji vaš preglednik može reproducirati.
Premium - također od Subformera

Najčešća pitanja

Isprobajte druge besplatne jezike za pretvaranje govora u tekst