Subformer
Besplatno · Bez prijave · Radi u vašem pregledniku

Besplatno pretvaranje govora u tekst za English

English

Povucite English audio ili video datoteku i dobite potpuni transkript s vremenskim oznakama - sve u vašem pregledniku, bez prijave. Model se preuzima jednom (~75 MB) i pohranjuje lokalno u predmemoriju, tako da su naredna pokretanja trenutna i rade offline.

Provjerava se podrška preglednika…

Trebate veću točnost ili više jezika?

Govor u tekst temeljen na oblaku za English

Besplatni alat u pregledniku pokreće mali model otvorenog koda – dobar za čist zvuk, ali može imati poteškoća s jakim English naglascima, bukom ili preklapajućim govornicima, i pokriva samo ograničen skup jezika. Za točnost emitiranja, mnogo širu jezičnu podršku i preuzimanja SRT/VTT/TXT, koristite naš plaćeni govor u tekst temeljen na oblaku.

Isprobajte govor u tekst temeljen na oblaku

Kako to radi

  1. 1. Povucite datoteku

    Ubacite bilo koji English audio ili video - podržani su MP3, WAV, M4A, MP4 i WEBM.

  2. 2. Transkribiraj

    Prvim klikom model od ~75 MB se preuzima u vaš preglednik. Nakon toga je prepoznavanje trenutačno i može raditi bez interneta.

  3. 3. Preuzmi

    Spremite transkript kao TXT, SRT ili VTT. Vaš audio i rezultat nikada ne napuštaju vaš uređaj.

Vaš audio ostaje na vašem uređaju

Prepoznavanje se izvršava u potpunosti u vašem pregledniku koristeći WebAssembly. Jedini mrežni zahtjevi su za dohvat modela i WebAssembly runtimea - oba su javni, statični resursi. Ne vidimo vaš audio i ne vidimo transkript.

Kako se English transkripcija izvodi u vašem pregledniku

Prepoznavanje govora obično znači učitavanje vašeg zvuka na tuđi GPU. Ovdje se model izvodi na vašem vlastitom stroju, što ovo čini besplatnim i privatnim u isto vrijeme.

Open-source recognition model
Neuronski model otvorenog koda obučen na višejezičnom zvuku - zbog čega jedno preuzimanje obrađuje English bez potrebe za preuzimanjem modela specifičnog za jezik.
WebAssembly
Izvršno okruženje za zaključivanje kompilirano je u WebAssembly, tako da numerički kod radi gotovo nativnom brzinom unutar izolirane kartice bez dodataka i instalacije.
On-device inference
Učitava se kvantizirani model od ~75 MB, a petlja dekodiranja u potpunosti se pokreće na strani klijenta. Nijedan dio cjevovoda ne poziva poslužitelj nakon što se stranica učita.
Web Audio API
Vaša datoteka se dekodira i ponovno uzorkuje na 16 kHz mono što model očekuje koristeći vlastiti audio cjevovod preglednika, tako da je prihvaćen bilo koji format koji vaš preglednik može reproducirati.
Premium - također od Subformera

Često postavljana pitanja

Isprobajte druge besplatne jezike za pretvaranje govora u tekst