Subformer
Besplatno · Bez prijave · Radi u vašem pregledniku

Besplatno pretvaranje govora u tekst na 35+ jezika

Povucite bilo koju audio ili video datoteku, odaberite jezik i dobijte potpuni transkript s vremenskim oznakama - sve u vašem pregledniku. Model se preuzima jednom (~75 MB) i pohranjuje lokalno u predmemoriju, pa su sljedeća pokretanja trenutačna i rade offline.

Privatno prema zadanim postavkama

Prepoznavanje se izvodi lokalno. Vaš audio nikada ne napušta vaš uređaj.

Trenutačno nakon prvog učitavanja

Model je keširan u vašem pregledniku. Sljedeća izvođenja rade izvanmrežno.

Besplatno, bez prijave

Bez računa, bez kredita, bez ograničenja korištenja. Otvoreno za korištenje.

Odaberite jezik

Ispod haube

Prepoznavanje govora obično znači učitavanje vašeg zvuka na tuđi GPU. Ovdje se model izvodi na vašem vlastitom stroju, što alat čini besplatnim i privatnim u isto vrijeme.

Open-source recognition model
Kvantizirana verzija otvorenog koda neuronskog modela za prepoznavanje govora, dovoljno mala da se preuzme jednom i zadrži u vašem pregledniku.
WebAssembly
Izvršno okruženje za zaključivanje kompilirano je u WebAssembly, tako da numerički kod radi gotovo nativnom brzinom unutar izolirane kartice bez dodataka i instalacije.
On-device inference
Učitavanje modela, tokenizacija i pokretanje petlje dekodiranja - sve se događa na strani klijenta. Nijedan dio cjevovoda ne poziva poslužitelj nakon što se stranica učita.
Web Audio API
Vaša datoteka se dekodira i ponovno uzorkuje na 16 kHz mono što model očekuje koristeći vlastiti audio cjevovod preglednika, tako da je prihvaćen bilo koji format koji vaš preglednik može reproducirati.

Kompromis je veličina modela. Težine na uređaju su djelić onoga što pokreće hostirana usluga, pa točnost opada kod bučnog zvuka, jakih naglasaka i preklapajućih govornika – tu opcija oblaka ispod dolazi do izražaja.

Trebate veću točnost ili više jezika?

Govor u tekst temeljen na oblaku

Besplatni alat u pregledniku pokreće mali model otvorenog koda – dobar za čist zvuk, ali može imati poteškoća s jakim naglascima, bukom ili preklapajućim govornicima, i pokriva samo ograničen skup jezika. Za točnost emitiranja, mnogo širu jezičnu podršku i preuzimanja SRT/VTT/TXT, koristite naš plaćeni govor u tekst temeljen na oblaku.

Isprobajte govor u tekst temeljen na oblaku