Subformer
Besplatno · Bez prijave · Radi u pregledaču

Besplatno pretvaranje govora u tekst na 35+ jezika

Prevucite bilo koji audio ili video fajl, izaberite jezik i dobijte kompletan transkript sa vremenskim oznakama - sve u vašem pregledaču. Model se preuzima jednom (~75 MB) i kešira lokalno, pa su naredna pokretanja instantna i rade offline.

Privatno po podrazumevanju

Препознавање се покреће локално. Ваш аудио никада не напушта ваш уређај.

Odmah nakon prvog učitavanja

Модел је кеширан у вашем прегледачу. Накнадна покретања раде ван мреже.

Besplatno, bez registracije

Nema naloga, nema kredita, nema ograničenja upotrebe. Otvoreno za korišćenje.

Izaberite jezik

Ispod haube

Prepoznavanje govora obično znači otpremanje vašeg zvuka na tuđi GPU. Ovde model radi na vašoj mašini, što alat čini besplatnim i privatnim u isto vreme.

Open-source recognition model
Kvantizovana verzija otvorenog koda neuronskog modela za prepoznavanje govora, dovoljno mala da se preuzme jednom i zadrži u vašem pregledaču.
WebAssembly
Vreme izvršavanja inferencije je kompajlirano u WebAssembly, tako da numerički kod radi skoro nativnom brzinom unutar izolovanog taba bez dodataka i instalacije.
On-device inference
Učitavanje modela, tokenizacija i pokretanje petlje dekodiranja – sve se dešava na strani klijenta. Nijedan deo pipeline-a ne poziva server nakon što se stranica učita.
Web Audio API
Vaša datoteka se dekodira i ponovo uzorkuje na 16 kHz mono što model očekuje koristeći sopstveni audio cevovod pretraživača, tako da je prihvaćen bilo koji format koji vaš pretraživač može da reprodukuje.

Kompromis je veličina modela. Težine na uređaju su delić onoga što pokreće hostovana usluga, tako da preciznost opada kod bučnog zvuka, jakih akcenata i preklapajućih govornika – tu opcija u oblaku ispod dolazi do izražaja.

Potrebna vam je veća preciznost ili više jezika?

Prepoznavanje govora u tekstu zasnovano na oblaku

Besplatni alat u pregledaču koristi mali model otvorenog koda – dobar je za čist zvuk, ali može imati problema sa jakim akcentima, bukom ili preklapajućim govornicima, i pokriva samo ograničen skup jezika. Za preciznost emitovanja, mnogo širu podršku za jezike i preuzimanja SRT/VTT/TXT, koristite našu plaćenu uslugu Prepoznavanja govora u tekstu zasnovanu na oblaku.

Isprobajte prepoznavanje govora u tekstu zasnovano na oblaku