Subformer
Besplatno · Bez prijave · Radi u pregledaču

Besplatno Mandarin pretvaranje govora u tekst

中文

Prevucite Mandarin audio ili video fajl i dobijte kompletan transkript sa vremenskim oznakama - sve u vašem pregledaču, bez registracije. Model se preuzima jednom (~75 MB) i kešira lokalno, pa su naredna pokretanja instantna i rade offline.

Proverava se podrška pregledača…

Potrebna vam je veća preciznost ili više jezika?

Mandarin Prepoznavanje govora u tekstu zasnovano na oblaku

Besplatni alat u pregledaču koristi mali model otvorenog koda – dobar je za čist zvuk, ali može imati problema sa jakim Mandarin akcentima, bukom ili preklapajućim govornicima, i pokriva samo ograničen skup jezika. Za preciznost emitovanja, mnogo širu podršku za jezike i preuzimanja SRT/VTT/TXT, koristite našu plaćenu uslugu Prepoznavanja govora u tekstu zasnovanu na oblaku.

Isprobajte prepoznavanje govora u tekstu zasnovano na oblaku

Kako to funkcioniše

  1. 1. Prevucite fajl

    Ubacite bilo koji Mandarin audio ili video - MP3, WAV, M4A, MP4 i WEBM su podržani.

  2. 2. Transkribuj

    Prvim klikom se preuzima model od oko ~75 MB u vaš pregledač. Nakon toga, prepoznavanje je trenutačno i može da radi offline.

  3. 3. Preuzmi

    Сачувајте транскрипт као TXT, SRT или VTT. Ваш аудио и резултат никада не напуштају ваш уређај.

Ваш аудио остаје на вашем уређају

Препознавање се у потпуности одвија у вашем прегледачу користећи WebAssembly. Једини мрежни захтеви су за преузимање модела и WebAssembly runtime-а - оба су јавни, статички ресурси. Ми не видимо ваш аудио и не видимо транскрипт.

Kako Mandarin transkripcija radi u vašem pregledaču

Prepoznavanje govora obično znači otpremanje vašeg zvuka na tuđi GPU. Ovde model radi na vašoj mašini, što ovo čini besplatnim i privatnim u isto vreme.

Open-source recognition model
Neuronska mreža otvorenog koda obučena na višejezičnom zvuku – zbog čega jedno preuzimanje obrađuje Mandarin bez potrebe za preuzimanjem modela specifičnog za jezik.
WebAssembly
Vreme izvršavanja inferencije je kompajlirano u WebAssembly, tako da numerički kod radi skoro nativnom brzinom unutar izolovanog taba bez dodataka i instalacije.
On-device inference
~75 MB kvantizovani model se učitava i petlja dekodiranja se u potpunosti pokreće na strani klijenta. Nijedan deo pipeline-a ne poziva server nakon što se stranica učita.
Web Audio API
Vaša datoteka se dekodira i ponovo uzorkuje na 16 kHz mono što model očekuje koristeći sopstveni audio cevovod pretraživača, tako da je prihvaćen bilo koji format koji vaš pretraživač može da reprodukuje.
Премиум - такође од Subformer-а

Često postavljana pitanja

Пробајте друге бесплатне језике за претварање говора у текст