Subformer
Libre · Walang signup · Tumatakbo sa iyong browser

Libreng Pagsasalita-sa-Teksto sa 35+ na mga wika

I-drop ang anumang audio o video file, pumili ng wika, at makakuha ng buong transcript na may timestamps - lahat sa iyong browser. Ang modelo ay dine-download nang isang beses (~75 MB) at naka-cache nang lokal, kaya ang mga susunod na pagpapatakbo ay instant at gumagana offline.

Pribado bilang default

Ang pagkilala ay tumatakbo nang lokal. Hindi umaalis ang iyong audio mula sa iyong aparato.

Agad pagkatapos ng unang paglo-load

Naka-cache ang modelo sa iyong browser. Gumagana nang offline ang mga susunod na pagtakbo.

Libre, walang signup

Walang account, walang credits, walang limitasyon sa paggamit. Buksan at gamitin.

Pumili ng wika

Sa ilalim ng hood

Ang speech recognition ay karaniwang nangangahulugang pag-upload ng iyong audio sa GPU ng ibang tao. Dito, ang model ay tumatakbo sa iyong sariling makina, na siyang dahilan kung bakit libre at pribado ang tool nang sabay.

Open-source recognition model
Isang quantized build ng isang open-source neural speech recognition model, sapat ang liit para i-download nang isang beses at panatilihin sa iyong browser.
WebAssembly
Ang inference runtime ay naka-compile sa WebAssembly, kaya ang numerical code ay tumatakbo sa halos native na bilis sa loob ng isang sandboxed tab nang walang plugin at walang install.
On-device inference
Ang pag-load ng model, tokenizing, at pagpapatakbo ng decoding loop ay nangyayari lahat sa client-side. Walang bahagi ng pipeline ang tumatawag sa isang server kapag na-load na ang pahina.
Web Audio API
Ang iyong file ay dini-decode at ni-resample sa 16 kHz mono na inaasahan ng modelo gamit ang sariling audio pipeline ng browser, kaya anumang format na kayang i-play ng iyong browser ay tinatanggap.

Ang kapalit ay ang laki ng modelo. Ang mga on-device na weights ay isang bahagi lamang ng pinapatakbo ng isang hosted service, kaya bumababa ang accuracy sa maingay na audio, malakas na accent, at magkakapatong na nagsasalita - doon kumikita ang cloud option sa ibaba.

Kailangan ng mas mataas na katumpakan o mas maraming wika?

Cloud-based Speech to Text

Ang libreng in-browser tool ay gumagamit ng maliit na open-source model - mainam para sa malinis na audio, ngunit maaari itong mahirapan sa malakas na accent, ingay, o magkakapatong na nagsasalita, at sumasaklaw lamang sa limitadong hanay ng mga wika. Para sa broadcast-grade na katumpakan, mas malawak na suporta sa wika, at mga pag-download ng SRT/VTT/TXT, gamitin ang aming bayad na cloud-based Speech to Text.

Subukan ang cloud-based Speech to Text