I-drop ang anumang audio o video file, pumili ng wika, at makakuha ng buong transcript na may timestamps - lahat sa iyong browser. Ang modelo ay dine-download nang isang beses (~75 MB) at naka-cache nang lokal, kaya ang mga susunod na pagpapatakbo ay instant at gumagana offline.
Ang pagkilala ay tumatakbo nang lokal. Hindi umaalis ang iyong audio mula sa iyong aparato.
Naka-cache ang modelo sa iyong browser. Gumagana nang offline ang mga susunod na pagtakbo.
Walang account, walang credits, walang limitasyon sa paggamit. Buksan at gamitin.
Ang speech recognition ay karaniwang nangangahulugang pag-upload ng iyong audio sa GPU ng ibang tao. Dito, ang model ay tumatakbo sa iyong sariling makina, na siyang dahilan kung bakit libre at pribado ang tool nang sabay.
Ang kapalit ay ang laki ng modelo. Ang mga on-device na weights ay isang bahagi lamang ng pinapatakbo ng isang hosted service, kaya bumababa ang accuracy sa maingay na audio, malakas na accent, at magkakapatong na nagsasalita - doon kumikita ang cloud option sa ibaba.
Ang libreng in-browser tool ay gumagamit ng maliit na open-source model - mainam para sa malinis na audio, ngunit maaari itong mahirapan sa malakas na accent, ingay, o magkakapatong na nagsasalita, at sumasaklaw lamang sa limitadong hanay ng mga wika. Para sa broadcast-grade na katumpakan, mas malawak na suporta sa wika, at mga pag-download ng SRT/VTT/TXT, gamitin ang aming bayad na cloud-based Speech to Text.
Subukan ang cloud-based Speech to Text