Subformer
B'xejn · L-ebda reġistrazzjoni · Jaħdem fil-browser tiegħek

Speech-to-Text b'xejn f'35+ lingwi

Poġġi kwalunkwe fajl awdjo jew vidjo, agħżel lingwa, u ġib transkrizzjoni sħiħa b'timestamps - kollox fil-browser tiegħek. Il-mudell jitniżżel darba (~75 MB) u jiġi maħżun lokalment, għalhekk it-tħaddimiet sussegwenti jkunu immedjati u jaħdmu offline.

Privat b'mod predefinit

Ir-rikonoxximent isir lokalment. L-awdjo tiegħek qatt ma jitlaq mit-tagħmir tiegħek.

Immedjat wara l-ewwel tagħbija

Il-mudell huwa maħżun fil-cache tal-browser tiegħek. Il-ġirjiet sussegwenti jaħdmu offline.

B'xejn, mingħajr reġistrazzjoni

L-ebda kont, l-ebda krediti, l-ebda limitu ta' użu. Miftuħ u uża.

Agħżel lingwa

Taħt il-barnuża

Ir-rikonoxximent tad-diskors normalment ifisser li ttella' l-awdjo tiegħek fuq il-GPU ta' xi ħadd. Hawnhekk il-mudell jaħdem fuq il-magna tiegħek stess minflok, li huwa dak li jagħmel l-għodda b'xejn u privata fl-istess ħin.

Open-source recognition model
Bini kkwantizzat ta' mudell newrali ta' rikonoxximent tad-diskors open-source, żgħir biżżejjed biex jitniżżel darba u jinżamm fil-browser tiegħek.
WebAssembly
Ir-runtime tal-inferenza huwa kkompilat għal WebAssembly, u għalhekk il-kodiċi numeriku jaħdem b'veloċità kważi nattiva ġewwa tab sandboxed mingħajr plugin u mingħajr installazzjoni.
On-device inference
It-tagħbija tal-mudell, it-tokenizzazzjoni, u t-tħaddim tal-loop tad-dekodifikazzjoni kollha jseħħu min-naħa tal-klijent. L-ebda parti tal-pipeline ma ssejjaħ lil server ladarba l-paġna tkun tgħabbi.
Web Audio API
Il-fajl tiegħek jiġi dekodifikat u rriċampionat għall-mono ta' 16 kHz li l-mudell jistenna billi juża l-pipeline tal-awdjo tal-browser stess, u għalhekk kwalunkwe format li l-browser tiegħek jista' jdoqq huwa aċċettat.

Il-kompromess huwa d-daqs tal-mudell. Il-piżijiet fuq l-apparat huma frazzjoni ta' dak li jħaddem servizz ospitat, u għalhekk l-eżattezza tonqos fuq awdjo storbjuż, aċċenti qawwija, u kelliema li jikkoinċidu - hemmhekk l-għażla tal-cloud hawn taħt taqla' l-ħobża tagħha.

Għandek bżonn preċiżjoni ogħla jew aktar lingwi?

Speech to Text ibbażat fuq il-cloud

L-għodda b'xejn fil-browser tħaddem mudell żgħir open-source - tajjeb għal awdjo nadif, iżda tista' titħabat ma' aċċenti qawwija, storbju, jew kelliema li jikkoinċidu, u tkopri biss sett limitat ta' lingwi. Għal preċiżjoni ta' grad ta' xandir, appoġġ lingwistiku ferm usa', u downloads SRT/VTT/TXT, uża l-Speech to Text imħallas tagħna bbażat fuq il-cloud.

Ipprova Speech to Text ibbażat fuq il-cloud