Subformer
Brezplačno · Brez prijave · Deluje v vašem brskalniku

Brezplačen govor v besedilo v 35+ jezikih

Spustite poljubno zvočno ali video datoteko, izberite jezik in pridobite celoten prepis s časovnimi žigi - vse v vašem brskalniku. Model se prenese enkrat (~75 MB) in se shrani lokalno v predpomnilnik, zato so naslednji zagoni takojšnji in delujejo brez povezave.

Privzeto zasebno

Prepoznavanje poteka lokalno. Vaš zvok nikoli ne zapusti vaše naprave.

Takoj po prvem nalaganju

Model je shranjen v predpomnilniku vašega brskalnika. Naslednji zagoni delujejo brez povezave.

Brezplačno, brez prijave

Brez računa, brez kreditov, brez omejitve uporabe. Odprite in uporabite.

Izberite jezik

Pod pokrovom

Prepoznavanje govora običajno pomeni nalaganje vašega zvoka na GPU nekoga drugega. Tukaj model deluje na vašem lastnem računalniku, kar omogoča, da je orodje hkrati brezplačno in zasebno.

Open-source recognition model
Kvantizirana različica odprtokodnega nevronskega modela za prepoznavanje govora, dovolj majhna, da jo prenesete enkrat in jo obdržite v brskalniku.
WebAssembly
Izvajalno okolje za sklepanje je prevedeno v WebAssembly, zato se numerična koda izvaja s skoraj izvorno hitrostjo znotraj izoliranega zavihka brez vtičnikov in namestitve.
On-device inference
Nalaganje modela, tokenizacija in izvajanje zanke dekodiranja se vse dogaja na strani odjemalca. Noben del cevovoda ne kliče strežnika, ko se stran naloži.
Web Audio API
Vaša datoteka je dekodirana in ponovno vzorčena na 16 kHz mono, ki ga model pričakuje, z uporabo lastnega avdio cevovoda brskalnika, zato je sprejet kateri koli format, ki ga lahko predvaja vaš brskalnik.

Kompromis je velikost modela. Teže na napravi so delček tistega, kar poganja gostovana storitev, zato natančnost pade pri hrupnem zvoku, močnih naglasih in prekrivajočih se govorcih – tam se spodnja možnost v oblaku izkaže.

Potrebujete večjo natančnost ali več jezikov?

Govor v besedilo v oblaku

Brezplačno orodje v brskalniku poganja majhen odprtokodni model – primerno za čist zvok, vendar se lahko bori s poudarjenimi naglasi, šumom ali prekrivajočimi se govorci in pokriva le omejen nabor jezikov. Za natančnost na ravni oddajanja, veliko širšo jezikovno podporo in prenose SRT/VTT/TXT uporabite naše plačljivo orodje Govor v besedilo v oblaku.

Preizkusite govor v besedilo v oblaku