Subformer
Falas · Pa regjistrim · Funksionon në shfletuesin tënd

Zë-në-tekst falas në 35+ gjuhë

Lësho çdo skedar audio ose video, zgjidh një gjuhë dhe merr një transkript të plotë me etiketat e kohës - të gjitha në shfletuesin tuaj. Modeli shkarkohet vetëm një herë (~75 MB) dhe ruhet lokalisht në cache, kështu që ekzekutimet e mëvonshme janë të menjëhershme dhe funksionojnë pa internet.

Privat si parazgjedhje

Njohja ekzekutohet lokalisht. Audioja juaj nuk del kurrë nga pajisja juaj.

Menjëherë pas ngarkimit të parë

Modeli ruhet në cache të shfletuesit tuaj. Përdorimet e mëvonshme funksionojnë pa lidhje.

Falas, pa regjistrim

Pa llogari, pa kredite, pa kufi përdorimi. I hapur dhe i gatshëm për përdorim.

Zgjidhni një gjuhë

Nën kapak

Njohja e të folurit normalisht do të thotë ngarkimi i audios tuaj në GPU-në e dikujt tjetër. Këtu modeli ekzekutohet në makinën tuaj, gjë që e bën mjetin falas dhe privat në të njëjtën kohë.

Open-source recognition model
Një version i kuantizuar i një modeli neural të njohjes së të folurit me burim të hapur, mjaft i vogël për t'u shkarkuar një herë dhe për t'u mbajtur në shfletuesin tuaj.
WebAssembly
Koha e ekzekutimit të inferencës është përpiluar në WebAssembly, kështu që kodi numerik ekzekutohet me shpejtësi pothuajse vendase brenda një skede të izoluar pa shtojcë dhe pa instalim.
On-device inference
Ngarkimi i modelit, tokenizimi dhe ekzekutimi i ciklit të dekodimit ndodhin të gjitha në anën e klientit. Asnjë pjesë e pipeline-it nuk thërret një server pasi faqja të jetë ngarkuar.
Web Audio API
Skedari juaj dekodohet dhe ri-mostrohet në mono 16 kHz që pret modeli duke përdorur tubacionin audio të shfletuesit, kështu që çdo format që shfletuesi juaj mund të luajë pranohet.

Kompromisi është madhësia e modelit. Peshat në pajisje janë një fraksion i asaj që ekzekuton një shërbim i hostuar, kështu që saktësia bie në audio me zhurmë, thekse të forta dhe folës që mbivendosen - aty opsioni i cloud më poshtë fiton vendin e tij.

Keni nevojë për saktësi më të lartë ose më shumë gjuhë?

Zë në Tekst i bazuar në renë kompjuterike

Mjeti falas në shfletues përdor një model të vogël me burim të hapur - i mirë për audio të pastër, por mund të ketë vështirësi me thekse të rënda, zhurmë ose folës që mbivendosen, dhe mbulon vetëm një grup të kufizuar gjuhësh. Për saktësi të nivelit të transmetimit, mbështetje shumë më të gjerë gjuhësore dhe shkarkime SRT/VTT/TXT, përdorni shërbimin tonë Zë në Tekst me pagesë, të bazuar në renë kompjuterike.

Provo Zë në Tekst të bazuar në renë kompjuterike