Subformer
Falas · Pa regjistrim · Funksionon në shfletuesin tënd

Falas Russian Zë në tekst

Русский

Lësho një skedar audio ose video Russian dhe merr një transkript të plotë me etiketat e kohës - të gjitha në shfletuesin tuaj, pa regjistrim. Modeli shkarkohet një herë (~75 MB) dhe ruhet lokalisht në cache, kështu që ekzekutimet e mëvonshme janë të menjëhershme dhe funksionojnë pa internet.

Po kontrollohet mbështetja e shfletuesit…

Keni nevojë për saktësi më të lartë ose më shumë gjuhë?

Zë në Tekst Russian i bazuar në renë kompjuterike

Mjeti falas në shfletues përdor një model të vogël me burim të hapur - i mirë për audio të pastër, por mund të ketë vështirësi me thekse të rënda Russian, zhurmë ose folës që mbivendosen, dhe mbulon vetëm një grup të kufizuar gjuhësh. Për saktësi të nivelit të transmetimit, mbështetje shumë më të gjerë gjuhësore dhe shkarkime SRT/VTT/TXT, përdorni shërbimin tonë Zë në Tekst me pagesë, të bazuar në renë kompjuterike.

Provo Zë në Tekst të bazuar në renë kompjuterike

Si funksionon

  1. 1. Lësho një skedar

    Lësho çdo skedar audio ose video Russian - MP3, WAV, M4A, MP4 dhe WEBM mbështeten të gjitha.

  2. 2. Transkribo

    Klikimi i parë shkarkon modelin ~75 MB në shfletuesin tuaj. Pas kësaj, njohja është e menjëhershme dhe e aftë për të punuar pa internet.

  3. 3. Shkarko

    Ruani transkriptin si TXT, SRT, ose VTT. Audioja juaj dhe rezultati nuk dalin kurrë nga pajisja juaj.

Audioni juaj mbetet në pajisjen tuaj

Njohja ekzekutohet tërësisht në shfletuesin tuaj duke përdorur WebAssembly. Kërkesat e vetme në rrjet janë për të marrë modelin dhe runtime-in e WebAssembly - të dyja janë asete publike, statike. Ne nuk shohim audion tuaj dhe nuk shohim transkriptin.

Si funksionon transkriptimi Russian në shfletuesin tuaj

Njohja e të folurit normalisht do të thotë ngarkimi i audios tuaj në GPU-në e dikujt tjetër. Këtu modeli ekzekutohet në makinën tuaj, gjë që e bën këtë falas dhe privat në të njëjtën kohë.

Open-source recognition model
Një model neural me burim të hapur i trajnuar në audio shumëgjuhëshe - prandaj një shkarkim trajton Russian pa pasur nevojë të shkarkohet një model specifik për gjuhën.
WebAssembly
Koha e ekzekutimit të inferencës është përpiluar në WebAssembly, kështu që kodi numerik ekzekutohet me shpejtësi pothuajse vendase brenda një skede të izoluar pa shtojcë dhe pa instalim.
On-device inference
Modeli i kuantizuar ~75 MB ngarkohet dhe cikli i dekodimit drejtohet tërësisht në anën e klientit. Asgjë në pipeline nuk thërret një server pasi faqja të jetë ngarkuar.
Web Audio API
Skedari juaj dekodohet dhe ri-mostrohet në mono 16 kHz që pret modeli duke përdorur tubacionin audio të shfletuesit, kështu që çdo format që shfletuesi juaj mund të luajë pranohet.
Premium - gjithashtu nga Subformer

Pyetjet e shpeshta

Provoni gjuhë të tjera falas për konvertimin zanor në tekst