Subformer
Бясплатна · Без рэгістрацыі · Працуе ў вашым браўзеры

Бясплатнае Russian распазнаванне прамовы ў тэкст

Русский

Перацягніце Russian аўдыё- або відэафайл і атрымайце поўную транскрыпцыю з пазнакамі часу - усё ў вашым браўзэры, без рэгістрацыі. Мадэль загружаецца аднойчы (~75 MB) і захоўваецца лакальна ў кэшы, таму наступныя запускі імгненныя і працуюць у аўтаномным рэжыме.

Праверка падтрымкі браўзэра…

Патрэбна большая дакладнасць або больш моў?

Воблачнае пераўтварэнне Russian маўлення ў тэкст

Бясплатны інструмент у браўзеры выкарыстоўвае невялікую мадэль з адкрытым зыходным кодам — добра для чыстага аўдыя, але ён можа мець праблемы з моцнымі Russian акцэнтамі, шумам або перакрываючыміся галасамі, і падтрымлівае толькі абмежаваны набор моў. Для дакладнасці вяшчальнага ўзроўню, значна шырэйшай моўнай падтрымкі і загрузкі SRT/VTT/TXT выкарыстоўвайце наш платны воблачны сэрвіс пераўтварэння маўлення ў тэкст.

Паспрабуйце воблачнае пераўтварэнне маўлення ў тэкст

Як гэта працуе

  1. 1. Перацягніце файл

    Перацягніце любы Russian аўдыё- або відэафайл - MP3, WAV, M4A, MP4 і WEBM - усе падтрымліваюцца.

  2. 2. Транскрыбаваць

    Першым клікам у ваш браўзэр загружаецца мадэль (~75 MB). Пасля гэтага распазнаванне імгненнае і працуе ў аўтаномным рэжыме.

  3. 3. Спампаваць

    Захавайце транскрыпт як TXT, SRT або VTT. Ваша аўдыё і вынік ніколі не пакідаюць вашу прыладу.

Ваш аўдыё застаецца на вашай прыладзе

Распазнаванне цалкам выконваецца ў вашым браўзеры з выкарыстаннем WebAssembly. Адзіныя сеткавыя запыты робяцца для загрузкі мадэлі і WebAssembly runtime - абодва з'яўляюцца публічнымі, статычнымі рэсурсамі. Мы не бачым вашага аўдыё і не бачым транскрыпта.

Як транскрыпцыя Russian працуе ў вашым браўзеры

Распазнаванне маўлення звычайна азначае загрузку вашага аўдыя на чыйсьці графічны працэсар. Тут мадэль працуе на вашай уласнай машыне, што робіць гэта бясплатным і прыватным адначасова.

Open-source recognition model
Нейронная мадэль з адкрытым зыходным кодам, навучаная на шматмоўным аўдыя — таму адна загрузка апрацоўвае Russian без неабходнасці спампоўваць мадэль для канкрэтнай мовы.
WebAssembly
Асяроддзе выканання вываду скампілявана ў WebAssembly, таму лікавы код працуе з хуткасцю, блізкай да натыўнай, унутры ізаляванай укладкі без плагінаў і ўстаноўкі.
On-device inference
Квантаваная мадэль памерам ~75 МБ загружаецца, і цыкл дэкадавання цалкам кіруецца на баку кліента. Нічога ў канвееры не звяртаецца да сервера пасля загрузкі старонкі.
Web Audio API
Ваш файл дэкадуецца і перадыскрэтызуецца ў мона 16 кГц, якое чакае мадэль, выкарыстоўваючы ўласны аўдыяканвеер браўзера, таму прымаецца любы фармат, які ваш браўзер можа прайграваць.
Преміум - таксама ад Subformer

Часта задаваныя пытанні

Паспрабуйце іншыя бясплатныя мовы для распазнавання прамовы ў тэкст