Subformer
Бясплатна · Без рэгістрацыі · Працуе ў вашым браўзеры

Бясплатнае распазнаванне прамовы на 35+ мовах

Перацягніце любы аўдыё- або відэафайл, выберыце мову і атрымайце поўную транскрыпцыю з пазнакамі часу - ўсё ў вашым браўзэры. Мадэль загружаецца аднойчы (~75 MB) і захоўваецца лакальна ў кэшы, таму наступныя запускі імгненныя і працуюць у аўтаномным рэжыме.

Прыватна па змаўчанні

Распазнаванне працуе лакальна. Ваша аўдыё ніколі не пакідае вашу прыладу.

Імгненна пасля першай загрузкі

Мадэль кэшуецца ў вашым браўзэры. Наступныя запуски працуюць у аўтаномным рэжыме.

Бясплатна, без рэгістрацыі

Без уліковага запісу, без крэдытаў, без абмежаванняў на выкарыстанне. Адкрыта для выкарыстання.

Выберыце мову

Пад капотам

Распазнаванне маўлення звычайна азначае загрузку вашага аўдыя на чыйсьці графічны працэсар. Тут мадэль працуе на вашай уласнай машыне, што робіць інструмент бясплатным і прыватным адначасова.

Open-source recognition model
Квантаваная зборка нейроннай мадэлі распазнавання маўлення з адкрытым зыходным кодам, досыць малая, каб спампаваць адзін раз і захоўваць у вашым браўзеры.
WebAssembly
Асяроддзе выканання вываду скампілявана ў WebAssembly, таму лікавы код працуе з хуткасцю, блізкай да натыўнай, унутры ізаляванай укладкі без плагінаў і ўстаноўкі.
On-device inference
Загрузка мадэлі, такенізацыя і запуск цыкла дэкадавання — усё гэта адбываецца на баку кліента. Ніводная частка канвеера не звяртаецца да сервера пасля загрузкі старонкі.
Web Audio API
Ваш файл дэкадуецца і перадыскрэтызуецца ў мона 16 кГц, якое чакае мадэль, выкарыстоўваючы ўласны аўдыяканвеер браўзера, таму прымаецца любы фармат, які ваш браўзер можа прайграваць.

Кампраміс — гэта памер мадэлі. Вагі на прыладзе складаюць долю таго, што выкарыстоўвае хостынгавы сэрвіс, таму дакладнасць зніжаецца на шумным аўдыя, моцных акцэнтах і перакрываючыхся дынаміках — вось дзе воблачная опцыя ніжэй апраўдвае сябе.

Патрэбна большая дакладнасць або больш моў?

Воблачнае пераўтварэнне маўлення ў тэкст

Бясплатны інструмент у браўзеры выкарыстоўвае невялікую мадэль з адкрытым зыходным кодам — добра для чыстага аўдыя, але ён можа мець праблемы з моцнымі акцэнтамі, шумам або перакрываючыміся галасамі, і падтрымлівае толькі абмежаваны набор моў. Для дакладнасці вяшчальнага ўзроўню, значна шырэйшай моўнай падтрымкі і загрузкі SRT/VTT/TXT выкарыстоўвайце наш платны воблачны сэрвіс пераўтварэння маўлення ў тэкст.

Паспрабуйце воблачнае пераўтварэнне маўлення ў тэкст