Subformer
Бесплатно · Без регистрација · Се извршува во вашиот прелистувач

Бесплатно претворање на говор во текст на 35+ јазици

Испуштете која било аудио или видео датотека, изберете јазик и добијте целосен транскрипт со временски ознаки - сето тоа во вашиот прелистувач. Моделот се презема еднаш (~75 MB) и се зачувува локално во кеш, така што следните извршувања се моментални и работат офлајн.

Приватно по подразбирање

Препознавањето се извршува локално. Вашиот аудио никогаш не го напушта уредот.

Моментално по првото вчитување

Моделот е кеширан во вашиот прелистувач. Следните извршувања ќе работат офлајн.

Бесплатно, без регистрација

Без налог, без кредити, без ограничување на употреба. Отворено и готово за користење.

Изберете јазик

Под хаубата

Препознавањето говор обично значи поставување на вашето аудио на туѓа графичка картичка. Овде моделот работи на вашата сопствена машина, што ја прави алатката бесплатна и приватна во исто време.

Open-source recognition model
Квантизирана верзија на отворен изворен невронски модел за препознавање говор, доволно мала за да се преземе еднаш и да се чува во вашиот прелистувач.
WebAssembly
Времето на извршување на заклучувањето е компајлирано во WebAssembly, така што нумеричкиот код работи со речиси природна брзина во изолирана картичка без приклучок и без инсталација.
On-device inference
Вчитувањето на моделот, токенизирањето и извршувањето на циклусот на декодирање се случуваат на страната на клиентот. Ниту еден дел од процесот не повикува сервер откако страницата ќе се вчита.
Web Audio API
Вашата датотека се декодира и повторно се зема примерок до 16 kHz моно што го очекува моделот користејќи ја сопствената аудио цевка на прелистувачот, така што се прифаќа секој формат што вашиот прелистувач може да го репродуцира.

Компромисот е големината на моделот. Тежините на уредот се дел од она што го извршува хостирана услуга, така што точноста опаѓа при бучно аудио, силни акценти и преклопувачки говорници – тука опцијата за облак подолу ја оправдува својата вредност.

Ви треба поголема точност или повеќе јазици?

Говор во текст базиран на облак

Бесплатната алатка во прелистувачот користи мал модел со отворен код – одлична за чисто аудио, но може да има потешкотии со силни акценти, бучава или преклопувачки говорници и покрива само ограничен сет на јазици. За точност од емитувачки квалитет, многу поширока јазична поддршка и преземања на SRT/VTT/TXT, користете го нашиот платен говор во текст базиран на облак.

Пробајте говор во текст базиран на облак