Subformer
Безплатно · Без регистрация · Работи в браузъра ви

Безплатно преобразуване на реч в текст на 35+ езика

Пуснете всякакъв аудио- или видеофайл, изберете език и получете пълен транскрипт с времеви марки - всичко в браузъра ви. Моделът се изтегля само веднъж (~75 MB) и се кешира локално, така че следващите изпълнения са мигновени и работят офлайн.

Частно по подразбиране

Разпознаването се изпълнява локално. Вашето аудио никога не напуска устройството ви.

Моментално след първото зареждане

Моделът се кешира в браузъра ви. Следващите изпълнения работят офлайн.

Безплатно, без регистрация

Няма акаунт, няма кредити, няма ограничение за използване. Отворете и използвайте.

Изберете език

Под капака

Разпознаването на реч обикновено означава качване на вашето аудио на GPU на някого. Тук моделът работи на вашата собствена машина, което прави инструмента безплатен и частен едновременно.

Open-source recognition model
Квантувана версия на невронeн модел за разпознаване на реч с отворен код, достатъчно малък, за да се изтегли веднъж и да остане във вашия браузър.
WebAssembly
Средата за изпълнение на изводи е компилирана до WebAssembly, така че числовият код работи с почти нативна скорост в изолиран раздел без плъгин и без инсталация.
On-device inference
Зареждането на модела, токенизирането и изпълнението на цикъла за декодиране – всичко това се случва от страна на клиента. Нито една част от конвейера не извиква сървър, след като страницата е заредена.
Web Audio API
Вашият файл се декодира и пресемплира до 16 kHz моно, което моделът очаква, използвайки собствения аудио конвейер на браузъра, така че всеки формат, който браузърът ви може да възпроизвежда, се приема.

Компромисът е размерът на модела. Теглата на устройството са малка част от това, което работи хоствана услуга, така че точността намалява при шумно аудио, силни акценти и припокриващи се говорители – това е мястото, където опцията за облак по-долу си заслужава.

Нуждаете се от по-висока точност или повече езици?

Облачно преобразуване на реч в текст

Безплатният инструмент в браузъра използва малък модел с отворен код – подходящ за чисто аудио, но може да има затруднения с тежки акценти, шум или припокриващи се говорители и покрива само ограничен набор от езици. За точност на ниво излъчване, много по-широка езикова поддръжка и изтегляне на SRT/VTT/TXT, използвайте нашето платено облачно преобразуване на реч в текст.

Изпробвайте облачно преобразуване на реч в текст