Subformer
Безкоштовно · Без реєстрації · Працює у вашому браузері

Безкоштовне перетворення мовлення в текст на 35+ мовах

Перетягніть будь-який аудіо- або відеофайл, оберіть мову й отримаєте повну транскрипцію з часовими позначками - все у вашому браузері. Модель завантажується один раз (~75 MB) і зберігається в локальному кеші, тому наступні запуски миттєві й працюють офлайн.

За замовчуванням приватно

Розпізнавання працює локально. Ваше аудіо ніколи не покидає ваш пристрій.

Миттєво після першого завантаження

Модель кешується у вашому браузері. Наступні запуски працюють офлайн.

Безкоштовно, без реєстрації

Без акаунта, без кредитів, без ліміту використання. Відкрийте й використовуйте.

Виберіть мову

Під капотом

Розпізнавання мовлення зазвичай означає завантаження вашого аудіо на чийсь графічний процесор. Тут модель працює на вашій власній машині, що робить інструмент безкоштовним і приватним одночасно.

Open-source recognition model
Квантована збірка відкритої нейронної моделі розпізнавання мовлення, достатньо мала, щоб завантажити її один раз і зберігати у вашому браузері.
WebAssembly
Середовище виконання висновків скомпільовано в WebAssembly, тому числовий код працює майже з нативною швидкістю всередині ізольованої вкладки без плагінів та встановлення.
On-device inference
Завантаження моделі, токенізація та запуск циклу декодування – все це відбувається на стороні клієнта. Жодна частина конвеєра не звертається до сервера після завантаження сторінки.
Web Audio API
Ваш файл декодується та передискретизується до 16 кГц моно, що очікує модель, використовуючи власний аудіоконвеєр браузера, тому приймається будь-який формат, який може відтворити ваш браузер.

Компроміс — розмір моделі. Ваги на пристрої становлять лише частину того, що використовує хостинговий сервіс, тому точність знижується на шумному аудіо, сильних акцентах та перекритті мовців — саме тут хмарний варіант нижче виправдовує себе.

Потрібна вища точність або більше мов?

Хмарне перетворення мовлення в текст

Безкоштовний інструмент у браузері використовує невелику модель з відкритим вихідним кодом – це добре для чистого аудіо, але він може мати проблеми з сильними акцентами, шумом або перекриттям мовців, і охоплює лише обмежений набір мов. Для точності мовлення на рівні трансляції, значно ширшої мовної підтримки та завантажень SRT/VTT/TXT використовуйте наш платний хмарний сервіс перетворення мовлення в текст.

Спробуйте хмарне перетворення мовлення в текст