Subformer
Безплатно · Без регистрация · Работи в браузъра ви

Безплатно преобразуване на реч в текст за Thai

ไทย

Пуснете Thai аудио- или видеофайл и получете пълен транскрипт с времеви марки - всичко в браузъра ви, без регистрация. Моделът се изтегля само веднъж (~75 MB) и се кешира локално, така че следващите изпълнения са мигновени и работят офлайн.

Проверка за поддръжка в браузъра…

Нуждаете се от по-висока точност или повече езици?

Облачно Thai преобразуване на реч в текст

Безплатният инструмент в браузъра използва малък модел с отворен код – подходящ за чисто аудио, но може да има затруднения с тежки Thai акценти, шум или припокриващи се говорители и покрива само ограничен набор от езици. За точност на ниво излъчване, много по-широка езикова поддръжка и изтегляне на SRT/VTT/TXT, използвайте нашето платено облачно преобразуване на реч в текст.

Изпробвайте облачно преобразуване на реч в текст

Как работи

  1. 1. Пуснете файл

    Пуснете всеки Thai аудио- или видеофайл - MP3, WAV, M4A, MP4 и WEBM се поддържат.

  2. 2. Транскрибирай

    Първото щракване изтегля модела (~75 MB) във вашия браузър. След това разпознаването е мигновено и работи офлайн.

  3. 3. Изтегли

    Запазете транскрипцията като TXT, SRT, или VTT. Вашето аудио и резултатът никога не напускат устройството ви.

Аудиото ви остава на устройството ви

Разпознаването се изпълнява изцяло в браузъра ви с помощта на WebAssembly. Единствените мрежови заявки са за изтегляне на модела и WebAssembly runtime - и двете са публични, статични ресурси. Ние не виждаме вашето аудио и не виждаме транскрипцията.

Как Thai транскрипцията работи във вашия браузър

Разпознаването на реч обикновено означава качване на вашето аудио на GPU на някого. Тук моделът работи на вашата собствена машина, което прави това безплатно и частно едновременно.

Open-source recognition model
Невронeн модел с отворен код, обучен на многоезично аудио – ето защо едно изтегляне обработва Thai без необходимост от изтегляне на езиково-специфичен модел.
WebAssembly
Средата за изпълнение на изводи е компилирана до WebAssembly, така че числовият код работи с почти нативна скорост в изолиран раздел без плъгин и без инсталация.
On-device inference
Квантуваният модел от ~75 MB се зарежда и цикълът за декодиране се управлява изцяло от страна на клиента. Нито една част от конвейера не извиква сървър, след като страницата е заредена.
Web Audio API
Вашият файл се декодира и пресемплира до 16 kHz моно, което моделът очаква, използвайки собствения аудио конвейер на браузъра, така че всеки формат, който браузърът ви може да възпроизвежда, се приема.
Премиум - също от Subformer

Често задавани въпроси

Опитайте други безплатни езици за преобразуване на реч в текст