Subformer
Percuma · Tiada pendaftaran · Berjalan dalam pelayar anda

Percuma Thai Pertuturan ke Teks

ไทย

Jatuhkan fail audio atau video Thai dan dapatkan transkrip penuh dengan cap masa - semuanya dalam pelayar anda, tanpa pendaftaran. Model dimuat turun sekali (~75 MB) dan disimpan dalam cache secara tempatan, jadi penggunaan seterusnya adalah serta-merta dan berfungsi secara luar talian.

Menyemak sokongan pelayar…

Perlukan ketepatan yang lebih tinggi atau lebih banyak bahasa?

Pertuturan ke Teks Thai berasaskan awan

Alat dalam pelayar percuma menjalankan model sumber terbuka kecil - sesuai untuk audio bersih, tetapi ia mungkin menghadapi masalah dengan loghat Thai yang pekat, bunyi bising, atau pembesar suara bertindih, dan hanya meliputi set bahasa yang terhad. Untuk ketepatan gred siaran, sokongan bahasa yang jauh lebih luas, dan muat turun SRT/VTT/TXT, gunakan Pertuturan ke Teks berasaskan awan berbayar kami.

Cuba Pertuturan ke Teks berasaskan awan

Bagaimana ia berfungsi

  1. 1. Lepaskan fail

    Jatuhkan sebarang fail audio atau video Thai - MP3, WAV, M4A, MP4 dan WEBM semuanya disokong.

  2. 2. Transkripsi

    Klik pertama memuat turun model ~75 MB ke pelayar anda. Selepas itu, pengenalan suara adalah serta-merta dan boleh berfungsi secara luar talian.

  3. 3. Muat turun

    Simpan transkrip sebagai TXT, SRT, atau VTT. Audio anda dan hasilnya tidak pernah meninggalkan peranti anda.

Audio anda kekal pada peranti anda

Pengecaman dijalankan sepenuhnya dalam pelayar anda menggunakan WebAssembly. Satu-satunya permintaan rangkaian adalah untuk mengambil model dan runtime WebAssembly - kedua-duanya adalah aset awam, statik. Kami tidak melihat audio anda dan kami tidak melihat transkrip tersebut.

Bagaimana transkripsi Thai berjalan dalam pelayar anda

Pengecaman pertuturan biasanya bermaksud memuat naik audio anda ke GPU seseorang. Di sini model berjalan pada mesin anda sendiri, itulah yang menjadikan ini percuma dan peribadi pada masa yang sama.

Open-source recognition model
Model neural sumber terbuka yang dilatih pada audio berbilang bahasa - itulah sebabnya satu muat turun mengendalikan Thai tanpa model khusus bahasa untuk diambil.
WebAssembly
Masa jalan inferens dikompilasi ke WebAssembly, jadi kod berangka berjalan pada kelajuan hampir asli di dalam tab kotak pasir tanpa pemalam dan tanpa pemasangan.
On-device inference
Model terkuantisasi ~75 MB dimuatkan dan gelung penyahkodan didorong sepenuhnya di sisi klien. Tiada apa-apa dalam saluran paip memanggil pelayan setelah halaman dimuatkan.
Web Audio API
Fail anda dinyahkod dan disampel semula kepada mono 16 kHz yang dijangka oleh model menggunakan saluran paip audio pelayar sendiri, jadi sebarang format yang boleh dimainkan oleh pelayar anda diterima.
Premium - juga dari Subformer

Soalan Lazim

Cuba bahasa percuma pertuturan-ke-teks yang lain