Subformer
Gratis · Tanpa daftar · Mlaku ing browser sampeyan

Gratis Mandarin Ucapan menyang Teks

中文

Seret file audio utawa video Mandarin lan éntuk transkrip lengkap karo cap wektu - kabèh ing browser sampeyan, tanpa ndaftar. Model diundhuh sepisan (~75 MB) lan disimpen lokal, dadi mlaku sabanjure langsung lan bisa digunakaké offline.

Mriksa dukungan browser…

Butuh akurasi luwih dhuwur utawa luwih akeh basa?

Speech to Text Mandarin adhedhasar awan

Piranti gratis ing browser nglakokake model open-source cilik - apik kanggo audio sing resik, nanging bisa uga angel karo aksen Mandarin sing abot, swara, utawa pamicara sing tumpang tindih, lan mung nyakup sawetara basa sing winates. Kanggo akurasi kelas siaran, dhukungan basa sing luwih jembar, lan unduhan SRT/VTT/TXT, gunakake Speech to Text adhedhasar awan sing mbayar.

Coba Speech to Text adhedhasar awan

Carane kerjane

  1. 1. Seret file

    Lebokaké sembarang audio utawa video Mandarin - MP3, WAV, M4A, MP4, lan WEBM kabèh didhukung.

  2. 2. Transkripsikake

    Klik pisanan bakal ngundhuh model ~75 MB menyang browser sampeyan. Sawisé kuwi, pengenalan langsung lan bisa digunakaké offline.

  3. 3. Unduh

    Simpen transkrip minangka TXT, SRT, utawa VTT. Audio lan asil sampeyan ora bakal tau ninggalake piranti.

Audio sampeyan tetep ana ing piranti sampeyan

Pengenalan mlaku kabeh ing browser sampeyan nggunakake WebAssembly. Siji-sijiné panyuwunan jaringan yaiku kanggo njupuk model lan runtime WebAssembly - loro-loroné minangka aset publik sing statis. Kita ora ndeleng audio sampeyan lan kita ora ndeleng transkrip.

Carane transkripsi Mandarin mlaku ing browser sampeyan

Pangenalan swara biasane tegese ngunggah audio sampeyan menyang GPU wong liya. Ing kene model mlaku ing mesin sampeyan dhewe, sing ndadekake iki gratis lan pribadi ing wektu sing padha.

Open-source recognition model
Model neural open-source sing dilatih ing audio multibasa - mulane siji unduhan nangani Mandarin tanpa model khusus basa sing kudu dijupuk.
WebAssembly
Runtime inferensi dikompilasi menyang WebAssembly, saengga kode numerik mlaku kanthi kacepetan meh asli ing tab sing di-sandbox tanpa plugin lan tanpa instalasi.
On-device inference
Model kuantisasi ~75 MB dimuat lan loop dekoding didorong kabeh ing sisih klien. Ora ana ing pipeline sing nelpon server sawise kaca wis dimuat.
Web Audio API
File sampeyan didekode lan disampel ulang menyang mono 16 kHz sing dikarepake model nggunakake pipa audio browser dhewe, saengga format apa wae sing bisa diputer browser sampeyan ditampa.
Premium - uga saka Subformer

Pitakon sing asring ditakoni

Coba basa speech-to-text gratis liyane