Subformer
Gratis · Ingen tilmelding · Kører i din browser

Gratis Thai tale-til-tekst

ไทย

Slip en Thai lyd- eller videofil og få en fuld transskription med tidsstempler - alt i din browser, uden tilmelding. Modellen downloades én gang (~75 MB) og gemmes lokalt i cache, så efterfølgende kørsel er øjeblikkelig og virker offline.

Kontrollerer browserunderstøttelse…

Har du brug for højere nøjagtighed eller flere sprog?

Skybaseret Thai tale til tekst

Det gratis værktøj i browseren kører en lille open source-model – fint til ren lyd, men det kan kæmpe med kraftige Thai accenter, støj eller overlappende talere og dækker kun et begrænset sæt sprog. For nøjagtighed i broadcast-kvalitet, langt bredere sprogunderstøttelse og SRT/VTT/TXT-downloads, brug vores betalte skybaserede tale til tekst.

Prøv skybaseret tale til tekst

Sådan fungerer det

  1. 1. Slip en fil

    Slip enhver Thai lyd- eller videofil ind - MP3, WAV, M4A, MP4 og WEBM understøttes.

  2. 2. Transskriber

    Det første klik downloader modellen på ~75 MB til din browser. Derefter er genkendelsen øjeblikkelig og kan køre offline.

  3. 3. Hent

    Gem transskriptionen som TXT, SRT eller VTT. Din lyd og resultatet forlader aldrig din enhed.

Din lyd forbliver på din enhed

Genkendelsen kører helt i din browser ved hjælp af WebAssembly. De eneste netværksanmodninger er for at hente modellen og WebAssembly-runtime'en - begge er offentlige, statiske ressourcer. Vi ser ikke din lyd, og vi ser ikke transskriptionen.

Sådan kører Thai transskription i din browser

Talegenkendelse betyder normalt at uploade din lyd til en andens GPU. Her kører modellen i stedet på din egen maskine, hvilket gør dette gratis og privat på samme tid.

Open-source recognition model
En open source neural model trænet på flersproget lyd - hvilket er grunden til, at én download håndterer Thai uden en sprogspecifik model at hente.
WebAssembly
Inference-runtime er kompileret til WebAssembly, så den numeriske kode kører med næsten native hastighed inde i en sandboxed fane uden plugin og ingen installation.
On-device inference
Den ~75 MB kvantiserede model indlæses, og afkodningssløjfen drives udelukkende på klientsiden. Ingen del af pipelinen kalder en server, når siden er indlæst.
Web Audio API
Din fil afkodes og resamples til den 16 kHz mono, modellen forventer, ved hjælp af browserens egen lydpipeline, så ethvert format, din browser kan afspille, accepteres.
Premium - også fra Subformer

Ofte stillede spørgsmål

Prøv andre gratis tale-til-tekst-sprog