Subformer
Ingyenes · Nincs regisztráció · A böngészőben fut

Ingyenes Romanian beszédfelismerés

Română

Húzzon ide egy Romanian hang- vagy videófájlt, és szerezzen teljes átírást időbélyegekkel - mindez a böngészőjében, regisztráció nélkül. A modellt egyszer töltjük le (~75 MB), és helyileg gyorsítótárazódik, így a későbbi futtatások azonnaliak és offline is működnek.

Böngésző támogatás ellenőrzése…

Nagyobb pontosságra vagy több nyelvre van szüksége?

Felhőalapú Romanian beszéd-szöveg átalakítás

Az ingyenes böngészőben futó eszköz egy kis nyílt forráskódú modellt használ – tiszta hanganyag esetén megfelelő, de nehézséget okozhatnak neki az erős Romanian akcentusok, a zaj vagy az egymásra beszélő hangok, és csak korlátozott számú nyelvet támogat. A műsorszórási minőségű pontosság, a sokkal szélesebb nyelvi támogatás, valamint az SRT/VTT/TXT letöltések érdekében használja fizetős felhőalapú beszéd-szöveg átalakító szolgáltatásunkat.

Próbálja ki a felhőalapú beszéd-szöveg átalakítást

Hogyan működik

  1. 1. Húzzon ide egy fájlt

    Dobjon be bármilyen Romanian hang- vagy videófájlt - MP3, WAV, M4A, MP4 és WEBM mind támogatottak.

  2. 2. Átirat készítése

    Az első kattintás letölti a ~75 MB-os modellt a böngészőjébe. Ezután a felismerés azonnali, és offline módban is működik.

  3. 3. Letöltés

    Mentse a leiratot TXT, SRT vagy VTT formátumban. Az audio és az eredmény soha nem hagyja el az eszközét.

A hanganyagod az eszközödön marad

A felismerés teljes egészében a böngészőjében fut WebAssembly segítségével. A hálózati kérések kizárólag a modell és a WebAssembly futtatókörnyezet lekérésére irányulnak - mindkettő nyilvános, statikus erőforrás. Nem látjuk az audiofájlját, és a leiratot sem.

Hogyan fut a(z) Romanian átírás a böngészőjében

A beszédfelismerés általában azt jelenti, hogy feltölti a hanganyagát valaki GPU-jára. Itt a modell ehelyett az Ön saját gépén fut, ami ingyenessé és egyben priváttá teszi ezt.

Open-source recognition model
Egy nyílt forráskódú neurális modell, amelyet többnyelvű hanganyagon képeztek – ezért egy letöltés kezeli a(z) Romanian nyelvet anélkül, hogy nyelvre specifikus modellt kellene letölteni.
WebAssembly
Az inferencia futtatókörnyezet WebAssembly-re van fordítva, így a numerikus kód közel natív sebességgel fut egy homokozóban lévő lapon, bővítmény és telepítés nélkül.
On-device inference
A ~75 MB-os kvantált modell betöltődik, és a dekódolási ciklust teljes egészében kliensoldalon vezérlik. A folyamat egyetlen része sem hív meg szervert, miután az oldal betöltődött.
Web Audio API
Fájlja dekódolásra és 16 kHz-es monóvá mintavételezésre kerül, amit a modell elvár, a böngésző saját hang-pipeline-jának használatával, így bármilyen formátum elfogadott, amit a böngészője le tud játszani.
Prémium - szintén a Subformertől

Gyakran ismételt kérdések

Próbálj ki más ingyenes beszéd-szöveg nyelveket