Subformer
Gratuit · Fără înscriere · Rulează în browserul tău

Gratuit Hebrew Transcriere vocală

עברית

Plasează un Hebrew fișier audio sau video și obține o transcriere completă cu marcaje de timp - totul în browserul tău, fără înregistrare. Modelul se descarcă o singură dată (~75 MB) și este stocat în cache local, astfel încât rulările ulterioare sunt instantanee și funcționează offline.

Se verifică compatibilitatea browserului…

Aveți nevoie de o precizie mai mare sau de mai multe limbi?

Speech to Text Hebrew bazat pe cloud

Instrumentul gratuit din browser rulează un model open-source mic - bun pentru audio curat, dar se poate confrunta cu accente Hebrew puternice, zgomot sau vorbitori suprapuși și acoperă doar un set limitat de limbi. Pentru o precizie de nivel profesional, un suport lingvistic mult mai larg și descărcări SRT/VTT/TXT, utilizați serviciul nostru plătit Speech to Text bazat pe cloud.

Încercați Speech to Text bazat pe cloud

Cum funcționează

  1. 1. Trage un fișier

    Plasează orice Hebrew fișier audio sau video - MP3, WAV, M4A, MP4 și WEBM sunt toate acceptate.

  2. 2. Transcrie

    Primul clic descarcă modelul de ~75 MB în browserul tău. După aceea, recunoașterea este instantanee și funcționează offline.

  3. 3. Descarcă

    Salvează transcrierea ca TXT, SRT sau VTT. Fișierul tău audio și rezultatul nu părăsesc niciodată dispozitivul.

Audio-ul tău rămâne pe dispozitivul tău

Recunoașterea rulează în întregime în browserul tău folosind WebAssembly. Singurele cereri de rețea sunt pentru preluarea modelului și a runtime-ului WebAssembly - ambele sunt resurse publice, statice. Nu vedem fișierul tău audio și nici transcrierea.

Cum rulează transcrierea Hebrew în browserul tău

Recunoașterea vocală înseamnă, în mod normal, încărcarea audio-ului tău pe GPU-ul cuiva. Aici modelul rulează pe propria ta mașină, ceea ce face acest lucru gratuit și privat în același timp.

Open-source recognition model
Un model neural open-source antrenat pe audio multilingv - motiv pentru care o singură descărcare gestionează Hebrew fără a fi nevoie să se descarce un model specific limbii.
WebAssembly
Runtime-ul de inferență este compilat în WebAssembly, astfel încât codul numeric rulează la o viteză aproape nativă într-o filă sandbox, fără plugin și fără instalare.
On-device inference
Modelul cuantificat de ~75 MB este încărcat, iar bucla de decodare este gestionată în întregime pe partea clientului. Nimic din pipeline nu apelează un server odată ce pagina a fost încărcată.
Web Audio API
Fișierul dvs. este decodificat și reeșantionat la mono de 16 kHz pe care modelul îl așteaptă, folosind propriul pipeline audio al browserului, astfel încât orice format pe care browserul dvs. îl poate reda este acceptat.
Premium - tot de la Subformer

Întrebări frecvente

Încearcă alte limbi gratuite pentru speech-to-text