Subformer
Zdarma · Žádná registrace · Běží ve vašem prohlížeči

Zdarma Farsi převod řeči na text

فارسی

Přetáhněte Farsi audio nebo video soubor a získejte kompletní přepis s časovými razítky - vše ve vašem prohlížeči, bez registrace. Model se stáhne jednou (~75 MB) a uloží lokálně do mezipaměti, takže další běhy jsou okamžité a fungují offline.

Kontrola podpory prohlížeče…

Potřebujete vyšší přesnost nebo více jazyků?

Cloudové Farsi převádění řeči na text

Bezplatný nástroj v prohlížeči používá malý open-source model – je vhodný pro čistý zvuk, ale může mít potíže se silnými Farsi akcenty, šumem nebo překrývajícími se mluvčími a pokrývá pouze omezenou sadu jazyků. Pro přesnost na úrovni vysílání, mnohem širší jazykovou podporu a stahování SRT/VTT/TXT použijte náš placený cloudový převod řeči na text.

Vyzkoušejte cloudové převádění řeči na text

Jak to funguje

  1. 1. Přetáhněte soubor

    Vložte libovolný Farsi audio nebo video soubor - MP3, WAV, M4A, MP4 a WEBM jsou podporovány.

  2. 2. Přepsat

    První kliknutí stáhne do vašeho prohlížeče model o velikosti ~75 MB. Poté je rozpoznávání okamžité a funguje offline.

  3. 3. Stáhnout

    Uložte přepis jako TXT, SRT nebo VTT. Váš zvuk i výsledek nikdy neopustí zařízení.

Vaše audio zůstává na vašem zařízení

Rozpoznávání probíhá kompletně ve vašem prohlížeči pomocí WebAssembly. Jediné síťové požadavky jsou pro stažení modelu a WebAssembly runtime - oba jsou veřejné, statické zdroje. Nevidíme vaše audio a nevidíme ani přepis.

Jak probíhá transkripce v jazyce Farsi ve vašem prohlížeči

Rozpoznávání řeči obvykle znamená nahrávání vašeho zvuku na GPU někoho jiného. Zde model běží místo toho na vašem vlastním počítači, což činí toto zároveň bezplatným a soukromým.

Open-source recognition model
Open-source neuronový model trénovaný na vícejazyčném zvuku – proto jedno stažení zvládne Farsi bez nutnosti stahovat model specifický pro daný jazyk.
WebAssembly
Runtime pro inferenci je kompilován do WebAssembly, takže numerický kód běží téměř nativní rychlostí uvnitř izolované záložky bez pluginů a instalace.
On-device inference
Je načten kvantizovaný model o velikosti ~75 MB a dekódovací smyčka je řízena zcela na straně klienta. Žádná část pipeline nevolá na server, jakmile se stránka načte.
Web Audio API
Váš soubor je dekódován a převzorkován na 16 kHz mono, které model očekává, pomocí vlastního zvukového pipeline prohlížeče, takže je přijímán jakýkoli formát, který váš prohlížeč dokáže přehrát.
Premium - také od Subformeru

Často kladené otázky

Vyzkoušejte další bezplatné jazyky pro převod řeči na text