Subformer
Gratis · Ingen registrering · Körs i din webbläsare

Gratis Italian tal-till-text

Italiano

Släpp en Italian-ljud- eller videofil och få en fullständig utskrift med tidsstämplar - allt i din webbläsare, utan registrering. Modellen laddas ner en gång (~75 MB) och cachas lokalt, så efterföljande körningar är omedelbara och fungerar offline.

Kontrollerar webbläsarstöd…

Behöver du högre noggrannhet eller fler språk?

Molnbaserad Italian tal till text

Det kostnadsfria verktyget i webbläsaren kör en liten öppen källkodsmodell – bra för rent ljud, men det kan ha svårt med kraftiga Italian accenter, brus eller överlappande talare, och täcker bara en begränsad uppsättning språk. För noggrannhet i sändningskvalitet, mycket bredare språkstöd och nedladdningar av SRT/VTT/TXT, använd vår betalda molnbaserade tal till text.

Prova molnbaserad tal till text

Så fungerar det

  1. 1. Släpp en fil

    Släpp in valfri Italian-ljud- eller videofil - MP3, WAV, M4A, MP4 och WEBM stöds.

  2. 2. Transkribera

    Första klicket laddar ner modellen (~75 MB) till din webbläsare. Därefter är igenkänningen omedelbar och fungerar offline.

  3. 3. Ladda ner

    Spara transkriptet som TXT, SRT eller VTT. Ditt ljud och resultatet lämnar aldrig din enhet.

Ditt ljud stannar kvar på din enhet

Igenkänningen körs helt i din webbläsare med WebAssembly. De enda nätverksförfrågningarna är för att hämta modellen och WebAssembly-runtime - båda är offentliga, statiska resurser. Vi ser inte ditt ljud och vi ser inte transkriptet.

Hur Italian transkription körs i din webbläsare

Taligenkänning innebär normalt att du laddar upp ditt ljud till någon annans GPU. Här körs modellen istället på din egen maskin, vilket gör detta gratis och privat samtidigt.

Open-source recognition model
En neural modell med öppen källkod tränad på flerspråkigt ljud – vilket är anledningen till att en nedladdning hanterar Italian utan att behöva hämta en språkspecifik modell.
WebAssembly
Inferenskörtiden är kompilerad till WebAssembly, så den numeriska koden körs i nära inbyggd hastighet inuti en sandlådad flik utan plugin och ingen installation.
On-device inference
Den ~75 MB kvantiserade modellen laddas och avkodningsloopen drivs helt på klientsidan. Inget i pipelinen anropar en server när sidan väl har laddats.
Web Audio API
Din fil avkodas och samplas om till den 16 kHz mono som modellen förväntar sig med hjälp av webbläsarens egen ljudpipeline, så alla format din webbläsare kan spela accepteras.
Premium - även från Subformer

Vanliga frågor

Prova andra gratis tal-till-text-språk