Subformer
Ilmainen · Ei rekisteröitymistä · Toimii selaimessasi

Ilmainen Italian puheesta tekstiksi

Italiano

Pudota Italian-ääni- tai videotiedosto ja saat täydellisen transkription aikaleimoineen - kaikki selaimessasi, ilman rekisteröitymistä. Malli ladataan kerran (~75 MB) ja tallennetaan paikallisesti välimuistiin, joten myöhemmät suoritukset ovat välittömiä ja toimivat offline-tilassa.

Tarkistetaan selaimen tuki…

Tarvitsetko tarkempaa tai useampia kieliä?

Pilvipohjainen Italian puheesta tekstiksi

Ilmainen selaimessa toimiva työkalu käyttää pientä avoimen lähdekoodin mallia – se sopii puhtaalle äänelle, mutta sillä voi olla vaikeuksia voimakkaiden Italian aksenttien, melun tai päällekkäisten puhujien kanssa, ja se kattaa vain rajoitetun määrän kieliä. Lähetyslaatuisen tarkkuuden, paljon laajemman kielituen ja SRT/VTT/TXT-latausten saamiseksi käytä maksullista pilvipohjaista puheesta tekstiksi -palveluamme.

Kokeile pilvipohjaista puheesta tekstiksi -palvelua

Kuinka se toimii

  1. 1. Pudota tiedosto

    Pudota mikä tahansa Italian-ääni- tai videotiedosto - MP3, WAV, M4A, MP4 ja WEBM ovat tuettuja.

  2. 2. Muunna tekstiksi

    Ensimmäinen klikkaus lataa ~75 MB mallin selaimeesi. Tämän jälkeen tunnistus on välitöntä ja toimii offline-tilassa.

  3. 3. Lataa

    Tallenna transkriptio TXT-, SRT- tai VTT-muodossa. Äänesi ja tulos eivät koskaan poistu laitteestasi.

Äänesi pysyy laitteellasi

Tunnistus suoritetaan kokonaan selaimessasi WebAssemblyn avulla. Ainoat verkopyynnöt ovat mallin ja WebAssembly-ajoympäristön hakemista varten - molemmat ovat julkisia, staattisia resursseja. Emme näe ääntäsi emmekä transkriptiota.

Miten Italian transkriptio toimii selaimessasi

Puheentunnistus tarkoittaa yleensä äänen lataamista jonkun GPU:lle. Tässä malli toimii sen sijaan omalla koneellasi, mikä tekee tästä samanaikaisesti ilmaisen ja yksityisen.

Open-source recognition model
Monikieliseen ääneen koulutettu avoimen lähdekoodin neuroverkkomalli – siksi yksi lataus käsittelee Italian ilman kielikohtaista mallia.
WebAssembly
Päättelyajonaikainen ympäristö on käännetty WebAssemblyksi, joten numeerinen koodi toimii lähes natiivinopeudella hiekkalaatikoidussa välilehdessä ilman laajennuksia ja asennusta.
On-device inference
~75 MB:n kvantisoitu malli ladataan ja dekoodaussykliä ohjataan kokonaan asiakaspuolella. Mikään putkessa ei kutsu palvelinta, kun sivu on latautunut.
Web Audio API
Tiedostosi dekoodataan ja näytteistetään uudelleen mallin odottamaan 16 kHz:n monomuotoon selaimen oman ääniputken avulla, joten kaikki selaimen toistettavissa olevat formaatit hyväksytään.
Premium - myös Subformerilta

Usein kysytyt kysymykset

Kokeile muita ilmaisia puheentunnistuskieliä