Pudota mikä tahansa ääni- tai videotiedosto, valitse kieli ja saat täydellisen transkription aikaleimoineen - kaikki selaimessasi. Malli ladataan kerran (~75 MB) ja tallennetaan paikallisesti välimuistiin, joten myöhemmät suoritukset ovat välittömiä ja toimivat offline-tilassa.
Tunnistus suoritetaan paikallisesti. Äänesi ei koskaan poistu laitteestasi.
Malli on välimuistissa selaimessasi. Seuraavat käyttökerrat toimivat offline-tilassa.
Ei tiliä, ei krediittejä, ei käyttörajoitusta. Avaa ja käytä.
Puheentunnistus tarkoittaa yleensä äänen lataamista jonkun GPU:lle. Tässä malli toimii sen sijaan omalla koneellasi, mikä tekee työkalusta samanaikaisesti ilmaisen ja yksityisen.
Kompromissi on mallin koko. Laitteella olevat painot ovat murto-osa siitä, mitä isännöity palvelu käyttää, joten tarkkuus heikkenee meluisassa äänessä, voimakkaissa aksenteissa ja päällekkäisissä puhujissa - siinä alla oleva pilvivaihtoehto ansaitsee paikkansa.
Ilmainen selaimessa toimiva työkalu käyttää pientä avoimen lähdekoodin mallia – se sopii puhtaalle äänelle, mutta sillä voi olla vaikeuksia voimakkaiden aksenttien, melun tai päällekkäisten puhujien kanssa, ja se kattaa vain rajoitetun määrän kieliä. Lähetyslaatuisen tarkkuuden, paljon laajemman kielituen ja SRT/VTT/TXT-latausten saamiseksi käytä maksullista pilvipohjaista puheesta tekstiksi -palveluamme.
Kokeile pilvipohjaista puheesta tekstiksi -palvelua