Subformer
Ilmainen · Ei rekisteröitymistä · Toimii selaimessasi

Ilmainen puhe tekstiksi yli 35 kielellä

Pudota mikä tahansa ääni- tai videotiedosto, valitse kieli ja saat täydellisen transkription aikaleimoineen - kaikki selaimessasi. Malli ladataan kerran (~75 MB) ja tallennetaan paikallisesti välimuistiin, joten myöhemmät suoritukset ovat välittömiä ja toimivat offline-tilassa.

Oletuksena yksityinen

Tunnistus suoritetaan paikallisesti. Äänesi ei koskaan poistu laitteestasi.

Välitön ensimmäisen latauksen jälkeen

Malli on välimuistissa selaimessasi. Seuraavat käyttökerrat toimivat offline-tilassa.

Ilmainen, ei rekisteröintiä

Ei tiliä, ei krediittejä, ei käyttörajoitusta. Avaa ja käytä.

Valitse kieli

Konepellin alla

Puheentunnistus tarkoittaa yleensä äänen lataamista jonkun GPU:lle. Tässä malli toimii sen sijaan omalla koneellasi, mikä tekee työkalusta samanaikaisesti ilmaisen ja yksityisen.

Open-source recognition model
Kvantisoitu versio avoimen lähdekoodin neuroverkkoon perustuvasta puheentunnistusmallista, joka on riittävän pieni ladattavaksi kerran ja säilytettäväksi selaimessasi.
WebAssembly
Päättelyajonaikainen ympäristö on käännetty WebAssemblyksi, joten numeerinen koodi toimii lähes natiivinopeudella hiekkalaatikoidussa välilehdessä ilman laajennuksia ja asennusta.
On-device inference
Mallin lataaminen, tokenisointi ja dekoodaussyklin ajaminen tapahtuvat kaikki asiakaspuolella. Mikään osa putkesta ei kutsu palvelinta, kun sivu on latautunut.
Web Audio API
Tiedostosi dekoodataan ja näytteistetään uudelleen mallin odottamaan 16 kHz:n monomuotoon selaimen oman ääniputken avulla, joten kaikki selaimen toistettavissa olevat formaatit hyväksytään.

Kompromissi on mallin koko. Laitteella olevat painot ovat murto-osa siitä, mitä isännöity palvelu käyttää, joten tarkkuus heikkenee meluisassa äänessä, voimakkaissa aksenteissa ja päällekkäisissä puhujissa - siinä alla oleva pilvivaihtoehto ansaitsee paikkansa.

Tarvitsetko tarkempaa tai useampia kieliä?

Pilvipohjainen puheesta tekstiksi

Ilmainen selaimessa toimiva työkalu käyttää pientä avoimen lähdekoodin mallia – se sopii puhtaalle äänelle, mutta sillä voi olla vaikeuksia voimakkaiden aksenttien, melun tai päällekkäisten puhujien kanssa, ja se kattaa vain rajoitetun määrän kieliä. Lähetyslaatuisen tarkkuuden, paljon laajemman kielituen ja SRT/VTT/TXT-latausten saamiseksi käytä maksullista pilvipohjaista puheesta tekstiksi -palveluamme.

Kokeile pilvipohjaista puheesta tekstiksi -palvelua