Slipp en hvilken som helst lyd- eller videofil, velg et språk, og få et fullstendig transkript med tidsstempler - alt i nettleseren din. Modellen lastes ned én gang (~75 MB) og bufres lokalt, så etterfølgende kjøringer er øyeblikkelige og fungerer offline.
Gjenkjenning kjører lokalt. Lydfilen din forlater aldri enheten din.
Modellen er bufret i nettleseren din. Etterfølgende kjøringer fungerer offline.
Ingen konto, ingen kreditter, ingen bruksgrense. Bare åpne og bruk.
Talegjenkjenning betyr vanligvis å laste opp lyden din til noens GPU. Her kjører modellen på din egen maskin i stedet, noe som gjør verktøyet gratis og privat samtidig.
Kompromisset er modellstørrelse. Vektdata på enheten er en brøkdel av hva en hostet tjeneste kjører, så nøyaktigheten synker på støyende lyd, sterke aksenter og overlappende stemmer – det er der skyalternativet nedenfor kommer til sin rett.
Det gratis nettleserverktøyet kjører en liten åpen kildekode-modell – fint for ren lyd, men det kan slite med kraftige aksenter, støy eller overlappende høyttalere, og dekker bare et begrenset sett med språk. For nøyaktighet i kringkastingskvalitet, langt bredere språkstøtte og SRT/VTT/TXT-nedlastinger, bruk vår betalte skybaserte tale til tekst.
Prøv skybasert tale til tekst