Deixa anar qualsevol fitxer d'àudio o vídeo, tria un idioma i obté una transcripció completa amb marques de temps - tot al teu navegador. El model es descarrega una sola vegada (~75 MB) i s'emmagatzema a la memòria cau local, així que les execucions posteriors són instantànies i funcionen sense connexió.
El reconeixement s'executa localment. El teu àudio mai no surt del teu dispositiu.
El model es guarda a la memòria cau del teu navegador. Les execucions posteriors funcionen sense connexió.
Sense compte, sense crèdits, sense límit d’ús. Obre'l i fes-ne ús.
El reconeixement de veu normalment implica carregar el vostre àudio a la GPU d'algú. Aquí el model s'executa a la vostra pròpia màquina, la qual cosa fa que l'eina sigui gratuïta i privada al mateix temps.
La contrapartida és la mida del model. Els pesos al dispositiu són una fracció del que executa un servei allotjat, de manera que la precisió disminueix en àudio sorollós, accents forts i parlants superposats; aquí és on l'opció del núvol següent es guanya el seu lloc.
L'eina gratuïta al navegador executa un petit model de codi obert, que funciona bé per a àudios nets, però pot tenir dificultats amb accents marcats, soroll o parlants superposats, i només cobreix un conjunt limitat d'idiomes. Per a una precisió de qualitat de difusió, un suport lingüístic molt més ampli i descàrregues SRT/VTT/TXT, utilitza el nostre reconeixement de veu a text de pagament basat en el núvol.
Prova el reconeixement de veu a text basat en el núvol