Trascina qualsiasi file audio o video, scegli una lingua e ottieni una trascrizione completa con timestamp - tutto nel tuo browser. Il modello viene scaricato una sola volta (~75 MB) e memorizzato nella cache localmente, quindi le esecuzioni successive sono istantanee e funzionano offline.
Il riconoscimento avviene localmente. Il tuo audio non lascia mai il dispositivo.
Il modello è memorizzato nella cache del tuo browser. Le esecuzioni successive funzionano offline.
Nessun account, nessun credito, nessun limite di utilizzo. Apri e usa.
Il riconoscimento vocale normalmente significa caricare il tuo audio sulla GPU di qualcun altro. Qui il modello viene eseguito sulla tua macchina, il che rende lo strumento gratuito e privato allo stesso tempo.
Il compromesso è la dimensione del modello. I pesi sul dispositivo sono una frazione di ciò che esegue un servizio ospitato, quindi la precisione diminuisce su audio rumorosi, accenti forti e oratori sovrapposti - è qui che l'opzione cloud sottostante si ripaga.
Lo strumento gratuito nel browser esegue un piccolo modello open-source - va bene per audio puliti, ma può avere difficoltà con forti accenti, rumore o oratori sovrapposti, e copre solo un set limitato di lingue. Per una precisione di livello broadcast, un supporto linguistico molto più ampio e download SRT/VTT/TXT, usa il nostro Speech to Text a pagamento basato su cloud.
Prova Speech to Text basato su cloud