Subformer
Gratis · Nessuna registrazione · Funziona nel tuo browser

Riconoscimento vocale gratuito in 35+ lingue

Trascina qualsiasi file audio o video, scegli una lingua e ottieni una trascrizione completa con timestamp - tutto nel tuo browser. Il modello viene scaricato una sola volta (~75 MB) e memorizzato nella cache localmente, quindi le esecuzioni successive sono istantanee e funzionano offline.

Privato per impostazione predefinita

Il riconoscimento avviene localmente. Il tuo audio non lascia mai il dispositivo.

Istantaneo dopo il primo caricamento

Il modello è memorizzato nella cache del tuo browser. Le esecuzioni successive funzionano offline.

Gratuito, senza registrazione

Nessun account, nessun credito, nessun limite di utilizzo. Apri e usa.

Scegli una lingua

Sotto il cofano

Il riconoscimento vocale normalmente significa caricare il tuo audio sulla GPU di qualcun altro. Qui il modello viene eseguito sulla tua macchina, il che rende lo strumento gratuito e privato allo stesso tempo.

Open-source recognition model
Una build quantizzata di un modello neurale open-source di riconoscimento vocale, abbastanza piccola da scaricare una volta e conservare nel browser.
WebAssembly
Il runtime di inferenza è compilato in WebAssembly, quindi il codice numerico viene eseguito a velocità quasi nativa all'interno di una scheda sandbox senza plugin e senza installazione.
On-device inference
Il caricamento del modello, la tokenizzazione e l'esecuzione del ciclo di decodifica avvengono tutti lato client. Nessuna parte della pipeline chiama un server una volta che la pagina è stata caricata.
Web Audio API
Il tuo file viene decodificato e ricampionato al mono 16 kHz che il modello si aspetta usando la pipeline audio del browser, quindi qualsiasi formato che il tuo browser può riprodurre è accettato.

Il compromesso è la dimensione del modello. I pesi sul dispositivo sono una frazione di ciò che esegue un servizio ospitato, quindi la precisione diminuisce su audio rumorosi, accenti forti e oratori sovrapposti - è qui che l'opzione cloud sottostante si ripaga.

Hai bisogno di maggiore precisione o più lingue?

Speech to Text basato su cloud

Lo strumento gratuito nel browser esegue un piccolo modello open-source - va bene per audio puliti, ma può avere difficoltà con forti accenti, rumore o oratori sovrapposti, e copre solo un set limitato di lingue. Per una precisione di livello broadcast, un supporto linguistico molto più ampio e download SRT/VTT/TXT, usa il nostro Speech to Text a pagamento basato su cloud.

Prova Speech to Text basato su cloud