Subformer
De balde · Sen rexistro · Funciona no teu navegador

Voz a texto gratis en German

Deutsch

Solte un ficheiro de audio ou vídeo German e obtén unha transcrición completa con marcas de tempo - todo no teu navegador, sen rexistro. O modelo descárgase unha vez (~75 MB) e almacénase en caché localmente, polo que as execucións posteriores son instantáneas e funcionan sen conexión.

Comprobando o soporte do navegador…

Necesitas maior precisión ou máis idiomas?

Conversión de voz a texto German baseada na nube

A ferramenta gratuíta no navegador executa un pequeno modelo de código aberto, que está ben para audio limpo, pero pode ter dificultades con acentos German fortes, ruído ou falantes superpostos, e só cobre un conxunto limitado de idiomas. Para unha precisión de calidade de emisión, un soporte de idiomas moito máis amplo e descargas SRT/VTT/TXT, utiliza a nosa conversión de voz a texto de pago baseada na nube.

Probar a conversión de voz a texto baseada na nube

Como funciona

  1. 1. Solte un ficheiro

    Solte calquera ficheiro de audio ou vídeo German - MP3, WAV, M4A, MP4 e WEBM son compatibles.

  2. 2. Transcribir

    O primeiro clic descarga o modelo (~75 MB) no teu navegador. Despois diso, o recoñecemento é instantáneo e funciona sen conexión.

  3. 3. Descargar

    Garda a transcrición como TXT, SRT ou VTT. O teu áudio e o resultado nunca saen do teu dispositivo.

O teu audio permanece no teu dispositivo

O recoñecemento execútase integramente no teu navegador usando WebAssembly. As únicas solicitudes de rede son para obter o modelo e o runtime de WebAssembly - ambos son activos públicos e estáticos. Non vemos o teu áudio e tampouco a transcrición.

Como se executa a transcrición German no teu navegador

O recoñecemento de voz normalmente significa cargar o teu audio á GPU doutra persoa. Aquí o modelo execútase na túa propia máquina, o que fai que isto sexa gratuíto e privado ao mesmo tempo.

Open-source recognition model
Un modelo neural de código aberto adestrado en audio multilingüe, por iso unha única descarga xestiona German sen necesidade de buscar un modelo específico para o idioma.
WebAssembly
O tempo de execución da inferencia compílase en WebAssembly, polo que o código numérico se executa a unha velocidade case nativa dentro dunha pestana illada sen complemento nin instalación.
On-device inference
O modelo cuantificado de ~75 MB cárgase e o bucle de decodificación é impulsado completamente no lado do cliente. Nada na pipeline chama a un servidor unha vez que a páxina se cargou.
Web Audio API
O seu ficheiro decodifícase e remostréase ao mono de 16 kHz que o modelo espera usando a propia canalización de audio do navegador, polo que se acepta calquera formato que o seu navegador poida reproducir.
Premium - tamén de Subformer

Preguntas frecuentes

Proba outras linguas gratuítas de fala a texto