Subformer
Gratis · Sin registro · Se ejecuta en tu navegador

Voz a texto Catalan gratis

Català

Suelta un archivo de audio o vídeo en Catalan y obtén una transcripción completa con marcas de tiempo - todo en tu navegador, sin registro. El modelo se descarga una sola vez (~75 MB) y se almacena en caché localmente, por lo que las ejecuciones posteriores son instantáneas y funcionan sin conexión.

Comprobando la compatibilidad del navegador…

¿Necesitas mayor precisión o más idiomas?

Voz a texto Catalan basado en la nube

La herramienta gratuita en el navegador ejecuta un pequeño modelo de código abierto, lo cual está bien para audio limpio, pero puede tener dificultades con acentos Catalan fuertes, ruido o oradores superpuestos, y solo cubre un conjunto limitado de idiomas. Para una precisión de calidad de emisión, un soporte de idiomas mucho más amplio y descargas SRT/VTT/TXT, utiliza nuestro servicio de Voz a texto de pago basado en la nube.

Probar Voz a texto basado en la nube

Cómo funciona

  1. 1. Suelta un archivo

    Suelta cualquier archivo de audio o vídeo Catalan - MP3, WAV, M4A, MP4 y WEBM son compatibles.

  2. 2. Transcribe

    El primer clic descarga el modelo de ~75 MB en tu navegador. A partir de entonces, el reconocimiento es instantáneo y funciona sin conexión.

  3. 3. Descarga

    Guarda la transcripción como TXT, SRT o VTT. Tu audio y el resultado nunca abandonan tu dispositivo.

Tu audio permanece en tu dispositivo

El reconocimiento se ejecuta íntegramente en tu navegador mediante WebAssembly. Las únicas peticiones de red son para obtener el modelo y el runtime de WebAssembly - ambos son recursos públicos y estáticos. No vemos tu audio y no vemos la transcripción.

Cómo funciona la transcripción en Catalan en tu navegador

El reconocimiento de voz normalmente implica subir tu audio a la GPU de alguien. Aquí el modelo se ejecuta en tu propia máquina, lo que hace que esto sea gratuito y privado al mismo tiempo.

Open-source recognition model
Un modelo neuronal de código abierto entrenado con audio multilingüe, por lo que una sola descarga gestiona Catalan sin necesidad de obtener un modelo específico para el idioma.
WebAssembly
El tiempo de ejecución de inferencia se compila a WebAssembly, por lo que el código numérico se ejecuta a una velocidad casi nativa dentro de una pestaña aislada sin complementos ni instalación.
On-device inference
El modelo cuantificado de ~75 MB se carga y el bucle de decodificación se ejecuta completamente del lado del cliente. Nada en el proceso llama a un servidor una vez que la página se ha cargado.
Web Audio API
Su archivo se decodifica y remuestrea a los 16 kHz mono que el modelo espera utilizando la propia canalización de audio del navegador, por lo que se acepta cualquier formato que su navegador pueda reproducir.
Premium - también de Subformer

Preguntas frecuentes

Prueba otros idiomas gratuitos de reconocimiento de voz