Subformer
Gratuit · Pas d'inscription · Fonctionne dans votre navigateur

Reconnaissance vocale gratuite en 35+ langues

Déposez n'importe quel fichier audio ou vidéo, choisissez une langue et obtenez une transcription complète avec horodatages - le tout dans votre navigateur. Le modèle est téléchargé une fois (~75 MB) et mis en cache localement, de sorte que les exécutions suivantes sont instantanées et fonctionnent hors ligne.

Privé par défaut

La reconnaissance s'exécute localement. Votre audio ne quitte jamais votre appareil.

Instantané après le premier chargement

Le modèle est mis en cache dans votre navigateur. Les exécutions suivantes fonctionnent hors connexion.

Gratuit, sans inscription

Pas de compte, pas de crédits, pas de limite d'utilisation. Ouvrez et utilisez.

Choisissez une langue

Sous le capot

La reconnaissance vocale signifie normalement le téléchargement de votre audio sur le GPU de quelqu'un. Ici, le modèle s'exécute sur votre propre machine, ce qui rend l'outil gratuit et privé à la fois.

Open-source recognition model
Une version quantifiée d'un modèle de reconnaissance vocale neuronal open-source, suffisamment petite pour être téléchargée une seule fois et conservée dans votre navigateur.
WebAssembly
Le runtime d'inférence est compilé en WebAssembly, de sorte que le code numérique s'exécute à une vitesse proche de la native dans un onglet sandboxé, sans plugin ni installation.
On-device inference
Le chargement du modèle, la tokenisation et l'exécution de la boucle de décodage se déroulent tous côté client. Aucune partie du pipeline n'appelle un serveur une fois la page chargée.
Web Audio API
Votre fichier est décodé et rééchantillonné en mono 16 kHz, comme le modèle l'attend, en utilisant le pipeline audio propre au navigateur, de sorte que tout format que votre navigateur peut lire est accepté.

Le compromis est la taille du modèle. Les poids sur l'appareil représentent une fraction de ce qu'un service hébergé exécute, de sorte que la précision diminue sur l'audio bruyant, les accents forts et les locuteurs qui se chevauchent - c'est là que l'option cloud ci-dessous prend tout son sens.

Besoin d'une plus grande précision ou de plus de langues ?

Reconnaissance vocale basée sur le cloud

L'outil gratuit intégré au navigateur utilise un petit modèle open-source – idéal pour un audio propre, mais il peut avoir du mal avec les accents prononcés, le bruit ou les locuteurs qui se chevauchent, et ne couvre qu'un ensemble limité de langues. Pour une précision de qualité diffusion, une prise en charge linguistique bien plus étendue et des téléchargements SRT/VTT/TXT, utilisez notre reconnaissance vocale payante basée sur le cloud.

Essayer la reconnaissance vocale basée sur le cloud