Subformer
Gratuit · Pas d'inscription · Fonctionne dans votre navigateur

Synthèse vocale Mandarin gratuite

普通话

Tapez ou collez Mandarin texte et écoutez-le prononcé - le tout dans votre navigateur, sans inscription. Le modèle vocal est téléchargé une seule fois (~60 Mo) et mis en cache localement, donc les exécutions suivantes sont instantanées et fonctionnent hors ligne.

Comment cela fonctionne

  1. 1. Saisissez votre texte

    Collez ou saisissez n'importe quel Mandarin texte - la ponctuation et les sauts de ligne sont respectés.

  2. 2. Générer

    Le premier clic télécharge le modèle vocal d'environ 60 Mo dans votre navigateur. Après cela, la synthèse est instantanée.

  3. 3. Télécharger ou lire

    Écoutez l'audio directement ou enregistrez-le au format WAV. L'audio ne quitte jamais votre appareil.

Votre texte reste sur votre appareil

La synthèse s'exécute entièrement dans votre navigateur à l'aide de WebAssembly. Les seules requêtes réseau sont pour récupérer le modèle vocal et le runtime d'inférence - tous deux sont des actifs publics et statiques. Nous ne voyons pas votre texte et nous ne voyons pas l'audio généré.

Comment la voix Mandarin s'exécute dans votre navigateur

Il s'agit d'un véritable modèle neuronal TTS exécuté sur votre propre machine, et non d'un client léger pour une API hébergée. Quatre éléments rendent cela possible dans un onglet.

Open-source neural voice
Le modèle Mandarin est entraîné sur un seul locuteur, c'est pourquoi l'accent et la prononciation restent constants sur tout ce que vous synthétisez.
WebAssembly
Le runtime du modèle et l'étape qui transforme le texte 普通话 en phonèmes sont tous deux compilés en WebAssembly, de sorte que le code initialement écrit pour le bureau s'exécute à une vitesse quasi native dans le bac à sable du navigateur.
On-device inference
Le réseau neuronal du modèle est exécuté localement, épinglé en mode mono-thread afin que la page n'ait jamais besoin d'isolation inter-origines et fonctionne dans tous les navigateurs modernes.
Origin Private File System
Le modèle vocal de ~60 Mo est mis en cache dans un stockage privé, par origine, après la première exécution. Les visites ultérieures évitent le téléchargement et synthétisent sans aucun réseau.
Besoin de voix de qualité broadcast ?

Subformer Voice Synthesis - de qualité studio Mandarin TTS

L'outil gratuit dans le navigateur ci-dessus est idéal pour les brouillons et les aperçus, mais la voix open source paraît nettement synthétique. La synthèse vocale payante de Subformer produit un audio naturel, de qualité broadcast, avec un clonage vocal optionnel.

Essayez Subformer Voice Synthesis
Premium - également proposé par Subformer

Foire aux questions

Essayez d'autres langues TTS gratuites

Voix propulsées par Piper. Les poids des voix sont sous licence MIT (rhasspy/piper-voices). Le phonémiseur wasm est chargé depuis un CDN public à l'exécution et ne fait pas partie de la distribution de ce site.