Subformer
मुफ्त · कोई साइनअप नहीं · ब्राउज़र में चलता है

मुफ्त Mandarin टेक्स्ट-टू-स्पीच

普通话

टाइप करें या Mandarin टेक्स्ट पेस्ट करें और इसे बोला हुआ सुनें - सब कुछ आपके ब्राउज़र में, बिना साइनअप के। वॉइस मॉडल एक बार (~60 MB) डाउनलोड होता है और लोकली कैश हो जाता है, इसलिए बाद के रन तुरंत होते हैं और ऑफ़लाइन काम करते हैं।

यह कैसे काम करता है

  1. 1. अपना टेक्स्ट टाइप करें

    कोई भी Mandarin टेक्स्ट पेस्ट या टाइप करें - विराम चिन्ह और लाइन ब्रेक्स को बरकरार रखा जाता है.

  2. 2. उत्पन्न करें

    पहली बार क्लिक करने पर ~60 MB वॉइस मॉडल आपके ब्राउज़र में डाउनलोड हो जाता है। उसके बाद, संश्लेषण त्वरित होता है।

  3. 3. डाउनलोड या चलाएँ

    ऑडियो को पेज पर ही चलाएँ या इसे WAV फ़ाइल के रूप में सेव करें। ऑडियो कभी भी आपके डिवाइस से बाहर नहीं जाता।

आपका टेक्स्ट आपके डिवाइस पर ही रहता है

सिंथेसिस वेबअसेंबली का उपयोग करके पूरी तरह से आपके ब्राउज़र में चलता है। एकमात्र नेटवर्क अनुरोध वॉयस मॉडल और इन्फरेंस रनटाइम को फेच करने के लिए होते हैं - दोनों सार्वजनिक, स्टैटिक एसेट हैं। हम आपका टेक्स्ट नहीं देखते हैं और हम जेनरेट किया गया ऑडियो नहीं देखते हैं।

आपके ब्राउज़र में Mandarin वॉयस कैसे चलती है

यह एक वास्तविक न्यूरल TTS मॉडल है जो आपकी अपनी मशीन पर निष्पादित हो रहा है, न कि होस्टेड API के लिए एक पतला क्लाइंट। चार चीज़ें इसे एक टैब में संभव बनाती हैं।

Open-source neural voice
Mandarin मॉडल को एक ही स्पीकर पर प्रशिक्षित किया जाता है, यही कारण है कि आपके द्वारा सिंथेसाइज़ की गई हर चीज़ में उच्चारण और डिलीवरी सुसंगत रहती है।
WebAssembly
मॉडल रनटाइम और वह चरण जो 普通话 टेक्स्ट को फोनीम में बदलता है, दोनों को वेबअसेंबली में संकलित किया जाता है, इसलिए डेस्कटॉप के लिए मूल रूप से लिखा गया कोड ब्राउज़र सैंडबॉक्स के अंदर लगभग-नेटिव गति से चलता है।
On-device inference
मॉडल का न्यूरल नेटवर्क स्थानीय रूप से निष्पादित होता है, जिसे सिंगल-थ्रेडेड मोड पर पिन किया जाता है ताकि पेज को कभी भी क्रॉस-ऑरिजिन आइसोलेशन की आवश्यकता न हो और यह हर आधुनिक ब्राउज़र में काम करे।
Origin Private File System
~60 MB वॉयस मॉडल पहली बार चलने के बाद एक निजी, प्रति-मूल स्टोर में कैश किया जाता है। बाद की विज़िट डाउनलोड को छोड़ देती हैं और बिना किसी नेटवर्क के सिंथेसाइज़ करती हैं।
ब्रॉडकास्ट-गुणवत्ता वाली आवाज़ चाहिए?

Subformer वॉइस सिंथेसिस - स्टूडियो-ग्रेड Mandarin TTS

ऊपर दिया गया मुफ्त ब्राउज़र-आधारित टूल ड्राफ्ट और प्रीव्यू के लिए शानदार है, लेकिन ओपन-सोर्स आवाज़ स्पष्ट रूप से कृत्रिम लगती है। Subformer का सशुल्क Voice Synthesis प्राकृतिक, प्रसारण-स्तरीय ऑडियो उत्पन्न करता है, जिसमें वैकल्पिक वॉइस क्लोनिंग की सुविधा है।

Subformer Voice Synthesis आज़माएँ
प्रीमियम - Subformer से भी

अक्सर पूछे जाने वाले प्रश्न

अन्य मुफ्त TTS भाषाएँ आज़माएँ

वॉइस Piper द्वारा संचालित हैं। वॉइस वेट्स MIT-लाइसेंस के अंतर्गत हैं (rhasspy/piper-voices). फोनिमाइज़र wasm रनटाइम पर एक सार्वजनिक CDN से लोड होता है और यह इस साइट के वितरण का हिस्सा नहीं है।