Subformer
मुफ्त · कोई साइनअप नहीं · ब्राउज़र में चलता है

मुफ्त Kazakh टेक्स्ट-टू-स्पीच

Қазақ тілі

टाइप करें या Kazakh टेक्स्ट पेस्ट करें और इसे बोला हुआ सुनें - सब कुछ आपके ब्राउज़र में, बिना साइनअप के। वॉइस मॉडल एक बार (~122 MB) डाउनलोड होता है और लोकली कैश हो जाता है, इसलिए बाद के रन तुरंत होते हैं और ऑफ़लाइन काम करते हैं।

यह कैसे काम करता है

  1. 1. अपना टेक्स्ट टाइप करें

    कोई भी Kazakh टेक्स्ट पेस्ट या टाइप करें - विराम चिन्ह और लाइन ब्रेक्स को बरकरार रखा जाता है.

  2. 2. उत्पन्न करें

    पहली बार क्लिक करने पर ~122 MB वॉइस मॉडल आपके ब्राउज़र में डाउनलोड हो जाता है। उसके बाद, संश्लेषण त्वरित होता है।

  3. 3. डाउनलोड या चलाएँ

    ऑडियो को पेज पर ही चलाएँ या इसे WAV फ़ाइल के रूप में सेव करें। ऑडियो कभी भी आपके डिवाइस से बाहर नहीं जाता।

आपका टेक्स्ट आपके डिवाइस पर ही रहता है

सिंथेसिस वेबअसेंबली का उपयोग करके पूरी तरह से आपके ब्राउज़र में चलता है। एकमात्र नेटवर्क अनुरोध वॉयस मॉडल और इन्फरेंस रनटाइम को फेच करने के लिए होते हैं - दोनों सार्वजनिक, स्टैटिक एसेट हैं। हम आपका टेक्स्ट नहीं देखते हैं और हम जेनरेट किया गया ऑडियो नहीं देखते हैं।

आपके ब्राउज़र में Kazakh वॉयस कैसे चलती है

यह एक वास्तविक न्यूरल TTS मॉडल है जो आपकी अपनी मशीन पर निष्पादित हो रहा है, न कि होस्टेड API के लिए एक पतला क्लाइंट। चार चीज़ें इसे एक टैब में संभव बनाती हैं।

Open-source neural voice
Kazakh मॉडल को एक ही स्पीकर पर प्रशिक्षित किया जाता है, यही कारण है कि आपके द्वारा सिंथेसाइज़ की गई हर चीज़ में उच्चारण और डिलीवरी सुसंगत रहती है।
WebAssembly
मॉडल रनटाइम और वह चरण जो Қазақ тілі टेक्स्ट को फोनीम में बदलता है, दोनों को वेबअसेंबली में संकलित किया जाता है, इसलिए डेस्कटॉप के लिए मूल रूप से लिखा गया कोड ब्राउज़र सैंडबॉक्स के अंदर लगभग-नेटिव गति से चलता है।
On-device inference
मॉडल का न्यूरल नेटवर्क स्थानीय रूप से निष्पादित होता है, जिसे सिंगल-थ्रेडेड मोड पर पिन किया जाता है ताकि पेज को कभी भी क्रॉस-ऑरिजिन आइसोलेशन की आवश्यकता न हो और यह हर आधुनिक ब्राउज़र में काम करे।
Origin Private File System
~122 MB वॉयस मॉडल पहली बार चलने के बाद एक निजी, प्रति-मूल स्टोर में कैश किया जाता है। बाद की विज़िट डाउनलोड को छोड़ देती हैं और बिना किसी नेटवर्क के सिंथेसाइज़ करती हैं।
ब्रॉडकास्ट-गुणवत्ता वाली आवाज़ चाहिए?

Subformer वॉइस सिंथेसिस - स्टूडियो-ग्रेड Kazakh TTS

ऊपर दिया गया मुफ्त ब्राउज़र-आधारित टूल ड्राफ्ट और प्रीव्यू के लिए शानदार है, लेकिन ओपन-सोर्स आवाज़ स्पष्ट रूप से कृत्रिम लगती है। Subformer का सशुल्क Voice Synthesis प्राकृतिक, प्रसारण-स्तरीय ऑडियो उत्पन्न करता है, जिसमें वैकल्पिक वॉइस क्लोनिंग की सुविधा है।

Subformer Voice Synthesis आज़माएँ
प्रीमियम - Subformer से भी

अक्सर पूछे जाने वाले प्रश्न

अन्य मुफ्त TTS भाषाएँ आज़माएँ

वॉइस Piper द्वारा संचालित हैं। वॉइस वेट्स MIT-लाइसेंस के अंतर्गत हैं (rhasspy/piper-voices). फोनिमाइज़र wasm रनटाइम पर एक सार्वजनिक CDN से लोड होता है और यह इस साइट के वितरण का हिस्सा नहीं है।