Subformer
मुफ्त · कोई साइनअप नहीं · ब्राउज़र में चलता है

मुफ्त Farsi टेक्स्ट-टू-स्पीच

فارسی

टाइप करें या Farsi टेक्स्ट पेस्ट करें और इसे बोला हुआ सुनें - सब कुछ आपके ब्राउज़र में, बिना साइनअप के। वॉइस मॉडल एक बार (~61 MB) डाउनलोड होता है और लोकली कैश हो जाता है, इसलिए बाद के रन तुरंत होते हैं और ऑफ़लाइन काम करते हैं।

यह कैसे काम करता है

  1. 1. अपना टेक्स्ट टाइप करें

    कोई भी Farsi टेक्स्ट पेस्ट या टाइप करें - विराम चिन्ह और लाइन ब्रेक्स को बरकरार रखा जाता है.

  2. 2. उत्पन्न करें

    पहली बार क्लिक करने पर ~61 MB वॉइस मॉडल आपके ब्राउज़र में डाउनलोड हो जाता है। उसके बाद, संश्लेषण त्वरित होता है।

  3. 3. डाउनलोड या चलाएँ

    ऑडियो को पेज पर ही चलाएँ या इसे WAV फ़ाइल के रूप में सेव करें। ऑडियो कभी भी आपके डिवाइस से बाहर नहीं जाता।

आपका टेक्स्ट आपके डिवाइस पर ही रहता है

सिंथेसिस वेबअसेंबली का उपयोग करके पूरी तरह से आपके ब्राउज़र में चलता है। एकमात्र नेटवर्क अनुरोध वॉयस मॉडल और इन्फरेंस रनटाइम को फेच करने के लिए होते हैं - दोनों सार्वजनिक, स्टैटिक एसेट हैं। हम आपका टेक्स्ट नहीं देखते हैं और हम जेनरेट किया गया ऑडियो नहीं देखते हैं।

आपके ब्राउज़र में Farsi वॉयस कैसे चलती है

यह एक वास्तविक न्यूरल TTS मॉडल है जो आपकी अपनी मशीन पर निष्पादित हो रहा है, न कि होस्टेड API के लिए एक पतला क्लाइंट। चार चीज़ें इसे एक टैब में संभव बनाती हैं।

Open-source neural voice
Farsi मॉडल को एक ही स्पीकर पर प्रशिक्षित किया जाता है, यही कारण है कि आपके द्वारा सिंथेसाइज़ की गई हर चीज़ में उच्चारण और डिलीवरी सुसंगत रहती है।
WebAssembly
मॉडल रनटाइम और वह चरण जो فارسی टेक्स्ट को फोनीम में बदलता है, दोनों को वेबअसेंबली में संकलित किया जाता है, इसलिए डेस्कटॉप के लिए मूल रूप से लिखा गया कोड ब्राउज़र सैंडबॉक्स के अंदर लगभग-नेटिव गति से चलता है।
On-device inference
मॉडल का न्यूरल नेटवर्क स्थानीय रूप से निष्पादित होता है, जिसे सिंगल-थ्रेडेड मोड पर पिन किया जाता है ताकि पेज को कभी भी क्रॉस-ऑरिजिन आइसोलेशन की आवश्यकता न हो और यह हर आधुनिक ब्राउज़र में काम करे।
Origin Private File System
~61 MB वॉयस मॉडल पहली बार चलने के बाद एक निजी, प्रति-मूल स्टोर में कैश किया जाता है। बाद की विज़िट डाउनलोड को छोड़ देती हैं और बिना किसी नेटवर्क के सिंथेसाइज़ करती हैं।
ब्रॉडकास्ट-गुणवत्ता वाली आवाज़ चाहिए?

Subformer वॉइस सिंथेसिस - स्टूडियो-ग्रेड Farsi TTS

ऊपर दिया गया मुफ्त ब्राउज़र-आधारित टूल ड्राफ्ट और प्रीव्यू के लिए शानदार है, लेकिन ओपन-सोर्स आवाज़ स्पष्ट रूप से कृत्रिम लगती है। Subformer का सशुल्क Voice Synthesis प्राकृतिक, प्रसारण-स्तरीय ऑडियो उत्पन्न करता है, जिसमें वैकल्पिक वॉइस क्लोनिंग की सुविधा है।

Subformer Voice Synthesis आज़माएँ
प्रीमियम - Subformer से भी

अक्सर पूछे जाने वाले प्रश्न

अन्य मुफ्त TTS भाषाएँ आज़माएँ

वॉइस Piper द्वारा संचालित हैं। वॉइस वेट्स MIT-लाइसेंस के अंतर्गत हैं (rhasspy/piper-voices). फोनिमाइज़र wasm रनटाइम पर एक सार्वजनिक CDN से लोड होता है और यह इस साइट के वितरण का हिस्सा नहीं है।