Subformer
मोफत · नोंदणी नाही · तुमच्या ब्राउझरमध्ये चालते

मुफ्त Mandarin टेक्स्ट-टू-स्पीच

普通话

टाइप करा किंवा Mandarin मजकूर पेस्ट करा आणि तो ऐका - सगळे तुमच्या ब्राउझरमध्ये, कोणतीही साइनअप न करता. व्हॉइस मॉडेल एकदाच डाउनलोड होते (~60 MB) आणि स्थानिकपणे कॅश होते, त्यामुळे पुढील वापर ताबडतोब आणि ऑफलाइन काम करतो.

हे कसे काम करते

  1. 1. आपला मजकूर टाइप करा

    कोणतेही Mandarin मजकूर पेस्ट करा किंवा टाइप करा - विरामचिन्हे आणि ओळींचे विभाजन जपले जाते.

  2. 2. निर्मित करा

    पहिल्या क्लिकवर ~60 MB आवाज मॉडेल तुमच्या ब्राउझरमध्ये डाउनलोड होते. त्यानंतर, संश्लेषण ताबडतोब होते.

  3. 3. डाउनलोड करा किंवा प्ले करा

    ऑडिओ इनलाइन प्ले करा किंवा WAV फाईल म्हणून जतन करा. ऑडिओ कधीही तुमच्या डिव्हाइसच्या बाहेर जात नाही.

तुमचा मजकूर तुमच्या डिव्हाइसवरच राहतो

सिंथेसिस वेबअसेम्बली वापरून तुमच्या ब्राउझरमध्ये पूर्णपणे चालते. एकमेव नेटवर्क विनंत्या व्हॉइस मॉडेल आणि इन्फरन्स रनटाइम आणण्यासाठी असतात - दोन्ही सार्वजनिक, स्थिर मालमत्ता आहेत. आम्ही तुमचा मजकूर पाहत नाही आणि आम्ही तयार केलेला ऑडिओ पाहत नाही.

तुमच्या ब्राउझरमध्ये Mandarin आवाज कसा चालतो

हे तुमच्या स्वतःच्या मशीनवर चालणारे एक वास्तविक न्यूरल TTS मॉडेल आहे, होस्ट केलेल्या API साठी पातळ क्लायंट नाही. चार गोष्टींमुळे हे टॅबमध्ये शक्य होते.

Open-source neural voice
Mandarin मॉडेल एकाच स्पीकरवर प्रशिक्षित केले जाते, म्हणूनच तुम्ही सिंथेसाइज केलेल्या प्रत्येक गोष्टीमध्ये उच्चारण आणि वितरण सुसंगत राहते.
WebAssembly
मॉडेल रनटाइम आणि 普通话 मजकूर ध्वनीमध्ये रूपांतरित करणारी पायरी दोन्ही वेबअसेम्बलीमध्ये संकलित केली जातात, त्यामुळे डेस्कटॉपसाठी मूळतः लिहिलेला कोड ब्राउझर सँडबॉक्समध्ये जवळजवळ मूळ वेगाने चालतो.
On-device inference
मॉडेलचे न्यूरल नेटवर्क स्थानिकरित्या कार्यान्वित केले जाते, सिंगल-थ्रेडेड मोडमध्ये पिन केलेले असते जेणेकरून पृष्ठाला कधीही क्रॉस-ओरिजिन आयसोलेशनची आवश्यकता नसते आणि ते प्रत्येक आधुनिक ब्राउझरमध्ये कार्य करते.
Origin Private File System
~60 MB व्हॉइस मॉडेल पहिल्या रननंतर खाजगी, प्रति-मूळ स्टोअरमध्ये कॅश केले जाते. नंतरच्या भेटींमध्ये डाउनलोड वगळले जाते आणि नेटवर्कशिवाय संश्लेषण होते.
प्रसारण-गुणवत्तेच्या आवाजांची गरज आहे का?

Subformer Voice Synthesis - स्टुडिओ-ग्रेड Mandarin TTS

वरील ब्राउझर-आधारित मोफत साधन मसुदे आणि पूर्वावलोकनांसाठी उत्तम आहे, परंतु मुक्त-स्रोत आवाज स्पष्टपणे कृत्रिम वाटतो. Subformer च्या सशुल्क Voice Synthesis नैसर्गिक, प्रसारण-मानक ऑडिओ तयार करते आणि ऐच्छिक आवाज क्लोनिंगची सुविधा देते.

Subformer Voice Synthesis वापरून पाहा
प्रीमियम - Subformer कडूनही

वारंवार विचारले जाणारे प्रश्न

इतर विनामूल्य TTS भाषा वापरून पहा

आवाज Piper द्वारे चालवले जातात. व्हॉइस वेट्स MIT-परवाना अंतर्गत आहेत (rhasspy/piper-voices). फोनेमायझर wasm रनटाइमवर सार्वजनिक CDN वरून लोड होते आणि हा या साइटच्या वितरणाचा भाग नाही.