Subformer
मोफत · नोंदणी नाही · तुमच्या ब्राउझरमध्ये चालते

मुफ्त Vietnamese टेक्स्ट-टू-स्पीच

Tiếng Việt

टाइप करा किंवा Vietnamese मजकूर पेस्ट करा आणि तो ऐका - सगळे तुमच्या ब्राउझरमध्ये, कोणतीही साइनअप न करता. व्हॉइस मॉडेल एकदाच डाउनलोड होते (~60 MB) आणि स्थानिकपणे कॅश होते, त्यामुळे पुढील वापर ताबडतोब आणि ऑफलाइन काम करतो.

हे कसे काम करते

  1. 1. आपला मजकूर टाइप करा

    कोणतेही Vietnamese मजकूर पेस्ट करा किंवा टाइप करा - विरामचिन्हे आणि ओळींचे विभाजन जपले जाते.

  2. 2. निर्मित करा

    पहिल्या क्लिकवर ~60 MB आवाज मॉडेल तुमच्या ब्राउझरमध्ये डाउनलोड होते. त्यानंतर, संश्लेषण ताबडतोब होते.

  3. 3. डाउनलोड करा किंवा प्ले करा

    ऑडिओ इनलाइन प्ले करा किंवा WAV फाईल म्हणून जतन करा. ऑडिओ कधीही तुमच्या डिव्हाइसच्या बाहेर जात नाही.

तुमचा मजकूर तुमच्या डिव्हाइसवरच राहतो

सिंथेसिस वेबअसेम्बली वापरून तुमच्या ब्राउझरमध्ये पूर्णपणे चालते. एकमेव नेटवर्क विनंत्या व्हॉइस मॉडेल आणि इन्फरन्स रनटाइम आणण्यासाठी असतात - दोन्ही सार्वजनिक, स्थिर मालमत्ता आहेत. आम्ही तुमचा मजकूर पाहत नाही आणि आम्ही तयार केलेला ऑडिओ पाहत नाही.

तुमच्या ब्राउझरमध्ये Vietnamese आवाज कसा चालतो

हे तुमच्या स्वतःच्या मशीनवर चालणारे एक वास्तविक न्यूरल TTS मॉडेल आहे, होस्ट केलेल्या API साठी पातळ क्लायंट नाही. चार गोष्टींमुळे हे टॅबमध्ये शक्य होते.

Open-source neural voice
Vietnamese मॉडेल एकाच स्पीकरवर प्रशिक्षित केले जाते, म्हणूनच तुम्ही सिंथेसाइज केलेल्या प्रत्येक गोष्टीमध्ये उच्चारण आणि वितरण सुसंगत राहते.
WebAssembly
मॉडेल रनटाइम आणि Tiếng Việt मजकूर ध्वनीमध्ये रूपांतरित करणारी पायरी दोन्ही वेबअसेम्बलीमध्ये संकलित केली जातात, त्यामुळे डेस्कटॉपसाठी मूळतः लिहिलेला कोड ब्राउझर सँडबॉक्समध्ये जवळजवळ मूळ वेगाने चालतो.
On-device inference
मॉडेलचे न्यूरल नेटवर्क स्थानिकरित्या कार्यान्वित केले जाते, सिंगल-थ्रेडेड मोडमध्ये पिन केलेले असते जेणेकरून पृष्ठाला कधीही क्रॉस-ओरिजिन आयसोलेशनची आवश्यकता नसते आणि ते प्रत्येक आधुनिक ब्राउझरमध्ये कार्य करते.
Origin Private File System
~60 MB व्हॉइस मॉडेल पहिल्या रननंतर खाजगी, प्रति-मूळ स्टोअरमध्ये कॅश केले जाते. नंतरच्या भेटींमध्ये डाउनलोड वगळले जाते आणि नेटवर्कशिवाय संश्लेषण होते.
प्रसारण-गुणवत्तेच्या आवाजांची गरज आहे का?

Subformer Voice Synthesis - स्टुडिओ-ग्रेड Vietnamese TTS

वरील ब्राउझर-आधारित मोफत साधन मसुदे आणि पूर्वावलोकनांसाठी उत्तम आहे, परंतु मुक्त-स्रोत आवाज स्पष्टपणे कृत्रिम वाटतो. Subformer च्या सशुल्क Voice Synthesis नैसर्गिक, प्रसारण-मानक ऑडिओ तयार करते आणि ऐच्छिक आवाज क्लोनिंगची सुविधा देते.

Subformer Voice Synthesis वापरून पाहा
प्रीमियम - Subformer कडूनही

वारंवार विचारले जाणारे प्रश्न

इतर विनामूल्य TTS भाषा वापरून पहा

आवाज Piper द्वारे चालवले जातात. व्हॉइस वेट्स MIT-परवाना अंतर्गत आहेत (rhasspy/piper-voices). फोनेमायझर wasm रनटाइमवर सार्वजनिक CDN वरून लोड होते आणि हा या साइटच्या वितरणाचा भाग नाही.