Subformer
मोफत · नोंदणी नाही · तुमच्या ब्राउझरमध्ये चालते

मुफ्त Arabic टेक्स्ट-टू-स्पीच

العربية

टाइप करा किंवा Arabic मजकूर पेस्ट करा आणि तो ऐका - सगळे तुमच्या ब्राउझरमध्ये, कोणतीही साइनअप न करता. व्हॉइस मॉडेल एकदाच डाउनलोड होते (~60 MB) आणि स्थानिकपणे कॅश होते, त्यामुळे पुढील वापर ताबडतोब आणि ऑफलाइन काम करतो.

हे कसे काम करते

  1. 1. आपला मजकूर टाइप करा

    कोणतेही Arabic मजकूर पेस्ट करा किंवा टाइप करा - विरामचिन्हे आणि ओळींचे विभाजन जपले जाते.

  2. 2. निर्मित करा

    पहिल्या क्लिकवर ~60 MB आवाज मॉडेल तुमच्या ब्राउझरमध्ये डाउनलोड होते. त्यानंतर, संश्लेषण ताबडतोब होते.

  3. 3. डाउनलोड करा किंवा प्ले करा

    ऑडिओ इनलाइन प्ले करा किंवा WAV फाईल म्हणून जतन करा. ऑडिओ कधीही तुमच्या डिव्हाइसच्या बाहेर जात नाही.

तुमचा मजकूर तुमच्या डिव्हाइसवरच राहतो

सिंथेसिस वेबअसेम्बली वापरून तुमच्या ब्राउझरमध्ये पूर्णपणे चालते. एकमेव नेटवर्क विनंत्या व्हॉइस मॉडेल आणि इन्फरन्स रनटाइम आणण्यासाठी असतात - दोन्ही सार्वजनिक, स्थिर मालमत्ता आहेत. आम्ही तुमचा मजकूर पाहत नाही आणि आम्ही तयार केलेला ऑडिओ पाहत नाही.

तुमच्या ब्राउझरमध्ये Arabic आवाज कसा चालतो

हे तुमच्या स्वतःच्या मशीनवर चालणारे एक वास्तविक न्यूरल TTS मॉडेल आहे, होस्ट केलेल्या API साठी पातळ क्लायंट नाही. चार गोष्टींमुळे हे टॅबमध्ये शक्य होते.

Open-source neural voice
Arabic मॉडेल एकाच स्पीकरवर प्रशिक्षित केले जाते, म्हणूनच तुम्ही सिंथेसाइज केलेल्या प्रत्येक गोष्टीमध्ये उच्चारण आणि वितरण सुसंगत राहते.
WebAssembly
मॉडेल रनटाइम आणि العربية मजकूर ध्वनीमध्ये रूपांतरित करणारी पायरी दोन्ही वेबअसेम्बलीमध्ये संकलित केली जातात, त्यामुळे डेस्कटॉपसाठी मूळतः लिहिलेला कोड ब्राउझर सँडबॉक्समध्ये जवळजवळ मूळ वेगाने चालतो.
On-device inference
मॉडेलचे न्यूरल नेटवर्क स्थानिकरित्या कार्यान्वित केले जाते, सिंगल-थ्रेडेड मोडमध्ये पिन केलेले असते जेणेकरून पृष्ठाला कधीही क्रॉस-ओरिजिन आयसोलेशनची आवश्यकता नसते आणि ते प्रत्येक आधुनिक ब्राउझरमध्ये कार्य करते.
Origin Private File System
~60 MB व्हॉइस मॉडेल पहिल्या रननंतर खाजगी, प्रति-मूळ स्टोअरमध्ये कॅश केले जाते. नंतरच्या भेटींमध्ये डाउनलोड वगळले जाते आणि नेटवर्कशिवाय संश्लेषण होते.
प्रसारण-गुणवत्तेच्या आवाजांची गरज आहे का?

Subformer Voice Synthesis - स्टुडिओ-ग्रेड Arabic TTS

वरील ब्राउझर-आधारित मोफत साधन मसुदे आणि पूर्वावलोकनांसाठी उत्तम आहे, परंतु मुक्त-स्रोत आवाज स्पष्टपणे कृत्रिम वाटतो. Subformer च्या सशुल्क Voice Synthesis नैसर्गिक, प्रसारण-मानक ऑडिओ तयार करते आणि ऐच्छिक आवाज क्लोनिंगची सुविधा देते.

Subformer Voice Synthesis वापरून पाहा
प्रीमियम - Subformer कडूनही

वारंवार विचारले जाणारे प्रश्न

इतर विनामूल्य TTS भाषा वापरून पहा

आवाज Piper द्वारे चालवले जातात. व्हॉइस वेट्स MIT-परवाना अंतर्गत आहेत (rhasspy/piper-voices). फोनेमायझर wasm रनटाइमवर सार्वजनिक CDN वरून लोड होते आणि हा या साइटच्या वितरणाचा भाग नाही.