Subformer
ఉచితం · సైన్‌అప్ అవసరం లేదు · మీ బ్రౌజర్లో నడుస్తుంది

ఉచితం Mandarin టెక్స్ట్-టు-స్పీచ్

普通话

Mandarin టెక్స్ట్‌ని టైప్ చేయండి లేదా పేస్ట్ చేసి దాన్ని వినండి - ఇవన్నీ మీ బ్రౌజర్లోనే, సైన్ అప్ అవసరం లేకుండా. వాయిస్ మోడల్ ఒకసారి (~60 MB) డౌన్‌లోడ్ చేసి స్థానికంగా క్యాష్ చేయబడుతుంది, అందువల్ల తరువాతి రన్‌లు వెంటనే మరియు ఆఫ్‌లైన్‌లో పనిచేస్తాయి.

ఇది ఎలా పని చేస్తుంది

  1. 1. మీ టెక్స్ట్ టైప్ చేయండి

    ఏైనా Mandarin టెక్స్ట్‌ను పేస్ట్ చేయండి లేదా టైప్ చేయండి - విరామ చిహ్నాలు మరియు లైన్ బ్రేక్‌లు గౌరవించబడతాయి

  2. 2. సృష్టించండి

    మొదటి క్లిక్ ~60 MB వాయిస్ మోడల్‌ని మీ బ్రౌజర్‌కు డౌన్లోడ్ చేస్తుంది. ఆ తర్వాత, సింథసిస్ తక్షణమే జరుగుతుంది.

  3. 3. డౌన్లోడ్ లేదా ప్లే చేయండి

    ఆడియోను_INLINE_లో ప్లే చేయండి లేదా దానిని WAV ఫైల్‌గా సేవ్ చేయండి. ఆడియో ఎప్పుడూ మీ పరికరాన్ని వదలదు.

మీ వచనం మీ పరికరంలోనే ఉంటుంది

సింథసిస్ వెబ్‌అసెంబ్లీని ఉపయోగించి మీ బ్రౌజర్‌లో పూర్తిగా నడుస్తుంది. వాయిస్ మోడల్ మరియు ఇన్‌ఫరెన్స్ రన్‌టైమ్‌ను పొందడానికి మాత్రమే నెట్‌వర్క్ అభ్యర్థనలు ఉంటాయి - రెండూ పబ్లిక్, స్టాటిక్ ఆస్తులు. మేము మీ వచనాన్ని చూడము మరియు మేము రూపొందించిన ఆడియోను చూడము.

మీ బ్రౌజర్‌లో Mandarin వాయిస్ ఎలా నడుస్తుంది

ఇది మీ స్వంత మెషీన్‌లో అమలు చేయబడే నిజమైన న్యూరల్ TTS మోడల్, హోస్ట్ చేసిన API కోసం సన్నని క్లయింట్ కాదు. నాలుగు భాగాలు దీన్ని ఒక ట్యాబ్‌లో సాధ్యం చేస్తాయి.

Open-source neural voice
మీరు సింథసైజ్ చేసే ప్రతిదానిలో యాస మరియు డెలివరీ స్థిరంగా ఉండటానికి కారణం, Mandarin మోడల్ ఒకే స్పీకర్‌పై శిక్షణ పొందింది.
WebAssembly
మోడల్ రన్‌టైమ్ మరియు 普通话 వచనాన్ని ఫోనెమ్‌లుగా మార్చే దశ రెండూ వెబ్‌అసెంబ్లీకి కంపైల్ చేయబడ్డాయి, కాబట్టి డెస్క్‌టాప్ కోసం వ్రాసిన కోడ్ బ్రౌజర్ శాండ్‌బాక్స్‌లో స్థానిక వేగానికి దగ్గరగా నడుస్తుంది.
On-device inference
మోడల్ యొక్క న్యూరల్ నెట్‌వర్క్ స్థానికంగా అమలు చేయబడుతుంది, సింగిల్-థ్రెడెడ్ మోడ్‌కు పిన్ చేయబడింది, కాబట్టి పేజీకి క్రాస్-ఒరిజిన్ ఐసోలేషన్ అవసరం లేదు మరియు ప్రతి ఆధునిక బ్రౌజర్‌లో పని చేస్తుంది.
Origin Private File System
మొదటిసారి రన్ అయిన తర్వాత ~60 MB వాయిస్ మోడల్ ప్రైవేట్, పర్-ఒరిజిన్ స్టోర్‌లో కాష్ చేయబడుతుంది. తర్వాత సందర్శనలు డౌన్‌లోడ్‌ను దాటవేసి, నెట్‌వర్క్ లేకుండానే సింథసైజ్ చేస్తాయి.
ప్రసార-నాణ్యత గల వాయిస్‌లు కావాలా?

Subformer Voice Synthesis - స్టూడియో-గ్రేడ్ Mandarin TTS

పై ఉచిత బ్రౌజర్‌లో పనిచేసే సాధనం ముసాయిదాలు మరియు ప్రివ్యూల కోసం చాలా ఉపయోగకరం, కానీ ఓపెన్-సోర్స్ వాయిస్ స్పష్టంగా కృత్రిమంగా వినిపిస్తుంది. Subformer's చెల్లింపుతో లభించే Voice Synthesis సహజమైన, ప్రసార-నాణ్యత గల ఆడియోని ఐచ్ఛిక వాయిస్ క్లోనింగ్‌తో ఉత్పత్తి చేస్తుంది.

Subformer వాయిస్ సింథసిస్‌ని ప్రయత్నించండి
ప్రీమియం - Subformer నుంచి కూడా

తరచుగా అడిగే ప్రశ్నలు

ఇతర ఉచిత TTS భాషలను ప్రయత్నించండి

వాయిస్‌లు Piper ద్వారా సంఖ్యామయ్యంగా నడిపించబడుతాయి. వాయిస్ వెయిట్స్ MIT లైసెన్స్ (rhasspy/piper-voices) కింద ఉన్నాయి. ఫోనెమైజర్ wasm రన్‌టైమ్‌లో పబ్లిక్ CDN నుండి లోడ్ అవుతుంది మరియు ఈ సైట్ పంపిణీలో భాగం కాదు.