Subformer
ఉచితం · సైన్‌అప్ అవసరం లేదు · మీ బ్రౌజర్లో నడుస్తుంది

ఉచితం English టెక్స్ట్-టు-స్పీచ్

English

English టెక్స్ట్‌ని టైప్ చేయండి లేదా పేస్ట్ చేసి దాన్ని వినండి - ఇవన్నీ మీ బ్రౌజర్లోనే, సైన్ అప్ అవసరం లేకుండా. వాయిస్ మోడల్ ఒకసారి (~60 MB) డౌన్‌లోడ్ చేసి స్థానికంగా క్యాష్ చేయబడుతుంది, అందువల్ల తరువాతి రన్‌లు వెంటనే మరియు ఆఫ్‌లైన్‌లో పనిచేస్తాయి.

ఇది ఎలా పని చేస్తుంది

  1. 1. మీ టెక్స్ట్ టైప్ చేయండి

    ఏైనా English టెక్స్ట్‌ను పేస్ట్ చేయండి లేదా టైప్ చేయండి - విరామ చిహ్నాలు మరియు లైన్ బ్రేక్‌లు గౌరవించబడతాయి

  2. 2. సృష్టించండి

    మొదటి క్లిక్ ~60 MB వాయిస్ మోడల్‌ని మీ బ్రౌజర్‌కు డౌన్లోడ్ చేస్తుంది. ఆ తర్వాత, సింథసిస్ తక్షణమే జరుగుతుంది.

  3. 3. డౌన్లోడ్ లేదా ప్లే చేయండి

    ఆడియోను_INLINE_లో ప్లే చేయండి లేదా దానిని WAV ఫైల్‌గా సేవ్ చేయండి. ఆడియో ఎప్పుడూ మీ పరికరాన్ని వదలదు.

మీ వచనం మీ పరికరంలోనే ఉంటుంది

సింథసిస్ వెబ్‌అసెంబ్లీని ఉపయోగించి మీ బ్రౌజర్‌లో పూర్తిగా నడుస్తుంది. వాయిస్ మోడల్ మరియు ఇన్‌ఫరెన్స్ రన్‌టైమ్‌ను పొందడానికి మాత్రమే నెట్‌వర్క్ అభ్యర్థనలు ఉంటాయి - రెండూ పబ్లిక్, స్టాటిక్ ఆస్తులు. మేము మీ వచనాన్ని చూడము మరియు మేము రూపొందించిన ఆడియోను చూడము.

మీ బ్రౌజర్‌లో English వాయిస్ ఎలా నడుస్తుంది

ఇది మీ స్వంత మెషీన్‌లో అమలు చేయబడే నిజమైన న్యూరల్ TTS మోడల్, హోస్ట్ చేసిన API కోసం సన్నని క్లయింట్ కాదు. నాలుగు భాగాలు దీన్ని ఒక ట్యాబ్‌లో సాధ్యం చేస్తాయి.

Open-source neural voice
మీరు సింథసైజ్ చేసే ప్రతిదానిలో యాస మరియు డెలివరీ స్థిరంగా ఉండటానికి కారణం, English మోడల్ ఒకే స్పీకర్‌పై శిక్షణ పొందింది.
WebAssembly
మోడల్ రన్‌టైమ్ మరియు English వచనాన్ని ఫోనెమ్‌లుగా మార్చే దశ రెండూ వెబ్‌అసెంబ్లీకి కంపైల్ చేయబడ్డాయి, కాబట్టి డెస్క్‌టాప్ కోసం వ్రాసిన కోడ్ బ్రౌజర్ శాండ్‌బాక్స్‌లో స్థానిక వేగానికి దగ్గరగా నడుస్తుంది.
On-device inference
మోడల్ యొక్క న్యూరల్ నెట్‌వర్క్ స్థానికంగా అమలు చేయబడుతుంది, సింగిల్-థ్రెడెడ్ మోడ్‌కు పిన్ చేయబడింది, కాబట్టి పేజీకి క్రాస్-ఒరిజిన్ ఐసోలేషన్ అవసరం లేదు మరియు ప్రతి ఆధునిక బ్రౌజర్‌లో పని చేస్తుంది.
Origin Private File System
మొదటిసారి రన్ అయిన తర్వాత ~60 MB వాయిస్ మోడల్ ప్రైవేట్, పర్-ఒరిజిన్ స్టోర్‌లో కాష్ చేయబడుతుంది. తర్వాత సందర్శనలు డౌన్‌లోడ్‌ను దాటవేసి, నెట్‌వర్క్ లేకుండానే సింథసైజ్ చేస్తాయి.
ప్రసార-నాణ్యత గల వాయిస్‌లు కావాలా?

Subformer Voice Synthesis - స్టూడియో-గ్రేడ్ English TTS

పై ఉచిత బ్రౌజర్‌లో పనిచేసే సాధనం ముసాయిదాలు మరియు ప్రివ్యూల కోసం చాలా ఉపయోగకరం, కానీ ఓపెన్-సోర్స్ వాయిస్ స్పష్టంగా కృత్రిమంగా వినిపిస్తుంది. Subformer's చెల్లింపుతో లభించే Voice Synthesis సహజమైన, ప్రసార-నాణ్యత గల ఆడియోని ఐచ్ఛిక వాయిస్ క్లోనింగ్‌తో ఉత్పత్తి చేస్తుంది.

Subformer వాయిస్ సింథసిస్‌ని ప్రయత్నించండి
ప్రీమియం - Subformer నుంచి కూడా

తరచుగా అడిగే ప్రశ్నలు

ఇతర ఉచిత TTS భాషలను ప్రయత్నించండి

వాయిస్‌లు Piper ద్వారా సంఖ్యామయ్యంగా నడిపించబడుతాయి. వాయిస్ వెయిట్స్ MIT లైసెన్స్ (rhasspy/piper-voices) కింద ఉన్నాయి. ఫోనెమైజర్ wasm రన్‌టైమ్‌లో పబ్లిక్ CDN నుండి లోడ్ అవుతుంది మరియు ఈ సైట్ పంపిణీలో భాగం కాదు.