Subformer
ఉచితం · సైన్‌అప్ అవసరం లేదు · మీ బ్రౌజర్లో నడుస్తుంది

ఉచితం Kazakh టెక్స్ట్-టు-స్పీచ్

Қазақ тілі

Kazakh టెక్స్ట్‌ని టైప్ చేయండి లేదా పేస్ట్ చేసి దాన్ని వినండి - ఇవన్నీ మీ బ్రౌజర్లోనే, సైన్ అప్ అవసరం లేకుండా. వాయిస్ మోడల్ ఒకసారి (~122 MB) డౌన్‌లోడ్ చేసి స్థానికంగా క్యాష్ చేయబడుతుంది, అందువల్ల తరువాతి రన్‌లు వెంటనే మరియు ఆఫ్‌లైన్‌లో పనిచేస్తాయి.

ఇది ఎలా పని చేస్తుంది

  1. 1. మీ టెక్స్ట్ టైప్ చేయండి

    ఏైనా Kazakh టెక్స్ట్‌ను పేస్ట్ చేయండి లేదా టైప్ చేయండి - విరామ చిహ్నాలు మరియు లైన్ బ్రేక్‌లు గౌరవించబడతాయి

  2. 2. సృష్టించండి

    మొదటి క్లిక్ ~122 MB వాయిస్ మోడల్‌ని మీ బ్రౌజర్‌కు డౌన్లోడ్ చేస్తుంది. ఆ తర్వాత, సింథసిస్ తక్షణమే జరుగుతుంది.

  3. 3. డౌన్లోడ్ లేదా ప్లే చేయండి

    ఆడియోను_INLINE_లో ప్లే చేయండి లేదా దానిని WAV ఫైల్‌గా సేవ్ చేయండి. ఆడియో ఎప్పుడూ మీ పరికరాన్ని వదలదు.

మీ వచనం మీ పరికరంలోనే ఉంటుంది

సింథసిస్ వెబ్‌అసెంబ్లీని ఉపయోగించి మీ బ్రౌజర్‌లో పూర్తిగా నడుస్తుంది. వాయిస్ మోడల్ మరియు ఇన్‌ఫరెన్స్ రన్‌టైమ్‌ను పొందడానికి మాత్రమే నెట్‌వర్క్ అభ్యర్థనలు ఉంటాయి - రెండూ పబ్లిక్, స్టాటిక్ ఆస్తులు. మేము మీ వచనాన్ని చూడము మరియు మేము రూపొందించిన ఆడియోను చూడము.

మీ బ్రౌజర్‌లో Kazakh వాయిస్ ఎలా నడుస్తుంది

ఇది మీ స్వంత మెషీన్‌లో అమలు చేయబడే నిజమైన న్యూరల్ TTS మోడల్, హోస్ట్ చేసిన API కోసం సన్నని క్లయింట్ కాదు. నాలుగు భాగాలు దీన్ని ఒక ట్యాబ్‌లో సాధ్యం చేస్తాయి.

Open-source neural voice
మీరు సింథసైజ్ చేసే ప్రతిదానిలో యాస మరియు డెలివరీ స్థిరంగా ఉండటానికి కారణం, Kazakh మోడల్ ఒకే స్పీకర్‌పై శిక్షణ పొందింది.
WebAssembly
మోడల్ రన్‌టైమ్ మరియు Қазақ тілі వచనాన్ని ఫోనెమ్‌లుగా మార్చే దశ రెండూ వెబ్‌అసెంబ్లీకి కంపైల్ చేయబడ్డాయి, కాబట్టి డెస్క్‌టాప్ కోసం వ్రాసిన కోడ్ బ్రౌజర్ శాండ్‌బాక్స్‌లో స్థానిక వేగానికి దగ్గరగా నడుస్తుంది.
On-device inference
మోడల్ యొక్క న్యూరల్ నెట్‌వర్క్ స్థానికంగా అమలు చేయబడుతుంది, సింగిల్-థ్రెడెడ్ మోడ్‌కు పిన్ చేయబడింది, కాబట్టి పేజీకి క్రాస్-ఒరిజిన్ ఐసోలేషన్ అవసరం లేదు మరియు ప్రతి ఆధునిక బ్రౌజర్‌లో పని చేస్తుంది.
Origin Private File System
మొదటిసారి రన్ అయిన తర్వాత ~122 MB వాయిస్ మోడల్ ప్రైవేట్, పర్-ఒరిజిన్ స్టోర్‌లో కాష్ చేయబడుతుంది. తర్వాత సందర్శనలు డౌన్‌లోడ్‌ను దాటవేసి, నెట్‌వర్క్ లేకుండానే సింథసైజ్ చేస్తాయి.
ప్రసార-నాణ్యత గల వాయిస్‌లు కావాలా?

Subformer Voice Synthesis - స్టూడియో-గ్రేడ్ Kazakh TTS

పై ఉచిత బ్రౌజర్‌లో పనిచేసే సాధనం ముసాయిదాలు మరియు ప్రివ్యూల కోసం చాలా ఉపయోగకరం, కానీ ఓపెన్-సోర్స్ వాయిస్ స్పష్టంగా కృత్రిమంగా వినిపిస్తుంది. Subformer's చెల్లింపుతో లభించే Voice Synthesis సహజమైన, ప్రసార-నాణ్యత గల ఆడియోని ఐచ్ఛిక వాయిస్ క్లోనింగ్‌తో ఉత్పత్తి చేస్తుంది.

Subformer వాయిస్ సింథసిస్‌ని ప్రయత్నించండి
ప్రీమియం - Subformer నుంచి కూడా

తరచుగా అడిగే ప్రశ్నలు

ఇతర ఉచిత TTS భాషలను ప్రయత్నించండి

వాయిస్‌లు Piper ద్వారా సంఖ్యామయ్యంగా నడిపించబడుతాయి. వాయిస్ వెయిట్స్ MIT లైసెన్స్ (rhasspy/piper-voices) కింద ఉన్నాయి. ఫోనెమైజర్ wasm రన్‌టైమ్‌లో పబ్లిక్ CDN నుండి లోడ్ అవుతుంది మరియు ఈ సైట్ పంపిణీలో భాగం కాదు.