Subformer
ఉచితం · సైన్‌అప్ అవసరం లేదు · మీ బ్రౌజర్లో నడుస్తుంది

ఉచితం Catalan టెక్స్ట్-టు-స్పీచ్

Català

Catalan టెక్స్ట్‌ని టైప్ చేయండి లేదా పేస్ట్ చేసి దాన్ని వినండి - ఇవన్నీ మీ బ్రౌజర్లోనే, సైన్ అప్ అవసరం లేకుండా. వాయిస్ మోడల్ ఒకసారి (~60 MB) డౌన్‌లోడ్ చేసి స్థానికంగా క్యాష్ చేయబడుతుంది, అందువల్ల తరువాతి రన్‌లు వెంటనే మరియు ఆఫ్‌లైన్‌లో పనిచేస్తాయి.

ఇది ఎలా పని చేస్తుంది

  1. 1. మీ టెక్స్ట్ టైప్ చేయండి

    ఏైనా Catalan టెక్స్ట్‌ను పేస్ట్ చేయండి లేదా టైప్ చేయండి - విరామ చిహ్నాలు మరియు లైన్ బ్రేక్‌లు గౌరవించబడతాయి

  2. 2. సృష్టించండి

    మొదటి క్లిక్ ~60 MB వాయిస్ మోడల్‌ని మీ బ్రౌజర్‌కు డౌన్లోడ్ చేస్తుంది. ఆ తర్వాత, సింథసిస్ తక్షణమే జరుగుతుంది.

  3. 3. డౌన్లోడ్ లేదా ప్లే చేయండి

    ఆడియోను_INLINE_లో ప్లే చేయండి లేదా దానిని WAV ఫైల్‌గా సేవ్ చేయండి. ఆడియో ఎప్పుడూ మీ పరికరాన్ని వదలదు.

మీ వచనం మీ పరికరంలోనే ఉంటుంది

సింథసిస్ వెబ్‌అసెంబ్లీని ఉపయోగించి మీ బ్రౌజర్‌లో పూర్తిగా నడుస్తుంది. వాయిస్ మోడల్ మరియు ఇన్‌ఫరెన్స్ రన్‌టైమ్‌ను పొందడానికి మాత్రమే నెట్‌వర్క్ అభ్యర్థనలు ఉంటాయి - రెండూ పబ్లిక్, స్టాటిక్ ఆస్తులు. మేము మీ వచనాన్ని చూడము మరియు మేము రూపొందించిన ఆడియోను చూడము.

మీ బ్రౌజర్‌లో Catalan వాయిస్ ఎలా నడుస్తుంది

ఇది మీ స్వంత మెషీన్‌లో అమలు చేయబడే నిజమైన న్యూరల్ TTS మోడల్, హోస్ట్ చేసిన API కోసం సన్నని క్లయింట్ కాదు. నాలుగు భాగాలు దీన్ని ఒక ట్యాబ్‌లో సాధ్యం చేస్తాయి.

Open-source neural voice
మీరు సింథసైజ్ చేసే ప్రతిదానిలో యాస మరియు డెలివరీ స్థిరంగా ఉండటానికి కారణం, Catalan మోడల్ ఒకే స్పీకర్‌పై శిక్షణ పొందింది.
WebAssembly
మోడల్ రన్‌టైమ్ మరియు Català వచనాన్ని ఫోనెమ్‌లుగా మార్చే దశ రెండూ వెబ్‌అసెంబ్లీకి కంపైల్ చేయబడ్డాయి, కాబట్టి డెస్క్‌టాప్ కోసం వ్రాసిన కోడ్ బ్రౌజర్ శాండ్‌బాక్స్‌లో స్థానిక వేగానికి దగ్గరగా నడుస్తుంది.
On-device inference
మోడల్ యొక్క న్యూరల్ నెట్‌వర్క్ స్థానికంగా అమలు చేయబడుతుంది, సింగిల్-థ్రెడెడ్ మోడ్‌కు పిన్ చేయబడింది, కాబట్టి పేజీకి క్రాస్-ఒరిజిన్ ఐసోలేషన్ అవసరం లేదు మరియు ప్రతి ఆధునిక బ్రౌజర్‌లో పని చేస్తుంది.
Origin Private File System
మొదటిసారి రన్ అయిన తర్వాత ~60 MB వాయిస్ మోడల్ ప్రైవేట్, పర్-ఒరిజిన్ స్టోర్‌లో కాష్ చేయబడుతుంది. తర్వాత సందర్శనలు డౌన్‌లోడ్‌ను దాటవేసి, నెట్‌వర్క్ లేకుండానే సింథసైజ్ చేస్తాయి.
ప్రసార-నాణ్యత గల వాయిస్‌లు కావాలా?

Subformer Voice Synthesis - స్టూడియో-గ్రేడ్ Catalan TTS

పై ఉచిత బ్రౌజర్‌లో పనిచేసే సాధనం ముసాయిదాలు మరియు ప్రివ్యూల కోసం చాలా ఉపయోగకరం, కానీ ఓపెన్-సోర్స్ వాయిస్ స్పష్టంగా కృత్రిమంగా వినిపిస్తుంది. Subformer's చెల్లింపుతో లభించే Voice Synthesis సహజమైన, ప్రసార-నాణ్యత గల ఆడియోని ఐచ్ఛిక వాయిస్ క్లోనింగ్‌తో ఉత్పత్తి చేస్తుంది.

Subformer వాయిస్ సింథసిస్‌ని ప్రయత్నించండి
ప్రీమియం - Subformer నుంచి కూడా

తరచుగా అడిగే ప్రశ్నలు

ఇతర ఉచిత TTS భాషలను ప్రయత్నించండి

వాయిస్‌లు Piper ద్వారా సంఖ్యామయ్యంగా నడిపించబడుతాయి. వాయిస్ వెయిట్స్ MIT లైసెన్స్ (rhasspy/piper-voices) కింద ఉన్నాయి. ఫోనెమైజర్ wasm రన్‌టైమ్‌లో పబ్లిక్ CDN నుండి లోడ్ అవుతుంది మరియు ఈ సైట్ పంపిణీలో భాగం కాదు.