Subformer
ఉచితం · సైన్‌అప్ అవసరం లేదు · మీ బ్రౌజర్లో నడుస్తుంది

ఉచితం Farsi టెక్స్ట్-టు-స్పీచ్

فارسی

Farsi టెక్స్ట్‌ని టైప్ చేయండి లేదా పేస్ట్ చేసి దాన్ని వినండి - ఇవన్నీ మీ బ్రౌజర్లోనే, సైన్ అప్ అవసరం లేకుండా. వాయిస్ మోడల్ ఒకసారి (~61 MB) డౌన్‌లోడ్ చేసి స్థానికంగా క్యాష్ చేయబడుతుంది, అందువల్ల తరువాతి రన్‌లు వెంటనే మరియు ఆఫ్‌లైన్‌లో పనిచేస్తాయి.

ఇది ఎలా పని చేస్తుంది

  1. 1. మీ టెక్స్ట్ టైప్ చేయండి

    ఏైనా Farsi టెక్స్ట్‌ను పేస్ట్ చేయండి లేదా టైప్ చేయండి - విరామ చిహ్నాలు మరియు లైన్ బ్రేక్‌లు గౌరవించబడతాయి

  2. 2. సృష్టించండి

    మొదటి క్లిక్ ~61 MB వాయిస్ మోడల్‌ని మీ బ్రౌజర్‌కు డౌన్లోడ్ చేస్తుంది. ఆ తర్వాత, సింథసిస్ తక్షణమే జరుగుతుంది.

  3. 3. డౌన్లోడ్ లేదా ప్లే చేయండి

    ఆడియోను_INLINE_లో ప్లే చేయండి లేదా దానిని WAV ఫైల్‌గా సేవ్ చేయండి. ఆడియో ఎప్పుడూ మీ పరికరాన్ని వదలదు.

మీ వచనం మీ పరికరంలోనే ఉంటుంది

సింథసిస్ వెబ్‌అసెంబ్లీని ఉపయోగించి మీ బ్రౌజర్‌లో పూర్తిగా నడుస్తుంది. వాయిస్ మోడల్ మరియు ఇన్‌ఫరెన్స్ రన్‌టైమ్‌ను పొందడానికి మాత్రమే నెట్‌వర్క్ అభ్యర్థనలు ఉంటాయి - రెండూ పబ్లిక్, స్టాటిక్ ఆస్తులు. మేము మీ వచనాన్ని చూడము మరియు మేము రూపొందించిన ఆడియోను చూడము.

మీ బ్రౌజర్‌లో Farsi వాయిస్ ఎలా నడుస్తుంది

ఇది మీ స్వంత మెషీన్‌లో అమలు చేయబడే నిజమైన న్యూరల్ TTS మోడల్, హోస్ట్ చేసిన API కోసం సన్నని క్లయింట్ కాదు. నాలుగు భాగాలు దీన్ని ఒక ట్యాబ్‌లో సాధ్యం చేస్తాయి.

Open-source neural voice
మీరు సింథసైజ్ చేసే ప్రతిదానిలో యాస మరియు డెలివరీ స్థిరంగా ఉండటానికి కారణం, Farsi మోడల్ ఒకే స్పీకర్‌పై శిక్షణ పొందింది.
WebAssembly
మోడల్ రన్‌టైమ్ మరియు فارسی వచనాన్ని ఫోనెమ్‌లుగా మార్చే దశ రెండూ వెబ్‌అసెంబ్లీకి కంపైల్ చేయబడ్డాయి, కాబట్టి డెస్క్‌టాప్ కోసం వ్రాసిన కోడ్ బ్రౌజర్ శాండ్‌బాక్స్‌లో స్థానిక వేగానికి దగ్గరగా నడుస్తుంది.
On-device inference
మోడల్ యొక్క న్యూరల్ నెట్‌వర్క్ స్థానికంగా అమలు చేయబడుతుంది, సింగిల్-థ్రెడెడ్ మోడ్‌కు పిన్ చేయబడింది, కాబట్టి పేజీకి క్రాస్-ఒరిజిన్ ఐసోలేషన్ అవసరం లేదు మరియు ప్రతి ఆధునిక బ్రౌజర్‌లో పని చేస్తుంది.
Origin Private File System
మొదటిసారి రన్ అయిన తర్వాత ~61 MB వాయిస్ మోడల్ ప్రైవేట్, పర్-ఒరిజిన్ స్టోర్‌లో కాష్ చేయబడుతుంది. తర్వాత సందర్శనలు డౌన్‌లోడ్‌ను దాటవేసి, నెట్‌వర్క్ లేకుండానే సింథసైజ్ చేస్తాయి.
ప్రసార-నాణ్యత గల వాయిస్‌లు కావాలా?

Subformer Voice Synthesis - స్టూడియో-గ్రేడ్ Farsi TTS

పై ఉచిత బ్రౌజర్‌లో పనిచేసే సాధనం ముసాయిదాలు మరియు ప్రివ్యూల కోసం చాలా ఉపయోగకరం, కానీ ఓపెన్-సోర్స్ వాయిస్ స్పష్టంగా కృత్రిమంగా వినిపిస్తుంది. Subformer's చెల్లింపుతో లభించే Voice Synthesis సహజమైన, ప్రసార-నాణ్యత గల ఆడియోని ఐచ్ఛిక వాయిస్ క్లోనింగ్‌తో ఉత్పత్తి చేస్తుంది.

Subformer వాయిస్ సింథసిస్‌ని ప్రయత్నించండి
ప్రీమియం - Subformer నుంచి కూడా

తరచుగా అడిగే ప్రశ్నలు

ఇతర ఉచిత TTS భాషలను ప్రయత్నించండి

వాయిస్‌లు Piper ద్వారా సంఖ్యామయ్యంగా నడిపించబడుతాయి. వాయిస్ వెయిట్స్ MIT లైసెన్స్ (rhasspy/piper-voices) కింద ఉన్నాయి. ఫోనెమైజర్ wasm రన్‌టైమ్‌లో పబ్లిక్ CDN నుండి లోడ్ అవుతుంది మరియు ఈ సైట్ పంపిణీలో భాగం కాదు.