Subformer
મફત · કોઈ સાઈનઅપ નથી · તમારા બ્રાઉઝરમાં ચાલે છે

મફત Kazakh 텍્સ્ટ-ટુ-સ્પીચ

Қазақ тілі

ટાઇપ કરો અથવા પેસ્ટ કરો Kazakh ટેક્સ્ટ અને તેને બોલતા સાંભળો - બધું તમારા બ્રાઉઝરમાં, કોઈ સાઇનઅપ વગર. વોઈસ મોડેલ એક વાર (~122 MB) ડાઉનલોડ થાય છે અને લોકલી કૅશ થાય છે, તેથી પછીના રન તરત અને ઑફલાઇન કામ કરે છે.

તે કેવી રીતે કામ કરે છે

  1. 1. તમારું લખાણ ટાઇપ કરો

    પેસ્ટ કરો અથવા કોઈપણ Kazakh લખો/ટાઇપ કરો - વિરામચિહ્નો અને લાઇન બ્રેક્સ જાળવવામાં આવે છે.

  2. 2. જનરેટ કરો

    પ્રથમ ક્લિક ~122 MB વોઈસ મોડેલ તમારા બ્રાઉઝરમાં ડાઉનલોડ કરે છે. ત્યારબાદ સિન્થેસિસ તરત થાય છે.

  3. 3. ડાઉનલોડ કરો અથવા પ્લે કરો

    ઓડિયોને ઇનલાઇન માં ચલાવો અથવા તેને WAV ફાઇલ તરીકે સેફ કરો. ઓડિયો ક્યારેય તમારા ઉપકરણની બહાર નથી.

તમારો લખાણ તમારા ઉપકરણ પર જ રહે છે

સિન્થેસિસ વેબઅસેમ્બલીનો ઉપયોગ કરીને સંપૂર્ણપણે તમારા બ્રાઉઝરમાં ચાલે છે. એકમાત્ર નેટવર્ક વિનંતીઓ વોઈસ મોડેલ અને ઇન્ફરન્સ રનટાઈમ મેળવવા માટે છે - બંને સાર્વજનિક, સ્થિર સંપત્તિઓ છે. અમે તમારો ટેક્સ્ટ જોતા નથી અને અમે જનરેટ થયેલ ઓડિયો જોતા નથી.

તમારા બ્રાઉઝરમાં Kazakh વોઈસ કેવી રીતે ચાલે છે

આ એક વાસ્તવિક ન્યુરલ TTS મોડેલ છે જે તમારી પોતાની મશીન પર ચાલે છે, હોસ્ટેડ API માટે પાતળો ક્લાયંટ નથી. ચાર ભાગો તેને ટેબમાં શક્ય બનાવે છે.

Open-source neural voice
Kazakh મોડેલ એક જ સ્પીકર પર તાલીમ પામેલું છે, તેથી જ તમે જે કંઈપણ સિન્થેસાઈઝ કરો છો તેમાં ઉચ્ચાર અને ડિલિવરી સુસંગત રહે છે.
WebAssembly
મોડેલ રનટાઈમ અને Қазақ тілі ટેક્સ્ટને ફોનિમ્સમાં રૂપાંતરિત કરતું પગલું બંને વેબઅસેમ્બલીમાં કમ્પાઈલ થયેલા છે, જેથી ડેસ્કટોપ માટે મૂળ રૂપે લખાયેલ કોડ બ્રાઉઝર સેન્ડબોક્સની અંદર લગભગ નેટિવ સ્પીડ પર ચાલે છે.
On-device inference
મોડેલનું ન્યુરલ નેટવર્ક સ્થાનિક રીતે ચલાવવામાં આવે છે, સિંગલ-થ્રેડેડ મોડ પર પિન કરેલું છે જેથી પૃષ્ઠને ક્યારેય ક્રોસ-ઓરિજિન આઇસોલેશનની જરૂર પડતી નથી અને તે દરેક આધુનિક બ્રાઉઝરમાં કામ કરે છે.
Origin Private File System
~122 MB વોઇસ મોડેલ પ્રથમ રન પછી ખાનગી, પ્રતિ-ઓરિજિન સ્ટોરમાં કેશ કરવામાં આવે છે. પછીની મુલાકાતો ડાઉનલોડ છોડી દે છે અને નેટવર્ક વિના જ સંશ્લેષણ કરે છે.
શું તમને પ્રસારણ-ગુણવત્તાવાળા અવાજો જોઈએ છે?

Subformer Voice Synthesis - સ્ટુડિયો-ગ્રેડ Kazakh TTS

ઉપરનો મફત બ્રાઉઝર-આધારિત ટૂલ ડ્રાફ્ટ અને પૂર્વદર્શન માટે ઉત્તમ છે, પરંતુ ઓપન-સોર્સ વૉઇસ નોંધપાત્ર રીતે કૃત્રિમ લાગે છે. Subformerની પેઇડ Voice Synthesis કુદરતી, પ્રસારણ-સ્તરના ઑડિયો ઉત્પન્ન કરે છે અને તેમાં વૈકલ્પિક વૉઇસ ક્લોનિંગ ઉપલબ્ધ છે.

Subformer Voice Synthesis અજમાવો
પ્રીમિયમ - Subformer તરફથી પણ

વારંવાર પૂછાતા પ્રશ્નો

અન્ય મફત TTS ભાષાઓ અજમાવો

વોઇસ Piper દ્વારા પ્રદાન કરવામાં આવે છે. વોઇસ વેઇટ્સ MIT લાઇસન્સ હેઠળ છે (rhasspy/piper-voices). ફોનેમાઇઝર wasm રનટાઇમ સમયે જાહેર CDNમાંથી લોડ થાય છે અને તે આ સાઇટના વિતરણનો ભાગ નથી.