Subformer
အခမဲ့ · စာရင်းသွင်းရန် မလို · ဘရောက်ဇာ၌ လည်ပတ်သည်

အခမဲ့ Swahili စာသားမှ အသံပြောင်း

Kiswahili

Swahili စာသားကို ရိုတ်ထည့် သို့မဟုတ် ကူးထည့်ပြီး စကားပြောထင်ရှားမှုကို ကြားပါ - အားလုံးကို သင့်ဘရောက်ဇာတွင် လုပ်ဆောင်နိုင်ပြီး စာရင်းသွင်းရန် မလိုအပ်ပါ။ အသံမော်ဒယ်ကို တစ်ကြိမ်သာ ဒေါင်းလုဒ်ဆွဲပြီး (~60 MB) ဒေသစံပယ်တွင် ကက်ရှ် ထားသောကြောင့် နောက်ပိုင်း အသုံးပြုမှုများသည် ခဏအချိန်တွင် ပြီးမြောက်ပြီး အော့ဖ်လိုင်းတွင်လည်း လည်ပတ်နိုင်သည်။

လုပ်ဆောင်ပုံ

  1. 1. သင့်စာသားကို ရိုက်ထည့်ပါ

    မည်သည့် Swahili စာသားကိုမဆို ကူးထည့် သို့မဟုတ် ရိုက်ထည့်ပါ - ကန့်သတ်ချက်များနှင့် စာကြောင်းခွဲများကို ထိန်းသိမ်းထားပါသည်။

  2. 2. ဖန်တီးပါ

    ပထမဆုံး နှိပ်လျှင် ~60 MB အရွယ်ရှိ အသံမော်ဒယ်ကို သင့်ဘရောက်ဇာသို့ ဒေါင်းလုတ်ဆွဲမည်။ ထို့နောက် အသံဖန်တီးခြင်းသည် ချက်ချင်း ဖြစ်သည်။

  3. 3. ဒေါင်းလုတ်ရယူ သို့မဟုတ် နားထောင်ပါ

    အသံကို တိုက်ရိုက် နားထောင်ရန် သို့မဟုတ် WAV ဖိုင်အဖြစ် သိမ်းဆည်းရန်။ အသံသည် သင့်ကိရိယာမှ မထွက်ပါ။

သင်၏စာသားသည် သင့်စက်ပစ္စည်းပေါ်တွင်သာရှိနေပါသည်

ပေါင်းစပ်ဖန်တီးခြင်းသည် WebAssembly ကိုအသုံးပြု၍ သင့်ဘရောက်ဆာတွင် လုံးဝလုပ်ဆောင်ပါသည်။ တစ်ခုတည်းသော network တောင်းဆိုမှုများမှာ အသံမော်ဒယ်နှင့် inference runtime ကို ရယူရန်ဖြစ်သည် - နှစ်ခုလုံးသည် အများပြည်သူသုံး၊ static ပိုင်ဆိုင်မှုများဖြစ်ပါသည်။ ကျွန်ုပ်တို့သည် သင့်စာသားကို မမြင်ရဘဲ ဖန်တီးထားသော အသံကိုလည်း မမြင်ရပါ။

သင့်ဘရောက်ဆာတွင် Swahili အသံ လုပ်ဆောင်ပုံ

၎င်းသည် သင့်ကိုယ်ပိုင်စက်တွင် လုပ်ဆောင်နေသော စစ်မှန်သော neural TTS မော်ဒယ်ဖြစ်ပြီး hosted API အတွက် thin client မဟုတ်ပါ။ အချက်လေးချက်က ၎င်းကို tab တွင် ဖြစ်နိုင်စေသည်။

Open-source neural voice
Swahili မော်ဒယ်ကို စပီကာတစ်ဦးတည်းဖြင့် လေ့ကျင့်ထားသောကြောင့် သင်ပေါင်းစပ်ဖန်တီးသည့် အရာအားလုံးတွင် လေယူလေသိမ်းနှင့် ပေးပို့မှုသည် တသမတ်တည်းရှိနေပါသည်။
WebAssembly
မော်ဒယ် လုပ်ဆောင်ချိန်နှင့် Kiswahili စာသားကို အသံထွက်အက္ခရာများအဖြစ် ပြောင်းလဲသည့် အဆင့်နှစ်ခုလုံးကို WebAssembly သို့ စုစည်းထားသောကြောင့် မူလက desktop အတွက် ရေးသားထားသော ကုဒ်သည် ဘရောက်ဆာ sandbox အတွင်း၌ မူရင်းအမြန်နှုန်းနီးပါးဖြင့် လုပ်ဆောင်ပါသည်။
On-device inference
မော်ဒယ်၏ neural network ကို ပြည်တွင်း၌ လုပ်ဆောင်ပြီး single-threaded mode သို့ ချိတ်ထားသောကြောင့် စာမျက်နှာသည် cross-origin isolation မလိုအပ်ဘဲ ခေတ်မီဘရောက်ဆာတိုင်းတွင် အလုပ်လုပ်ပါသည်။
Origin Private File System
~60 MB အသံမော်ဒယ်ကို ပထမဆုံးအကြိမ်အသုံးပြုပြီးနောက် သီးသန့်၊ မူရင်းအလိုက် သိုလှောင်မှုတွင် သိမ်းဆည်းထားသည်။ နောက်ပိုင်းအသုံးပြုမှုများတွင် ဒေါင်းလုဒ်လုပ်ရန်မလိုဘဲ ကွန်ရက်မရှိဘဲ အသံထုတ်လုပ်နိုင်သည်။
ထုတ်လွှင့်စံနှုန်း အရည်အသွေးရှိ သံများ လိုပါသလား?

Subformer Voice Synthesis - စတူဒီယိုအဆင့် Swahili TTS

အထက်ပါ ဘရော်ဇာအတွင်း အခမဲ့ ကိရိယာသည် မူကြမ်းနှင့် ကြိုကြည့်ခြင်းများအတွက် သင့်တော်သော်လည်း၊ ဖွင့်လင်းရင်းမြစ် (open-source) အသံသည် သိသာစွာ စက်လက်သံကဲ့သို့ ကြားရသည်။ Subformer ၏ ငွေပေးချေရသော Voice Synthesis သည် သဘာဝကျပြီး ထုတ်လွှင့်စံအရည်အသွေးရှိ အော်ဒီယိုကို ပေးဆောင်နိုင်ပြီး၊ လိုလျှင် အသံမိတ္တူ ဖန်တီးနိုင်သည်။

Subformer Voice Synthesis ကို စမ်းသပ်ပါ
ပရီမီယမ် - Subformer မှလည်း

မကြာခဏမေးလေ့ရှိသောမေးခွန်းများ

အခြား အခမဲ့ TTS ဘာသာစကားများကို စမ်းကြည့်ပါ

အသံများကို Piper ဖြင့် စွမ်းအားဖြည့်ထားသည်။ Voice weights များမှာ MIT လိုင်စင်ဖြင့် ကာကွယ်ထားပါသည် (rhasspy/piper-voices)။ phonemizer wasm သည် runtime တွင် ပွင့်လင်း CDN မှ မိနစ်ပိုင်းကာ ဒေါင်းလုတ်ဆွဲလာပြီး ဤဆိုဒ်၏ ဖြန့်ချိမှုတွင် ပါဝင်ခြင်း မရှိပါ။