Subformer
အခမဲ့ · စာရင်းသွင်းရန် မလို · ဘရောက်ဇာ၌ လည်ပတ်သည်

အခမဲ့ 35+ ဘာသာစကားများအတွက် အသံမှ စာသားပြောင်း

မည်သည့် အသံ သို့မဟုတ် ဗီဒီယို ဖိုင်ကိုမဆို ဆွဲထည့်၍ ဘာသာစကား ရွေးချယ်ပြီး အချိန်မှတ်တမ်းပါ ပြည့်စုံသော စာတမ်းကို ရယူပါ - အားလုံးကို သင်၏ ဘရောက်ဇာတွင် ပြုလုပ်နိုင်သည်။ မော်ဒယ်ကို တစ်ကြိမ် (~75 MB) ဒေါင်းယူပြီး ဒေသခံတွင် ကက်ရှ် ထိန်းသိမ်းထားသောကြောင့် နောက်ထပ်အသုံးပြုမှုများတွင် ခဏချင်း လည်ပတ်ပြီး အော့ဖ်လိုင်းဖြင့်လည်း အလုပ်လုပ်နိုင်သည်။

ပုံမှန်အနေဖြင့် ကိုယ်ပိုင် ဖြစ်သည်

အသိမှတ်ပြုမှုကို မိမိစက်ပေါ်တွင် လည်ပတ်သည်။ သင့်အသံသည် သင့်ကိရိယာမှ ထွက်သွားခြင်း မရှိပါ။

ပထမဆုံး ဒေါင်းလုတ်ပြီးနောက် ချက်ချင်း

မော်ဒယ်ကို သင့် ဘရောက်ဇာတွင် ကက်ရှ် ထည့်ထားပါသည်။ နောက်ထပ် အသုံးပြုမှုများကို အော့ဖ်လိုင်းတွင်လည်း လည်ပတ်နိုင်သည်။

အခမဲ့၊ စာရင်းဖွင့်ရန် မလို

အကောင့်မလို၊ ခရက်ဒစ်မလို၊ အသုံးမက်စံ မရှိ။ ဖွင့်ပြီး အသုံးပြုနိုင်သည်။

ဘာသာစကားရွေးချယ်ပါ

အတွင်းပိုင်းလုပ်ဆောင်ပုံ

အသံမှတ်မိစနစ်သည် ပုံမှန်အားဖြင့် သင့်အသံကို အခြားသူတစ်ဦး၏ GPU သို့ အပ်လုဒ်လုပ်ခြင်းကို ဆိုလိုပါသည်။ ဤနေရာတွင် မော်ဒယ်သည် သင့်ကိုယ်ပိုင်စက်တွင် လုပ်ဆောင်သောကြောင့် ကိရိယာကို အခမဲ့နှင့် တစ်ချိန်တည်းတွင် သီးသန့်ဖြစ်စေပါသည်။

Open-source recognition model
open-source အာရုံကြောစနစ်သုံး အသံမှတ်မိစနစ် မော်ဒယ်၏ ပမာဏသတ်မှတ်ထားသော တည်ဆောက်မှုတစ်ခုဖြစ်ပြီး တစ်ကြိမ်ဒေါင်းလုဒ်လုပ်ပြီး သင့်ဘရောက်ဆာတွင် သိမ်းထားနိုင်လောက်အောင် သေးငယ်ပါသည်။
WebAssembly
inference runtime ကို WebAssembly သို့ ပြောင်းလဲထားသောကြောင့် ဂဏန်းဆိုင်ရာ code များသည် plugin မပါဘဲ၊ ထည့်သွင်းစရာမလိုဘဲ sandboxed tab အတွင်းတွင် မူရင်းအမြန်နှုန်းနီးပါးဖြင့် အလုပ်လုပ်ပါသည်။
On-device inference
မော်ဒယ်ကို တင်ခြင်း၊ token အဖြစ်ပြောင်းလဲခြင်းနှင့် decoding loop ကို လုပ်ဆောင်ခြင်းတို့အားလုံးသည် client-side တွင် ဖြစ်ပေါ်ပါသည်။ စာမျက်နှာတင်ပြီးသည်နှင့် လုပ်ငန်းစဉ်၏ မည်သည့်အစိတ်အပိုင်းကမျှ ဆာဗာသို့ ခေါ်ဆိုခြင်းမရှိပါ။
Web Audio API
သင့်ဖိုင်ကို decode လုပ်ပြီး ဘရောက်ဆာ၏ ကိုယ်ပိုင် audio pipeline ကို အသုံးပြု၍ မော်ဒယ်မျှော်လင့်ထားသည့် 16 kHz mono သို့ ပြန်လည်နမူနာယူသည်။ ထို့ကြောင့် သင့်ဘရောက်ဆာဖွင့်နိုင်သည့် မည်သည့် format ကိုမဆို လက်ခံပါသည်။

လဲလှယ်ရမည့်အချက်မှာ မော်ဒယ်အရွယ်အစားဖြစ်သည်။ စက်ပစ္စည်းပေါ်ရှိ weights များသည် hosted service တစ်ခုမှ လုပ်ဆောင်သည့်အရာ၏ အစိတ်အပိုင်းတစ်ခုသာဖြစ်သောကြောင့် ဆူညံသောအသံ၊ ပြင်းထန်သောလေယူလေသိမ်းများနှင့် ထပ်နေသောအသံများတွင် တိကျမှုကျဆင်းသည်။ ထိုနေရာတွင် အောက်ဖော်ပြပါ cloud option သည် ၎င်း၏တန်ဖိုးကို ပြသသည်။

ပိုမိုတိကျမှု သို့မဟုတ် ဘာသာစကားများ ပိုမိုလိုအပ်ပါသလား။

Cloud-based စကားပြောကို စာသားပြောင်းလဲခြင်း

အခမဲ့ browser-based ကိရိယာသည် သေးငယ်သော open-source မော်ဒယ်ကို အသုံးပြုသည်။ ၎င်းသည် ကြည်လင်သောအသံအတွက် ကောင်းမွန်သော်လည်း ပြင်းထန်သော လေယူလေသိမ်းများ၊ ဆူညံသံများ သို့မဟုတ် ထပ်နေသော စကားပြောသူများနှင့် ရုန်းကန်ရနိုင်ပြီး ဘာသာစကားအနည်းငယ်ကိုသာ အကျုံးဝင်သည်။ ထုတ်လွှင့်မှုအဆင့်မီ တိကျမှု၊ ပိုမိုကျယ်ပြန့်သော ဘာသာစကားပံ့ပိုးမှုနှင့် SRT/VTT/TXT ဒေါင်းလုဒ်များအတွက် ကျွန်ုပ်တို့၏ အခပေး cloud-based စကားပြောကို စာသားပြောင်းလဲခြင်းကို အသုံးပြုပါ။

cloud-based စကားပြောကို စာသားပြောင်းလဲခြင်းကို စမ်းကြည့်ပါ