Subformer
အခမဲ့ · စာရင်းသွင်းရန် မလို · ဘရောက်ဇာ၌ လည်ပတ်သည်

အခမဲ့ Thai အသံမှ စာသားပြောင်း

ไทย

Thai အသံ သို့မဟုတ် ဗီဒီယို ဖိုင်တစ်ခုကို ဆွဲထည့်ပြီး အချိန်မှတ်တမ်းပါ သည့် ပြည့်စုံသော စာတမ်းကို ရယူပါ - အားလုံးကို သင်၏ ဘရောက်ဇာတွင် ဆောင်ရွက်နိုင်ပြီး အကောင့်ဖွင့်ရန် မလိုပါ။ မော်ဒယ်ကို တစ်ကြိမ် (~75 MB) ဒေါင်းယူကာ ဒေသခံတွင် ကက်ရှ် ထိန်းသိမ်းထားသောကြောင့် နောက်ထပ်အသုံးပြုမှုများတွင် ခဏချင်း လည်ပတ်ပြီး အော့ဖ်လိုင်းဖြင့်လည်း အလုပ်လုပ်နိုင်သည်။

ဘရောက်ဇာ၏ အထောက်အပံ့ကို စစ်ဆေးနေသည်…

ပိုမိုတိကျမှု သို့မဟုတ် ဘာသာစကားများ ပိုမိုလိုအပ်ပါသလား။

Cloud-based Thai စကားပြောကို စာသားပြောင်းလဲခြင်း

အခမဲ့ browser-based ကိရိယာသည် သေးငယ်သော open-source မော်ဒယ်ကို အသုံးပြုသည်။ ၎င်းသည် ကြည်လင်သောအသံအတွက် ကောင်းမွန်သော်လည်း ပြင်းထန်သော Thai လေယူလေသိမ်းများ၊ ဆူညံသံများ သို့မဟုတ် ထပ်နေသော စကားပြောသူများနှင့် ရုန်းကန်ရနိုင်ပြီး ဘာသာစကားအနည်းငယ်ကိုသာ အကျုံးဝင်သည်။ ထုတ်လွှင့်မှုအဆင့်မီ တိကျမှု၊ ပိုမိုကျယ်ပြန့်သော ဘာသာစကားပံ့ပိုးမှုနှင့် SRT/VTT/TXT ဒေါင်းလုဒ်များအတွက် ကျွန်ုပ်တို့၏ အခပေး cloud-based စကားပြောကို စာသားပြောင်းလဲခြင်းကို အသုံးပြုပါ။

cloud-based စကားပြောကို စာသားပြောင်းလဲခြင်းကို စမ်းကြည့်ပါ

လုပ်ဆောင်ပုံ

  1. 1. ဖိုင်တစ်ခုကို ဆွဲထည့်ပါ

    မည်သည့် Thai အသံ သို့မဟုတ် ဗီဒီယို မဆို ထည့်နိုင်သည် - MP3, WAV, M4A, MP4, WEBM အားလုံးကို ပံ့ပိုးသည်။

  2. 2. အသံကို စာသားအဖြစ် ရေးထုတ်ပါ

    ပထမဆုံး ကလစ်သည် မော်ဒယ် ~75 MB ကို သင်၏ ဘရောက်ဇာသို့ ဒေါင်းယူသည်။ ထို့နောက် အသိမှတ်ပြုမှုသည် ခဏချင်းဖြစ်ပြီး အော့ဖ်လိုင်းတွင်လည်း လုပ်ဆောင်နိုင်သည်။

  3. 3. ဒေါင်းလုပ်ပါ

    စာရင်းကို TXT, SRT, သို့မဟုတ် VTT အဖြစ် သိမ်းပါ။ သင့်အသံနှင့် ရလဒ်သည် မည်သည့်အချိန်မျှ မိမိကိရိယာမှ ထွက်ခြင်း မရှိပါ။

သင့်အသံသည် သင့်ပစ္စည်းပေါ်တွင်သာ တည်ရှိပါသည်

အသိမှတ်ပြုမှုကို WebAssembly ဖြင့် လုံးဝ သင်၏ ဘရောက်ဇာအတွင်းတွင် လည်ပတ်သည်။ ကွန်ယက်တောင်းဆိုမှုများမှာ မော်ဒယ်နှင့် WebAssembly runtime ကိုသာ ရယူရန်ဖြစ်ပြီး၊ နှစ်ခုလုံးသည် ပြည်သူသုံး static asset များဖြစ်သည်။ ကျွန်ုပ်တို့သည် သင့်အသံကို မမြင်ရဘူး၊ ထိပ်သရုပ်ကိုလည်း မမြင်နိုင်ပါ။

သင့်ဘရောက်ဆာတွင် Thai စာသားမှတ်တမ်းကူးယူခြင်း လုပ်ဆောင်ပုံ

အသံမှတ်မိစနစ်သည် ပုံမှန်အားဖြင့် သင့်အသံကို အခြားသူတစ်ဦး၏ GPU သို့ အပ်လုဒ်လုပ်ခြင်းကို ဆိုလိုပါသည်။ ဤနေရာတွင် မော်ဒယ်သည် သင့်ကိုယ်ပိုင်စက်တွင် လုပ်ဆောင်သောကြောင့် ၎င်းကို အခမဲ့နှင့် တစ်ချိန်တည်းတွင် သီးသန့်ဖြစ်စေပါသည်။

Open-source recognition model
ဘာသာစကားမျိုးစုံသုံး အသံများဖြင့် လေ့ကျင့်ထားသော open-source အာရုံကြောစနစ်သုံး မော်ဒယ်တစ်ခုဖြစ်ပြီး ထို့ကြောင့် တစ်ကြိမ်ဒေါင်းလုဒ်လုပ်ရုံဖြင့် ဘာသာစကားသီးသန့် မော်ဒယ်ကို ထပ်မံရယူစရာမလိုဘဲ Thai ကို ကိုင်တွယ်နိုင်ပါသည်။
WebAssembly
inference runtime ကို WebAssembly သို့ ပြောင်းလဲထားသောကြောင့် ဂဏန်းဆိုင်ရာ code များသည် plugin မပါဘဲ၊ ထည့်သွင်းစရာမလိုဘဲ sandboxed tab အတွင်းတွင် မူရင်းအမြန်နှုန်းနီးပါးဖြင့် အလုပ်လုပ်ပါသည်။
On-device inference
~75 MB ပမာဏသတ်မှတ်ထားသော မော်ဒယ်ကို တင်ပြီး decoding loop ကို client-side တွင် လုံးဝလုပ်ဆောင်ပါသည်။ စာမျက်နှာတင်ပြီးသည်နှင့် လုပ်ငန်းစဉ်၏ မည်သည့်အရာကမျှ ဆာဗာသို့ ခေါ်ဆိုခြင်းမရှိပါ။
Web Audio API
သင့်ဖိုင်ကို decode လုပ်ပြီး ဘရောက်ဆာ၏ ကိုယ်ပိုင် audio pipeline ကို အသုံးပြု၍ မော်ဒယ်မျှော်လင့်ထားသည့် 16 kHz mono သို့ ပြန်လည်နမူနာယူသည်။ ထို့ကြောင့် သင့်ဘရောက်ဆာဖွင့်နိုင်သည့် မည်သည့် format ကိုမဆို လက်ခံပါသည်။
ပရီမီယမ် - Subformer မှလည်း

မကြာခဏမေးလေ့ရှိသောမေးခွန်းများ

အခြား အခမဲ့ စကားမှ စာသားသို့ ဘာသာစကားများကို စမ်းကြည့်ပါ