Subformer
အခမဲ့ · စာရင်းသွင်းရန် မလို · ဘရောက်ဇာ၌ လည်ပတ်သည်

အခမဲ့ Mandarin အသံမှ စာသားပြောင်း

中文

Mandarin အသံ သို့မဟုတ် ဗီဒီယို ဖိုင်တစ်ခုကို ဆွဲထည့်ပြီး အချိန်မှတ်တမ်းပါ သည့် ပြည့်စုံသော စာတမ်းကို ရယူပါ - အားလုံးကို သင်၏ ဘရောက်ဇာတွင် ဆောင်ရွက်နိုင်ပြီး အကောင့်ဖွင့်ရန် မလိုပါ။ မော်ဒယ်ကို တစ်ကြိမ် (~75 MB) ဒေါင်းယူကာ ဒေသခံတွင် ကက်ရှ် ထိန်းသိမ်းထားသောကြောင့် နောက်ထပ်အသုံးပြုမှုများတွင် ခဏချင်း လည်ပတ်ပြီး အော့ဖ်လိုင်းဖြင့်လည်း အလုပ်လုပ်နိုင်သည်။

ဘရောက်ဇာ၏ အထောက်အပံ့ကို စစ်ဆေးနေသည်…

ပိုမိုတိကျမှု သို့မဟုတ် ဘာသာစကားများ ပိုမိုလိုအပ်ပါသလား။

Cloud-based Mandarin စကားပြောကို စာသားပြောင်းလဲခြင်း

အခမဲ့ browser-based ကိရိယာသည် သေးငယ်သော open-source မော်ဒယ်ကို အသုံးပြုသည်။ ၎င်းသည် ကြည်လင်သောအသံအတွက် ကောင်းမွန်သော်လည်း ပြင်းထန်သော Mandarin လေယူလေသိမ်းများ၊ ဆူညံသံများ သို့မဟုတ် ထပ်နေသော စကားပြောသူများနှင့် ရုန်းကန်ရနိုင်ပြီး ဘာသာစကားအနည်းငယ်ကိုသာ အကျုံးဝင်သည်။ ထုတ်လွှင့်မှုအဆင့်မီ တိကျမှု၊ ပိုမိုကျယ်ပြန့်သော ဘာသာစကားပံ့ပိုးမှုနှင့် SRT/VTT/TXT ဒေါင်းလုဒ်များအတွက် ကျွန်ုပ်တို့၏ အခပေး cloud-based စကားပြောကို စာသားပြောင်းလဲခြင်းကို အသုံးပြုပါ။

cloud-based စကားပြောကို စာသားပြောင်းလဲခြင်းကို စမ်းကြည့်ပါ

လုပ်ဆောင်ပုံ

  1. 1. ဖိုင်တစ်ခုကို ဆွဲထည့်ပါ

    မည်သည့် Mandarin အသံ သို့မဟုတ် ဗီဒီယို မဆို ထည့်နိုင်သည် - MP3, WAV, M4A, MP4, WEBM အားလုံးကို ပံ့ပိုးသည်။

  2. 2. အသံကို စာသားအဖြစ် ရေးထုတ်ပါ

    ပထမဆုံး ကလစ်သည် မော်ဒယ် ~75 MB ကို သင်၏ ဘရောက်ဇာသို့ ဒေါင်းယူသည်။ ထို့နောက် အသိမှတ်ပြုမှုသည် ခဏချင်းဖြစ်ပြီး အော့ဖ်လိုင်းတွင်လည်း လုပ်ဆောင်နိုင်သည်။

  3. 3. ဒေါင်းလုပ်ပါ

    စာရင်းကို TXT, SRT, သို့မဟုတ် VTT အဖြစ် သိမ်းပါ။ သင့်အသံနှင့် ရလဒ်သည် မည်သည့်အချိန်မျှ မိမိကိရိယာမှ ထွက်ခြင်း မရှိပါ။

သင့်အသံသည် သင့်ပစ္စည်းပေါ်တွင်သာ တည်ရှိပါသည်

အသိမှတ်ပြုမှုကို WebAssembly ဖြင့် လုံးဝ သင်၏ ဘရောက်ဇာအတွင်းတွင် လည်ပတ်သည်။ ကွန်ယက်တောင်းဆိုမှုများမှာ မော်ဒယ်နှင့် WebAssembly runtime ကိုသာ ရယူရန်ဖြစ်ပြီး၊ နှစ်ခုလုံးသည် ပြည်သူသုံး static asset များဖြစ်သည်။ ကျွန်ုပ်တို့သည် သင့်အသံကို မမြင်ရဘူး၊ ထိပ်သရုပ်ကိုလည်း မမြင်နိုင်ပါ။

သင့်ဘရောက်ဆာတွင် Mandarin စာသားမှတ်တမ်းကူးယူခြင်း လုပ်ဆောင်ပုံ

အသံမှတ်မိစနစ်သည် ပုံမှန်အားဖြင့် သင့်အသံကို အခြားသူတစ်ဦး၏ GPU သို့ အပ်လုဒ်လုပ်ခြင်းကို ဆိုလိုပါသည်။ ဤနေရာတွင် မော်ဒယ်သည် သင့်ကိုယ်ပိုင်စက်တွင် လုပ်ဆောင်သောကြောင့် ၎င်းကို အခမဲ့နှင့် တစ်ချိန်တည်းတွင် သီးသန့်ဖြစ်စေပါသည်။

Open-source recognition model
ဘာသာစကားမျိုးစုံသုံး အသံများဖြင့် လေ့ကျင့်ထားသော open-source အာရုံကြောစနစ်သုံး မော်ဒယ်တစ်ခုဖြစ်ပြီး ထို့ကြောင့် တစ်ကြိမ်ဒေါင်းလုဒ်လုပ်ရုံဖြင့် ဘာသာစကားသီးသန့် မော်ဒယ်ကို ထပ်မံရယူစရာမလိုဘဲ Mandarin ကို ကိုင်တွယ်နိုင်ပါသည်။
WebAssembly
inference runtime ကို WebAssembly သို့ ပြောင်းလဲထားသောကြောင့် ဂဏန်းဆိုင်ရာ code များသည် plugin မပါဘဲ၊ ထည့်သွင်းစရာမလိုဘဲ sandboxed tab အတွင်းတွင် မူရင်းအမြန်နှုန်းနီးပါးဖြင့် အလုပ်လုပ်ပါသည်။
On-device inference
~75 MB ပမာဏသတ်မှတ်ထားသော မော်ဒယ်ကို တင်ပြီး decoding loop ကို client-side တွင် လုံးဝလုပ်ဆောင်ပါသည်။ စာမျက်နှာတင်ပြီးသည်နှင့် လုပ်ငန်းစဉ်၏ မည်သည့်အရာကမျှ ဆာဗာသို့ ခေါ်ဆိုခြင်းမရှိပါ။
Web Audio API
သင့်ဖိုင်ကို decode လုပ်ပြီး ဘရောက်ဆာ၏ ကိုယ်ပိုင် audio pipeline ကို အသုံးပြု၍ မော်ဒယ်မျှော်လင့်ထားသည့် 16 kHz mono သို့ ပြန်လည်နမူနာယူသည်။ ထို့ကြောင့် သင့်ဘရောက်ဆာဖွင့်နိုင်သည့် မည်သည့် format ကိုမဆို လက်ခံပါသည်။
ပရီမီယမ် - Subformer မှလည်း

မကြာခဏမေးလေ့ရှိသောမေးခွန်းများ

အခြား အခမဲ့ စကားမှ စာသားသို့ ဘာသာစကားများကို စမ်းကြည့်ပါ