Subformer
အခမဲ့ · စာရင်းသွင်းရန် မလို · ဘရောက်ဇာ၌ လည်ပတ်သည်

အခမဲ့ Farsi အသံမှ စာသားပြောင်း

فارسی

Farsi အသံ သို့မဟုတ် ဗီဒီယို ဖိုင်တစ်ခုကို ဆွဲထည့်ပြီး အချိန်မှတ်တမ်းပါ သည့် ပြည့်စုံသော စာတမ်းကို ရယူပါ - အားလုံးကို သင်၏ ဘရောက်ဇာတွင် ဆောင်ရွက်နိုင်ပြီး အကောင့်ဖွင့်ရန် မလိုပါ။ မော်ဒယ်ကို တစ်ကြိမ် (~75 MB) ဒေါင်းယူကာ ဒေသခံတွင် ကက်ရှ် ထိန်းသိမ်းထားသောကြောင့် နောက်ထပ်အသုံးပြုမှုများတွင် ခဏချင်း လည်ပတ်ပြီး အော့ဖ်လိုင်းဖြင့်လည်း အလုပ်လုပ်နိုင်သည်။

ဘရောက်ဇာ၏ အထောက်အပံ့ကို စစ်ဆေးနေသည်…

ပိုမိုတိကျမှု သို့မဟုတ် ဘာသာစကားများ ပိုမိုလိုအပ်ပါသလား။

Cloud-based Farsi စကားပြောကို စာသားပြောင်းလဲခြင်း

အခမဲ့ browser-based ကိရိယာသည် သေးငယ်သော open-source မော်ဒယ်ကို အသုံးပြုသည်။ ၎င်းသည် ကြည်လင်သောအသံအတွက် ကောင်းမွန်သော်လည်း ပြင်းထန်သော Farsi လေယူလေသိမ်းများ၊ ဆူညံသံများ သို့မဟုတ် ထပ်နေသော စကားပြောသူများနှင့် ရုန်းကန်ရနိုင်ပြီး ဘာသာစကားအနည်းငယ်ကိုသာ အကျုံးဝင်သည်။ ထုတ်လွှင့်မှုအဆင့်မီ တိကျမှု၊ ပိုမိုကျယ်ပြန့်သော ဘာသာစကားပံ့ပိုးမှုနှင့် SRT/VTT/TXT ဒေါင်းလုဒ်များအတွက် ကျွန်ုပ်တို့၏ အခပေး cloud-based စကားပြောကို စာသားပြောင်းလဲခြင်းကို အသုံးပြုပါ။

cloud-based စကားပြောကို စာသားပြောင်းလဲခြင်းကို စမ်းကြည့်ပါ

လုပ်ဆောင်ပုံ

  1. 1. ဖိုင်တစ်ခုကို ဆွဲထည့်ပါ

    မည်သည့် Farsi အသံ သို့မဟုတ် ဗီဒီယို မဆို ထည့်နိုင်သည် - MP3, WAV, M4A, MP4, WEBM အားလုံးကို ပံ့ပိုးသည်။

  2. 2. အသံကို စာသားအဖြစ် ရေးထုတ်ပါ

    ပထမဆုံး ကလစ်သည် မော်ဒယ် ~75 MB ကို သင်၏ ဘရောက်ဇာသို့ ဒေါင်းယူသည်။ ထို့နောက် အသိမှတ်ပြုမှုသည် ခဏချင်းဖြစ်ပြီး အော့ဖ်လိုင်းတွင်လည်း လုပ်ဆောင်နိုင်သည်။

  3. 3. ဒေါင်းလုပ်ပါ

    စာရင်းကို TXT, SRT, သို့မဟုတ် VTT အဖြစ် သိမ်းပါ။ သင့်အသံနှင့် ရလဒ်သည် မည်သည့်အချိန်မျှ မိမိကိရိယာမှ ထွက်ခြင်း မရှိပါ။

သင့်အသံသည် သင့်ပစ္စည်းပေါ်တွင်သာ တည်ရှိပါသည်

အသိမှတ်ပြုမှုကို WebAssembly ဖြင့် လုံးဝ သင်၏ ဘရောက်ဇာအတွင်းတွင် လည်ပတ်သည်။ ကွန်ယက်တောင်းဆိုမှုများမှာ မော်ဒယ်နှင့် WebAssembly runtime ကိုသာ ရယူရန်ဖြစ်ပြီး၊ နှစ်ခုလုံးသည် ပြည်သူသုံး static asset များဖြစ်သည်။ ကျွန်ုပ်တို့သည် သင့်အသံကို မမြင်ရဘူး၊ ထိပ်သရုပ်ကိုလည်း မမြင်နိုင်ပါ။

သင့်ဘရောက်ဆာတွင် Farsi စာသားမှတ်တမ်းကူးယူခြင်း လုပ်ဆောင်ပုံ

အသံမှတ်မိစနစ်သည် ပုံမှန်အားဖြင့် သင့်အသံကို အခြားသူတစ်ဦး၏ GPU သို့ အပ်လုဒ်လုပ်ခြင်းကို ဆိုလိုပါသည်။ ဤနေရာတွင် မော်ဒယ်သည် သင့်ကိုယ်ပိုင်စက်တွင် လုပ်ဆောင်သောကြောင့် ၎င်းကို အခမဲ့နှင့် တစ်ချိန်တည်းတွင် သီးသန့်ဖြစ်စေပါသည်။

Open-source recognition model
ဘာသာစကားမျိုးစုံသုံး အသံများဖြင့် လေ့ကျင့်ထားသော open-source အာရုံကြောစနစ်သုံး မော်ဒယ်တစ်ခုဖြစ်ပြီး ထို့ကြောင့် တစ်ကြိမ်ဒေါင်းလုဒ်လုပ်ရုံဖြင့် ဘာသာစကားသီးသန့် မော်ဒယ်ကို ထပ်မံရယူစရာမလိုဘဲ Farsi ကို ကိုင်တွယ်နိုင်ပါသည်။
WebAssembly
inference runtime ကို WebAssembly သို့ ပြောင်းလဲထားသောကြောင့် ဂဏန်းဆိုင်ရာ code များသည် plugin မပါဘဲ၊ ထည့်သွင်းစရာမလိုဘဲ sandboxed tab အတွင်းတွင် မူရင်းအမြန်နှုန်းနီးပါးဖြင့် အလုပ်လုပ်ပါသည်။
On-device inference
~75 MB ပမာဏသတ်မှတ်ထားသော မော်ဒယ်ကို တင်ပြီး decoding loop ကို client-side တွင် လုံးဝလုပ်ဆောင်ပါသည်။ စာမျက်နှာတင်ပြီးသည်နှင့် လုပ်ငန်းစဉ်၏ မည်သည့်အရာကမျှ ဆာဗာသို့ ခေါ်ဆိုခြင်းမရှိပါ။
Web Audio API
သင့်ဖိုင်ကို decode လုပ်ပြီး ဘရောက်ဆာ၏ ကိုယ်ပိုင် audio pipeline ကို အသုံးပြု၍ မော်ဒယ်မျှော်လင့်ထားသည့် 16 kHz mono သို့ ပြန်လည်နမူနာယူသည်။ ထို့ကြောင့် သင့်ဘရောက်ဆာဖွင့်နိုင်သည့် မည်သည့် format ကိုမဆို လက်ခံပါသည်။
ပရီမီယမ် - Subformer မှလည်း

မကြာခဏမေးလေ့ရှိသောမေးခွန်းများ

အခြား အခမဲ့ စကားမှ စာသားသို့ ဘာသာစကားများကို စမ်းကြည့်ပါ