Subformer
Անվճար · Գրանցում չի պահանջվում · Շարժվում է ձեր բրաուզերում

Անվճար Mandarin Խոսքից Տեքստ

中文

Թողեք Mandarin ձայնային կամ տեսանյութի ֆայլը և ստացեք ամբողջական տրանսկրիպտ ժամանակային նշումներով - ամենը ձեր զննարկչում, առանց գրանցման. Մոդելը ներբեռնվում է մեկ անգամ (~75 MB) և տեղականորեն կեշավորվում, այնպես որ հետագա գործարկումները ակնթարթային են և աշխատում են օֆլայն.

Ստուգվում է զննարկչի աջակցությունը…

Ավելի բարձր ճշգրտությո՞ւն կամ ավելի շատ լեզուներ են պե՞տք:

Ամպային Mandarin խոսքի ճանաչում

Բրաուզերում անվճար գործիքն աշխատում է փոքր բաց կոդով մոդելով՝ հարմար մաքուր աուդիոյի համար, բայց այն կարող է դժվարանալ ծանր Mandarin շեշտադրումների, աղմուկի կամ համընկնող խոսողների դեպքում և ընդգրկում է միայն լեզուների սահմանափակ շարք: Հեռարձակման որակի ճշգրտության, լեզվի շատ ավելի լայն աջակցության և SRT/VTT/TXT ներբեռնումների համար օգտագործեք մեր վճարովի ամպային խոսքի ճանաչումը:

Փորձել ամպային խոսքի ճանաչումը

Ինչպես է գործում

  1. 1. Թողեք ֆայլը

    Թողեք ցանկացած Mandarin ձայնային կամ տեսանյութ - MP3, WAV, M4A, MP4 և WEBM բոլորն աջակցվում են.

  2. 2. Տեքստագրել

    Առաջին սեղմումով մոդելը (~75 MB) ներբեռնվում է ձեր զննարկչում. Դրանից հետո ճանաչումը ակնթարթային է և աշխատում է օֆլայն.

  3. 3. Ներբեռնել

    Պահպանեք տրանսկրիպտը որպես TXT, SRT կամ VTT. Ձեր աուդիոն և արդյունքը երբեք չեն լքում ձեր սարքը.

Ձեր աուդիոն մնում է ձեր սարքում

Խոսքի ճանաչումը ամբողջությամբ կատարվում է ձեր դիտարկիչում՝ օգտագործելով WebAssembly. Միակ ցանցային հարցումները մոդելի և WebAssembly runtime-ի բեռնումն են - երկուսն էլ հանրային, ստատիկ ռեսուրսներ. Մենք չենք տեսնում ձեր աուդիոն և չենք տեսնում տրանսկրիպտը.

Ինչպես է Mandarin տառադարձումն աշխատում ձեր բրաուզերում

Խոսքի ճանաչումը սովորաբար նշանակում է ձեր աուդիոյի վերբեռնում ուրիշի GPU-ին։ Այստեղ մոդելն աշխատում է ձեր սեփական մեքենայի վրա, ինչն էլ սա դարձնում է անվճար և միաժամանակ անձնական։

Open-source recognition model
Բաց կոդով նյարդային մոդել, որը մարզվել է բազմալեզու աուդիոյի վրա, այդ իսկ պատճառով մեկ ներբեռնումը մշակում է Mandarin՝ առանց լեզվին հատուկ մոդել ներբեռնելու անհրաժեշտության։
WebAssembly
Եզրակացության աշխատաժամանակը կոմպիլացված է WebAssembly-ի, ուստի թվային կոդը աշխատում է բնիկին մոտ արագությամբ ավազատուփի ներդիրում՝ առանց պլագինի և առանց տեղադրման:
On-device inference
~75 ՄԲ քվանտացված մոդելը բեռնվում է, և ապակոդավորման ցիկլը ամբողջությամբ կառավարվում է հաճախորդի կողմից։ Էջը բեռնվելուց հետո խողովակաշարի ոչ մի մաս չի դիմում սերվերին։
Web Audio API
Ձեր ֆայլը ապակոդավորվում և վերանմուշվում է մոդելի կողմից ակնկալվող 16 կՀց մոնո ձևաչափին՝ օգտագործելով բրաուզերի սեփական աուդիո խողովակաշարը, ուստի ձեր բրաուզերի կողմից նվագարկվող ցանկացած ձևաչափ ընդունվում է:
Պրեմիում - նույնպես Subformer-ից

Հաճախ տրվող հարցեր

Փորձեք այլ անվճար խոսքից‑տեքստ լեզուներ