Subformer
Անվճար · Գրանցում չի պահանջվում · Շարժվում է ձեր բրաուզերում

Անվճար Խոսքից Տեքստ 35+ լեզուներում

Թողեք ցանկացած ձայնային կամ տեսանյութի ֆայլ, ընտրեք լեզու և ստացեք ամբողջական տրանսկրիպտ ժամանակային նշումներով - ամենը ձեր զննարկչում. Մոդելը ներբեռնվում է մի անգամ (~75 MB) և տեղականորեն կեշավորվում, այնպես որ հետագա գործարկումները ակնթարթային են և աշխատում են օֆլայն.

Նախնականում՝ մասնավոր

Խոսքի ճանաչումը կատարվում է տեղում. Ձեր աուդիոն երբեք չի լքում ձեր սարքը.

Ակնթարթային՝ առաջին ներբեռումից հետո

Մոդելը կեշավորվում է ձեր բրաուզերում։ Հաջորդ անգամները աշխատում են օֆլայն։

Անվճար, գրանցում պետք չէ

Հաշիվ պետք չէ, վարկեր չկան, օգտագործման սահման չկա. Բաց է՝ օգտագործեք.

Ընտրեք լեզու

Կուլիսներում

Խոսքի ճանաչումը սովորաբար նշանակում է ձեր աուդիոյի վերբեռնում ուրիշի GPU-ին։ Այստեղ մոդելն աշխատում է ձեր սեփական մեքենայի վրա, ինչն էլ գործիքը դարձնում է անվճար և միաժամանակ անձնական։

Open-source recognition model
Բաց կոդով նյարդային խոսքի ճանաչման մոդելի քվանտացված կառուցվածք, որը բավականաչափ փոքր է մեկ անգամ ներբեռնելու և ձեր բրաուզերում պահելու համար։
WebAssembly
Եզրակացության աշխատաժամանակը կոմպիլացված է WebAssembly-ի, ուստի թվային կոդը աշխատում է բնիկին մոտ արագությամբ ավազատուփի ներդիրում՝ առանց պլագինի և առանց տեղադրման:
On-device inference
Մոդելի բեռնումը, թոքենիզացիան և ապակոդավորման ցիկլի գործարկումը բոլորն էլ տեղի են ունենում հաճախորդի կողմից։ Էջը բեռնվելուց հետո խողովակաշարի ոչ մի մաս չի դիմում սերվերին։
Web Audio API
Ձեր ֆայլը ապակոդավորվում և վերանմուշվում է մոդելի կողմից ակնկալվող 16 կՀց մոնո ձևաչափին՝ օգտագործելով բրաուզերի սեփական աուդիո խողովակաշարը, ուստի ձեր բրաուզերի կողմից նվագարկվող ցանկացած ձևաչափ ընդունվում է:

Փոխզիջումը մոդելի չափն է: Սարքի վրա գտնվող կշիռները հյուրընկալված ծառայության աշխատանքի մի մասն են, ուստի ճշգրտությունը նվազում է աղմկոտ աուդիոյի, ուժեղ շեշտադրումների և համընկնող խոսողների դեպքում. հենց այստեղ է, որ ստորև ներկայացված ամպային տարբերակը արդարացնում է իրեն:

Ավելի բարձր ճշգրտությո՞ւն կամ ավելի շատ լեզուներ են պե՞տք:

Ամպային խոսքի ճանաչում

Բրաուզերում անվճար գործիքն աշխատում է փոքր բաց կոդով մոդելով՝ հարմար մաքուր աուդիոյի համար, բայց այն կարող է դժվարանալ ծանր շեշտադրումների, աղմուկի կամ համընկնող խոսողների դեպքում և ընդգրկում է միայն լեզուների սահմանափակ շարք: Հեռարձակման որակի ճշգրտության, լեզվի շատ ավելի լայն աջակցության և SRT/VTT/TXT ներբեռնումների համար օգտագործեք մեր վճարովի ամպային խոսքի ճանաչումը:

Փորձել ամպային խոսքի ճանաչումը