Subformer
უფასო · რეგისტრაცია არ არის საჭირო · ბრაუზერში მუშაობს

უფასო Italian ხმიდან ტექსტად

Italiano

გადმოაგდეთ Italian აუდიო ან ვიდეო ფაილი და მიიღეთ სრული ტრანსკრიპტი დროის ნიშნებით - ყველაფერი თქვენს ბრაუზერში, რეგისტრაციის გარეშე. მოდელი ერთხელ ჩამოტვირთება (~75 MB) და შეინახება ადგილობრივად კეშში, ამიტომ შემდგომი გაშვებები არის მყისიერი და მუშაობს ოფლაინში.

ბრაუზერის მხარდაჭერის შემოწმება…

გჭირდებათ უფრო მაღალი სიზუსტე ან მეტი ენა?

ღრუბელზე დაფუძნებული Italian მეტყველების ტექსტად გადაქცევა

უფასო ბრაუზერში არსებული ხელსაწყო მუშაობს მცირე ღია კოდის მოდელზე - კარგია სუფთა აუდიოსთვის, მაგრამ მას შეიძლება გაუჭირდეს მძიმე Italian აქცენტებთან, ხმაურთან ან გადამფარავ სპიკერებთან გამკლავება და მოიცავს მხოლოდ შეზღუდულ ენებს. მაუწყებლობის ხარისხის სიზუსტისთვის, ბევრად უფრო ფართო ენის მხარდაჭერისთვის და SRT/VTT/TXT ჩამოტვირთვებისთვის, გამოიყენეთ ჩვენი ფასიანი ღრუბელზე დაფუძნებული მეტყველების ტექსტად გადაქცევა.

სცადეთ ღრუბელზე დაფუძნებული მეტყველების ტექსტად გადაქცევა

როგორ მუშაობს

  1. 1. გადმოაგდეთ ფაილი

    გადმოაგდეთ ნებისმიერი Italian აუდიო ან ვიდეო — MP3, WAV, M4A, MP4 და WEBM მხარდაჭერილია.

  2. 2. ტრანსკრიფცია

    პირველი დაჭერით მოდელი (~75 MB) ჩამოტვირთება თქვენს ბრაუზერში. ამის შემდეგ ამოცნობა იქნება მყისიერი და შესაძლებელი ოფლაინში.

  3. 3. ჩამოტვირთვა

    შეინახეთ ტრანსკრიპტი როგორც TXT, SRT ან VTT. თქვენი აუდიო და შედეგი არასდროს ტოვებს თქვენს მოწყობილობას.

თქვენი აუდიო რჩება თქვენს მოწყობილობაზე

აღქმა სრულად თქვენს ბრაუზერში ხდება WebAssembly-ის გამოყენებით. ერთადერთი ქსელური მოთხოვნები მოდელისა და WebAssembly runtime-ის მისაღებადაა - ორივე საჯარო, სტატიკური რესურსია. ჩვენ არ ვხედავთ თქვენს აუდიოს და არც ტრანსკრიპტს.

როგორ მუშაობს Italian ტრანსკრიფცია თქვენს ბრაუზერში

მეტყველების ამოცნობა ჩვეულებრივ ნიშნავს თქვენი აუდიოს სხვის GPU-ზე ატვირთვას. აქ მოდელი მუშაობს თქვენს საკუთარ მანქანაზე, რაც ამას უფასოს და პირადულს ხდის ერთდროულად.

Open-source recognition model
ღია კოდის ნერვული მოდელი, გაწვრთნილი მრავალენოვან აუდიოზე - რის გამოც ერთი ჩამოტვირთვა ამუშავებს Italian-ს ენის სპეციფიკური მოდელის ჩამოტვირთვის გარეშე.
WebAssembly
ინფერენციის გაშვების დრო კომპილირებულია WebAssembly-ში, ამიტომ რიცხვითი კოდი მუშაობს მშობლიურთან მიახლოებული სიჩქარით ქვიშის ყუთში მოთავსებულ ჩანართში, ყოველგვარი დანამატისა და ინსტალაციის გარეშე.
On-device inference
~75 მბ კვანტიზებული მოდელი იტვირთება და დეკოდირების ციკლი მთლიანად კლიენტის მხარეს იმართება. გვერდის ჩატვირთვის შემდეგ, კონვეიერის არცერთი ნაწილი არ უკავშირდება სერვერს.
Web Audio API
თქვენი ფაილი დეკოდირდება და ხელახლა სემპლირდება 16 kHz მონოზე, რასაც მოდელი ელოდება ბრაუზერის საკუთარი აუდიო მილსადენის გამოყენებით, ამიტომ ნებისმიერი ფორმატი, რომლის დაკვრაც თქვენს ბრაუზერს შეუძლია, მიღებულია.
პრემიუმი - ასევე Subformer-ისგან

ხშირად დასმული კითხვები

სცადეთ სხვა უფასო საუბრიდან‑ტექსტში ენები