Subformer
უფასო · რეგისტრაცია არ არის საჭირო · ბრაუზერში მუშაობს

უფასო Farsi ტექსტის ხმოვანი სინთეზი

فارسی

ჩაწერეთ ან ჩასვით Farsi ტექსტი და მოისმინეთ მისი წარმოთქმა — ყველაფერი თქვენს ბრაუზერში, რეგისტრაცია არ არის საჭირო. ხმოვანი მოდელი ერთხელ (~61 MB) ჩაიტვირთება და შეინახება ლოკალურად, ამიტომ შემდგომი გაშვებები მყისიერია და მუშაობენ ოფლაინში.

როგორ მუშაობს

  1. 1. შეიყვანეთ თქვენი ტექსტი

    ჩასვით ან აკრიფეთ ნებისმიერი Farsi ტექსტი - პუნქტუაცია და სტრიქონებად გაყოფა შენარჩუნებულია.

  2. 2. გენერირება

    პირველ დაწკაპუნებაზე ~61 MB ზომის ხმის მოდელი ჩაიტვირთება თქვენს ბრაუზერში. ამის შემდეგ სინთეზი დაუყოვნებლივ მოხდება.

  3. 3. ჩამოტვირთვა ან დაკვრა

    ჩაუშვით აუდიო პირდაპირ ან შეინახეთ იგი WAV ფაილად. აუდიო არასოდეს ტოვებს თქვენს მოწყობილობას.

თქვენი ტექსტი რჩება თქვენს მოწყობილობაზე

სინთეზი მთლიანად თქვენს ბრაუზერში მუშაობს WebAssembly-ის გამოყენებით. ერთადერთი ქსელური მოთხოვნები არის ხმოვანი მოდელის და დასკვნის გაშვების დროის მოსაპოვებლად - ორივე არის საჯარო, სტატიკური აქტივები. ჩვენ არ ვხედავთ თქვენს ტექსტს და არ ვხედავთ გენერირებულ აუდიოს.

როგორ მუშაობს Farsi ხმა თქვენს ბრაუზერში

ეს არის ნამდვილი ნერვული TTS მოდელი, რომელიც სრულდება თქვენს საკუთარ მანქანაზე, და არა თხელი კლიენტი ჰოსტინგის API-სთვის. ოთხი ნაწილი ხდის ამას შესაძლებელს ჩანართში.

Open-source neural voice
Farsi მოდელი გაწვრთნილია ერთ სპიკერზე, რის გამოც აქცენტი და გადმოცემა თანმიმდევრული რჩება ყველაფერში, რასაც სინთეზირებთ.
WebAssembly
როგორც მოდელის გაშვების დრო, ასევე ნაბიჯი, რომელიც فارسی ტექსტს ფონემებად აქცევს, კომპილირებულია WebAssembly-ზე, ასე რომ, დესკტოპისთვის თავდაპირველად დაწერილი კოდი მუშაობს თითქმის მშობლიური სიჩქარით ბრაუზერის სენდბოქსში.
On-device inference
მოდელის ნერვული ქსელი სრულდება ლოკალურად, დაფიქსირებულია ერთძაფიან რეჟიმში, რათა გვერდს არასოდეს დასჭირდეს სხვადასხვა წარმოშობის იზოლაცია და მუშაობს ყველა თანამედროვე ბრაუზერში.
Origin Private File System
პირველი გაშვების შემდეგ, ~61 MB ხმოვანი მოდელი ქეშირდება პირად, წარმოშობის მიხედვით მაღაზიაში. შემდგომი ვიზიტები გამოტოვებს ჩამოტვირთვას და სინთეზირდება ქსელის გარეშე.
ჭირდებათ სატელევიზიო ხარისხის ხმები?

Subformer ხმის სინთეზი - სტუდიური ხარისხის Farsi TTS

ზემოთ მოცემული უფასო ბრაუზერული ინსტრუმენტი შესანიშნავია დრაფტებისა და პრევიუებისთვის, მაგრამ ღია კოდის ხმა თვალსაჩინოდ სინთეტიკურია. Subformer-ის გადახდილი Voice Synthesis ქმნის ბუნებრივ, ეთერზე გასაცემად შესაფერის ხარისხის აუდიოს, დამატებით ხმის კლონირების შესაძლებლობით.

ცადეთ Subformer Voice Synthesis
პრემიუმი - ასევე Subformer-ისგან

ხშირად დასმული კითხვები

ცადეთ სხვა უფასო TTS ენები

ხმები უზრუნველყოფილია Piper-ით. ხმოვანი წონები MIT ლიცენზიითაა (rhasspy/piper-voices). ფონემიზერის wasm შესრულების დროს იტვირთება საჯარო CDN-იდან და არ არის ამ საიტის დისტრიბუციის ნაწილი.