Subformer
رایگان · بدون ثبت‌نام · در مرورگر شما اجرا می‌شود

رایگان Kazakh تبدیل متن به گفتار

Қазақ тілі

متن Kazakh را تایپ یا الصاق کنید و آن را بشنوید - همه در مرورگر شما، بدون نیاز به ثبت‌نام. مدل صدا یک‌بار (~122 MB) دانلود و به‌صورت محلی کش می‌شود، بنابراین اجراهای بعدی فوری و آفلاین هستند.

نحوهٔ کار

  1. 1. متن خود را تایپ کنید

    هر متن Kazakh را بچسبانید یا تایپ کنید - علائم نگارشی و شکستن خطوط رعایت می‌شوند.

  2. 2. تولید

    با اولین کلیک، مدل صدای ~122 مگابایتی به مرورگر شما دانلود می‌شود. بعد از آن، سنتز فوری است.

  3. 3. دانلود یا پخش

    صدا را به‌صورت درون‌خطی پخش کنید یا آن را به عنوان فایل WAV ذخیره کنید. صدا هرگز از دستگاه شما خارج نمی‌شود.

متن شما روی دستگاه شما می‌ماند

سنتز کاملاً در مرورگر شما با استفاده از WebAssembly اجرا می‌شود. تنها درخواست‌های شبکه برای دریافت مدل صوتی و زمان اجرای استنتاج است - هر دو دارایی‌های عمومی و استاتیک هستند. ما متن شما را نمی‌بینیم و صدای تولید شده را نمی‌بینیم.

نحوه اجرای صدای Kazakh در مرورگر شما

این یک مدل واقعی TTS عصبی است که روی دستگاه خود شما اجرا می‌شود، نه یک کلاینت سبک برای یک API میزبانی شده. چهار بخش این امر را در یک تب ممکن می‌سازند.

Open-source neural voice
مدل Kazakh روی یک گوینده آموزش دیده است، به همین دلیل لهجه و نحوه بیان در تمام آنچه سنتز می‌کنید ثابت می‌ماند.
WebAssembly
هم زمان اجرای مدل و هم مرحله‌ای که متن Қазақ тілі را به واج تبدیل می‌کند، به WebAssembly کامپایل شده‌اند، بنابراین کدی که در ابتدا برای دسکتاپ نوشته شده بود، با سرعتی نزدیک به بومی در سندباکس مرورگر اجرا می‌شود.
On-device inference
شبکه عصبی مدل به صورت محلی اجرا می‌شود و به حالت تک‌رشته‌ای محدود شده است تا صفحه هرگز به ایزوله‌سازی بین مبدأ نیاز نداشته باشد و در هر مرورگر مدرنی کار کند.
Origin Private File System
مدل صوتی با حجم تقریبی 122 مگابایت پس از اولین اجرا در یک حافظه خصوصی و مختص مبدأ ذخیره می‌شود. بازدیدهای بعدی دانلود را رد کرده و بدون نیاز به شبکه، صدا را تولید می‌کنند.
آیا به صداهای با کیفیت پخش نیاز دارید؟

Subformer Voice Synthesis - TTS Kazakh با کیفیت استودیویی

ابزار رایگانِ درون‌مرورگرِ بالا برای پیش‌نویس‌ها و پیش‌نمایش‌ها عالی است، اما صدای متن‌باز به‌طور محسوسی مصنوعی به‌نظر می‌رسد. سنتز صدای پولیِ Subformer صدای طبیعی و در سطح پخش حرفه‌ای تولید می‌کند و به‌صورت اختیاری امکان شبیه‌سازی (کلون) صدا را دارد.

تولید صدای Subformer را امتحان کنید
پریمیوم - همچنین از Subformer

پرسش‌های متداول

سایر زبان‌های رایگان TTS را امتحان کنید

صداها توسط Piper پشتیبانی می‌شوند. وزن‌های صدایی تحت مجوز MIT هستند (rhasspy/piper-voices). phonemizer wasm در زمان اجرا از یک CDN عمومی بارگذاری می‌شود و بخشی از توزیع این سایت نیست.