Subformer
رایگان · بدون ثبت‌نام · در مرورگر شما اجرا می‌شود

رایگان Turkish تبدیل گفتار به متن

Türkçe

یک فایل صوتی یا ویدیویی Turkish را رها کنید و یک رونوشت کامل با زمان‌بندی دریافت کنید - همه اینها در مرورگر شما، بدون ثبت‌نام. مدل فقط یک‌بار دانلود می‌شود (~75 MB) و به‌صورت محلی کش می‌شود، بنابراین اجراهای بعدی فوری هستند و به‌صورت آفلاین کار می‌کنند.

در حال بررسی پشتیبانی مرورگر…

به دقت بالاتر یا زبان‌های بیشتری نیاز دارید؟

تبدیل گفتار به متن Turkish مبتنی بر ابر

ابزار رایگان درون مرورگر یک مدل متن‌باز کوچک را اجرا می‌کند - برای صدای تمیز خوب است، اما ممکن است با لهجه‌های Turkish سنگین، نویز یا همپوشانی گویندگان مشکل داشته باشد و تنها مجموعه محدودی از زبان‌ها را پوشش می‌دهد. برای دقت در حد پخش، پشتیبانی بسیار گسترده‌تر از زبان‌ها و دانلودهای SRT/VTT/TXT، از تبدیل گفتار به متن ابری پولی ما استفاده کنید.

تبدیل گفتار به متن مبتنی بر ابر را امتحان کنید

نحوهٔ کار

  1. 1. فایل را رها کنید

    هر فایل صوتی یا ویدیویی Turkish را رها کنید - فرمت‌های MP3، WAV، M4A، MP4 و WEBM پشتیبانی می‌شوند.

  2. 2. تبدیل به متن

    کلیک اول مدل ~75 MB را در مرورگر شما دانلود می‌کند. بعد از آن، تشخیص فوری است و به‌صورت آفلاین کار می‌کند.

  3. 3. دانلود

    رونوشت را به‌صورت TXT، SRT یا VTT ذخیره کنید. فایل صوتی و نتیجه هرگز از دستگاه شما خارج نمی‌شوند.

صوت شما روی دستگاهتان باقی می‌ماند

تشخیص به‌طور کامل در مرورگر شما با استفاده از WebAssembly اجرا می‌شود. تنها درخواست‌های شبکه برای دریافت مدل و محیط اجرایی WebAssembly هستند - هر دو دارایی‌های عمومی و ثابت‌اند. ما صدای شما را نمی‌بینیم و متن تبدیل‌شده را هم نمی‌بینیم.

نحوه اجرای رونویسی Turkish در مرورگر شما

تشخیص گفتار معمولاً به معنای آپلود صدای شما به GPU شخص دیگری است. در اینجا مدل به جای آن روی دستگاه خود شما اجرا می‌شود، که همین امر این را همزمان رایگان و خصوصی می‌کند.

Open-source recognition model
یک مدل عصبی متن‌باز که روی صدای چندزبانه آموزش دیده است - به همین دلیل یک بار دانلود برای Turkish کافی است و نیازی به دریافت مدل خاص زبان نیست.
WebAssembly
زمان اجرای استنتاج به WebAssembly کامپایل شده است، بنابراین کد عددی با سرعتی نزدیک به بومی در یک تب سندباکس شده بدون نیاز به افزونه و نصب اجرا می‌شود.
On-device inference
مدل کوانتیزه شده ~75 مگابایتی بارگذاری می‌شود و حلقه رمزگشایی کاملاً در سمت کلاینت هدایت می‌شود. هیچ چیز در پایپ‌لاین پس از بارگذاری صفحه با سرور تماس نمی‌گیرد.
Web Audio API
فایل شما رمزگشایی و به مونو 16 کیلوهرتز که مدل انتظار دارد، با استفاده از خط لوله صوتی خود مرورگر، بازنمونه‌برداری می‌شود، بنابراین هر فرمتی که مرورگر شما بتواند پخش کند، پذیرفته می‌شود.
پریمیوم - همچنین از Subformer

پرسش‌های متداول

زبان‌های رایگان تبدیل گفتار به متن دیگر را امتحان کنید