Subformer
مجاني · بدون تسجيل · يعمل في متصفحك

مجاني Russian تحويل الكلام إلى نص

Русский

أفلت ملف Russian صوتي أو فيديو واحصل على نص كامل مع الطوابع الزمنية - كل ذلك في متصفحك، بدون تسجيل. يتم تنزيل النموذج مرة واحدة (~75 MB) وتخزينه محليًا، لذا تكون العمليات التالية فورية وتعمل دون اتصال.

جارٍ التحقق من دعم المتصفح…

هل تحتاج إلى دقة أعلى أو المزيد من اللغات؟

تحويل الكلام إلى نص Russian المستند إلى السحابة

تعمل الأداة المجانية داخل المتصفح بنموذج صغير مفتوح المصدر - مناسبة للصوت النظيف، ولكنها قد تواجه صعوبة مع اللهجات Russian الثقيلة، الضوضاء، أو المتحدثين المتداخلين، وتغطي مجموعة محدودة فقط من اللغات. للحصول على دقة بجودة البث، ودعم لغوي أوسع بكثير، وتنزيلات SRT/VTT/TXT، استخدم خدمة تحويل الكلام إلى نص المدفوعة والمستندة إلى السحابة.

جرب تحويل الكلام إلى نص المستند إلى السحابة

كيف يعمل

  1. 1. اسحب ملفًا وأفلته

    أفلت أي Russian ملف صوتي أو فيديو - MP3 و WAV و M4A و MP4 و WEBM كلها مدعومة.

  2. 2. تحويل إلى نص

    النقرة الأولى تقوم بتنزيل النموذج (~75 MB) إلى متصفحك. بعد ذلك، تصبح عملية التعرف فورية وتعمل دون اتصال.

  3. 3. تنزيل

    احفظ النص كملف TXT أو SRT أو VTT. صوتك والنتيجة لا يغادران جهازك أبدًا.

يبقى الصوت على جهازك

يعمل التعرف بالكامل في متصفحك باستخدام WebAssembly. طلبات الشبكة الوحيدة هي لجلب النموذج وبيئة تشغيل WebAssembly - كلاهما أصول عامة وثابتة. نحن لا نرى صوتك ولا نرى النص الناتج.

كيف يعمل نسخ Russian في متصفحك

عادةً ما يعني التعرف على الكلام تحميل صوتك إلى وحدة معالجة رسومات (GPU) لشخص آخر. هنا، يعمل النموذج على جهازك الخاص بدلاً من ذلك، وهذا ما يجعل هذا مجانيًا وخاصًا في نفس الوقت.

Open-source recognition model
نموذج عصبي مفتوح المصدر مدرب على صوت متعدد اللغات - ولهذا السبب يتعامل تنزيل واحد مع Russian بدون الحاجة إلى جلب نموذج خاص باللغة.
WebAssembly
يتم تجميع وقت تشغيل الاستدلال إلى WebAssembly، لذا يعمل الكود الرقمي بسرعة شبه أصلية داخل علامة تبويب معزولة بدون مكون إضافي وبدون تثبيت.
On-device inference
يتم تحميل النموذج الكمي بحجم ~75 ميجابايت ويتم تشغيل حلقة فك الترميز بالكامل من جانب العميل. لا يتصل أي جزء من المسار بخادم بمجرد تحميل الصفحة.
Web Audio API
يتم فك تشفير ملفك وإعادة أخذ عيناته إلى 16 كيلو هرتز أحادي كما يتوقع النموذج باستخدام مسار الصوت الخاص بالمتصفح، لذا يتم قبول أي تنسيق يمكن لمتصفحك تشغيله.
Premium - أيضًا من Subformer

الأسئلة الشائعة

جرب لغات تحويل الكلام إلى نص المجانية الأخرى