Subformer
مجاني · بدون تسجيل · يعمل في متصفحك

تحويل الكلام إلى نص مجاني في 35+ لغات

أفلت أي ملف صوتي أو فيديو، اختر لغة، واحصل على نص كامل مع الطوابع الزمنية - كل ذلك في متصفحك. يتم تنزيل النموذج مرة واحدة (~75 MB) وتخزينه محليًا، لذا تكون العمليات التالية فورية وتعمل دون اتصال.

خاص بشكل افتراضي

يعمل التعرف محليًا. صوتك لا يغادر جهازك أبدًا.

فوري بعد التحميل الأول

يُخزَّن النموذج في متصفحك. التشغيلات التالية تعمل دون اتصال.

مجانًا، بدون تسجيل

لا حاجة لحساب، لا أرصدة، لا حد للاستخدام. استخدمه مباشرة.

اختر لغة

تحت الغطاء

عادةً ما يعني التعرف على الكلام تحميل صوتك إلى وحدة معالجة رسومات (GPU) لشخص آخر. هنا، يعمل النموذج على جهازك الخاص بدلاً من ذلك، وهذا ما يجعل الأداة مجانية وخاصة في نفس الوقت.

Open-source recognition model
إصدار كمي من نموذج مفتوح المصدر للتعرف على الكلام العصبي، صغير بما يكفي لتنزيله مرة واحدة والاحتفاظ به في متصفحك.
WebAssembly
يتم تجميع وقت تشغيل الاستدلال إلى WebAssembly، لذا يعمل الكود الرقمي بسرعة شبه أصلية داخل علامة تبويب معزولة بدون مكون إضافي وبدون تثبيت.
On-device inference
يتم تحميل النموذج، وتقسيم الرموز، وتشغيل حلقة فك الترميز كلها من جانب العميل. لا يتصل أي جزء من المسار بخادم بمجرد تحميل الصفحة.
Web Audio API
يتم فك تشفير ملفك وإعادة أخذ عيناته إلى 16 كيلو هرتز أحادي كما يتوقع النموذج باستخدام مسار الصوت الخاص بالمتصفح، لذا يتم قبول أي تنسيق يمكن لمتصفحك تشغيله.

المقايضة هي حجم النموذج. الأوزان على الجهاز هي جزء صغير مما يديره الخدمة المستضافة، لذا تنخفض الدقة في الصوت الصاخب، واللهجات القوية، والمتحدثين المتداخلين - وهذا هو المكان الذي يكسب فيه خيار السحابة أدناه قيمته.

هل تحتاج إلى دقة أعلى أو المزيد من اللغات؟

تحويل الكلام إلى نص المستند إلى السحابة

تعمل الأداة المجانية داخل المتصفح بنموذج صغير مفتوح المصدر - مناسبة للصوت النظيف، ولكنها قد تواجه صعوبة مع اللهجات الثقيلة، الضوضاء، أو المتحدثين المتداخلين، وتغطي مجموعة محدودة فقط من اللغات. للحصول على دقة بجودة البث، ودعم لغوي أوسع بكثير، وتنزيلات SRT/VTT/TXT، استخدم خدمة تحويل الكلام إلى نص المدفوعة والمستندة إلى السحابة.

جرب تحويل الكلام إلى نص المستند إلى السحابة