أفلت أي ملف صوتي أو فيديو، اختر لغة، واحصل على نص كامل مع الطوابع الزمنية - كل ذلك في متصفحك. يتم تنزيل النموذج مرة واحدة (~75 MB) وتخزينه محليًا، لذا تكون العمليات التالية فورية وتعمل دون اتصال.
يعمل التعرف محليًا. صوتك لا يغادر جهازك أبدًا.
يُخزَّن النموذج في متصفحك. التشغيلات التالية تعمل دون اتصال.
لا حاجة لحساب، لا أرصدة، لا حد للاستخدام. استخدمه مباشرة.
عادةً ما يعني التعرف على الكلام تحميل صوتك إلى وحدة معالجة رسومات (GPU) لشخص آخر. هنا، يعمل النموذج على جهازك الخاص بدلاً من ذلك، وهذا ما يجعل الأداة مجانية وخاصة في نفس الوقت.
المقايضة هي حجم النموذج. الأوزان على الجهاز هي جزء صغير مما يديره الخدمة المستضافة، لذا تنخفض الدقة في الصوت الصاخب، واللهجات القوية، والمتحدثين المتداخلين - وهذا هو المكان الذي يكسب فيه خيار السحابة أدناه قيمته.
تعمل الأداة المجانية داخل المتصفح بنموذج صغير مفتوح المصدر - مناسبة للصوت النظيف، ولكنها قد تواجه صعوبة مع اللهجات الثقيلة، الضوضاء، أو المتحدثين المتداخلين، وتغطي مجموعة محدودة فقط من اللغات. للحصول على دقة بجودة البث، ودعم لغوي أوسع بكثير، وتنزيلات SRT/VTT/TXT، استخدم خدمة تحويل الكلام إلى نص المدفوعة والمستندة إلى السحابة.
جرب تحويل الكلام إلى نص المستند إلى السحابة