Subformer
مفت · سائن اپ نہیں · آپ کے براؤزر میں چلتا ہے

مفت Indonesian تقریر سے متن

Bahasa Indonesia

ایک Indonesian آڈیو یا ویڈیو فائل ڈراپ کریں اور ٹائم اسٹیمپس کے ساتھ مکمل ٹرانسکرپٹ حاصل کریں - یہ سب آپ کے براؤزر میں، بغیر کسی سائن اپ کے۔ ماڈل ایک مرتبہ (~75 MB) ڈاؤن لوڈ ہوتا ہے اور مقامی طور پر کیش ہو جاتا ہے، لہٰذا بعد کی مرتبہ رنز فوراً ہوتے ہیں اور آف لائن بھی کام کرتے ہیں.

براؤزر کی حمایت چیک کی جا رہی ہے…

زیادہ درستگی یا مزید زبانوں کی ضرورت ہے؟

کلاؤڈ پر مبنی Indonesian اسپیچ ٹو ٹیکسٹ

مفت ان-براؤزر ٹول ایک چھوٹا اوپن سورس ماڈل چلاتا ہے - صاف آڈیو کے لیے ٹھیک ہے، لیکن یہ بھاری Indonesian لہجوں، شور، یا اوورلیپنگ اسپیکرز کے ساتھ جدوجہد کر سکتا ہے، اور صرف زبانوں کے ایک محدود سیٹ کا احاطہ کرتا ہے۔ براڈکاسٹ-گریڈ کی درستگی، کہیں زیادہ وسیع زبان کی حمایت، اور SRT/VTT/TXT ڈاؤن لوڈز کے لیے، ہماری ادا شدہ کلاؤڈ پر مبنی اسپیچ ٹو ٹیکسٹ استعمال کریں۔

کلاؤڈ پر مبنی اسپیچ ٹو ٹیکسٹ آزمائیں

یہ کیسے کام کرتا ہے

  1. 1. فائل چھوڑیں

    کوئی بھی Indonesian آڈیو یا ویڈیو فائل ڈراپ کریں - MP3, WAV, M4A, MP4, اور WEBM سب سپورٹ کیے جاتے ہیں.

  2. 2. ٹرانسکرائب کریں

    پہلی بار کلک کرنے پر تقریباً 75 MB کا ماڈل آپ کے براؤزر میں ڈاؤن لوڈ ہوتا ہے۔ اس کے بعد، شناخت فوری اور آف لائن ممکن ہوتی ہے.

  3. 3. ڈاؤن لوڈ کریں

    ٹرانسکرپٹ کو TXT، SRT، یا VTT کے طور پر محفوظ کریں۔ آپ کی آڈیو اور نتیجہ کبھی آپ کے آلے سے باہر نہیں جاتے.

آپ کی آڈیو آپ کے ڈیوائس پر رہتی ہے

Recognition runs entirely in your browser using WebAssembly. The only network requests are to fetch the model and the WebAssembly runtime - both are public, static assets. We don't see your audio and we don't see the transcript.

آپ کے براؤزر میں Indonesian ٹرانسکرپشن کیسے چلتی ہے

اسپیچ ریکگنیشن کا عام طور پر مطلب ہے کہ آپ اپنی آڈیو کسی کے GPU پر اپ لوڈ کریں۔ یہاں ماڈل اس کے بجائے آپ کی اپنی مشین پر چلتا ہے، جو اسے ایک ہی وقت میں مفت اور نجی بناتا ہے۔

Open-source recognition model
ایک اوپن سورس نیورل ماڈل جو کثیر لسانی آڈیو پر تربیت یافتہ ہے - یہی وجہ ہے کہ ایک ڈاؤن لوڈ Indonesian کو بغیر کسی زبان کے مخصوص ماڈل کو حاصل کیے سنبھالتا ہے۔
WebAssembly
انفرنس رن ٹائم کو ویب اسمبلی میں کمپائل کیا گیا ہے، لہذا عددی کوڈ بغیر کسی پلگ ان اور انسٹال کے ایک سینڈ باکسڈ ٹیب کے اندر تقریباً مقامی رفتار سے چلتا ہے۔
On-device inference
~75 MB کوانٹائزڈ ماڈل لوڈ کیا جاتا ہے اور ڈی کوڈنگ لوپ مکمل طور پر کلائنٹ سائیڈ پر چلایا جاتا ہے۔ صفحہ لوڈ ہونے کے بعد پائپ لائن کا کوئی بھی حصہ سرور کو کال نہیں کرتا۔
Web Audio API
آپ کی فائل کو ڈی کوڈ کیا جاتا ہے اور ماڈل کی توقع کے مطابق 16 kHz مونو میں براؤزر کی اپنی آڈیو پائپ لائن کا استعمال کرتے ہوئے دوبارہ نمونہ لیا جاتا ہے، لہذا آپ کا براؤزر جو بھی فارمیٹ چلا سکتا ہے وہ قبول کیا جاتا ہے۔
پریمیم - Subformer کی طرف سے بھی

اکثر پوچھے جانے والے سوالات

دوسری مفت speech-to-text زبانیں آزمائیں