Subformer
मुफ्त · कोई साइनअप नहीं · ब्राउज़र में चलता है

मुफ़्त Indonesian स्पीच-टू-टेक्स्ट

Bahasa Indonesia

एक Indonesian ऑडियो या वीडियो फ़ाइल छोड़ें और टाइमस्टैम्प के साथ पूरा प्रतिलेख प्राप्त करें - यह सब आपके ब्राउज़र में, बिना किसी साइनअप के। मॉडल एक बार डाउनलोड होता है (~75 MB) और लोकल रूप से कैश किया जाता है, इसलिए बाद के रन तुरंत होते हैं और ऑफलाइन काम करते हैं।

ब्राउज़र समर्थन की जाँच हो रही है…

क्या आपको उच्च सटीकता या अधिक भाषाओं की आवश्यकता है?

क्लाउड-आधारित Indonesian स्पीच टू टेक्स्ट

निःशुल्क इन-ब्राउज़र टूल एक छोटा ओपन-सोर्स मॉडल चलाता है - यह स्वच्छ ऑडियो के लिए ठीक है, लेकिन यह भारी Indonesian उच्चारण, शोर, या ओवरलैपिंग वक्ताओं के साथ संघर्ष कर सकता है, और केवल सीमित भाषाओं को कवर करता है। प्रसारण-ग्रेड सटीकता, कहीं अधिक व्यापक भाषा समर्थन, और SRT/VTT/TXT डाउनलोड के लिए, हमारे सशुल्क क्लाउड-आधारित स्पीच टू टेक्स्ट का उपयोग करें।

क्लाउड-आधारित स्पीच टू टेक्स्ट आज़माएँ

यह कैसे काम करता है

  1. 1. फ़ाइल डालें

    किसी भी Indonesian ऑडियो या वीडियो को छोड़ें - MP3, WAV, M4A, MP4, और WEBM सभी समर्थित हैं।

  2. 2. प्रतिलेख करें

    पहली बार क्लिक करने पर ~75 MB मॉडल आपके ब्राउज़र में डाउनलोड होता है। उसके बाद, पहचान तुरंत होती है और ऑफलाइन-समर्थ होती है।

  3. 3. डाउनलोड करें

    ट्रांसक्रिप्ट को TXT, SRT, या VTT के रूप में सहेजें. आपकी ऑडियो और परिणाम कभी आपके डिवाइस से बाहर नहीं जाते.

आपका ऑडियो आपके डिवाइस पर रहता है

पहचान पूरी तरह से आपके ब्राउज़र में WebAssembly का उपयोग करके चलती है. एकमात्र नेटवर्क अनुरोध मॉडल और WebAssembly रनटाइम को लाने के लिए होते हैं - ये दोनों सार्वजनिक, स्थिर एसेट हैं. हम आपकी ऑडियो नहीं देखते और न ही हम ट्रांसक्रिप्ट देखते हैं.

आपके ब्राउज़र में Indonesian प्रतिलेखन कैसे चलता है

स्पीच रिकॉग्निशन का सामान्यतः मतलब है अपने ऑडियो को किसी के GPU पर अपलोड करना। यहां मॉडल इसके बजाय आपकी अपनी मशीन पर चलता है, जो इसे एक ही समय में मुफ़्त और निजी बनाता है।

Open-source recognition model
बहुभाषी ऑडियो पर प्रशिक्षित एक ओपन-सोर्स न्यूरल मॉडल - यही कारण है कि एक डाउनलोड Indonesian को बिना किसी भाषा-विशिष्ट मॉडल को फेच किए संभालता है।
WebAssembly
इन्फ्रेंस रनटाइम को वेबअसेंबली में संकलित किया गया है, इसलिए संख्यात्मक कोड बिना किसी प्लगइन और बिना किसी इंस्टॉलेशन के एक सैंडबॉक्स टैब के अंदर लगभग-मूल गति से चलता है।
On-device inference
~75 MB क्वांटाइज़्ड मॉडल लोड किया जाता है और डिकोडिंग लूप पूरी तरह से क्लाइंट-साइड से संचालित होता है। पेज लोड होने के बाद पाइपलाइन का कोई भी हिस्सा सर्वर को कॉल नहीं करता है।
Web Audio API
आपकी फ़ाइल को ब्राउज़र की अपनी ऑडियो पाइपलाइन का उपयोग करके मॉडल द्वारा अपेक्षित 16 kHz मोनो में डिकोड और रीसैंपल किया जाता है, इसलिए आपका ब्राउज़र चला सकने वाला कोई भी प्रारूप स्वीकार किया जाता है।
प्रीमियम - Subformer से भी

अक्सर पूछे जाने वाले प्रश्न

अन्य मुफ्त स्पीच-टू-टेक्स्ट भाषाएँ आज़माएँ