Subformer
मुफ्त · कोई साइनअप नहीं · ब्राउज़र में चलता है

मुफ़्त स्पीच-टू-टेक्स्ट 35+ भाषाओं में

कोई भी ऑडियो या वीडियो फ़ाइल छोड़ें, एक भाषा चुनें, और टाइमस्टैम्प के साथ पूरा प्रतिलेख प्राप्त करें - यह सब आपके ब्राउज़र में। मॉडल एक बार डाउनलोड होता है (~75 MB) और लोकल रूप से कैश किया जाता है, इसलिए बाद के रन तुरंत होते हैं और ऑफलाइन काम करते हैं।

डिफ़ॉल्ट रूप से निजी

पहचान स्थानीय रूप से चलती है. आपकी ऑडियो कभी आपके डिवाइस से बाहर नहीं जाती.

पहली बार लोड के बाद तुरंत

मॉडल आपके ब्राउज़र में कैश किया गया है। बाद के रन ऑफ़लाइन काम करते हैं।

मुफ्त, कोई साइनअप नहीं

कोई अकाउंट नहीं, कोई क्रेडिट नहीं, कोई उपयोग सीमा नहीं। खोलें और उपयोग करें।

एक भाषा चुनें

अंदरूनी तौर पर

स्पीच रिकॉग्निशन का सामान्यतः मतलब है अपने ऑडियो को किसी के GPU पर अपलोड करना। यहां मॉडल इसके बजाय आपकी अपनी मशीन पर चलता है, जो इस टूल को एक ही समय में मुफ़्त और निजी बनाता है।

Open-source recognition model
ओपन-सोर्स न्यूरल स्पीच रिकॉग्निशन मॉडल का एक क्वांटाइज़्ड बिल्ड, इतना छोटा कि इसे एक बार डाउनलोड करके आपके ब्राउज़र में रखा जा सके।
WebAssembly
इन्फ्रेंस रनटाइम को वेबअसेंबली में संकलित किया गया है, इसलिए संख्यात्मक कोड बिना किसी प्लगइन और बिना किसी इंस्टॉलेशन के एक सैंडबॉक्स टैब के अंदर लगभग-मूल गति से चलता है।
On-device inference
मॉडल लोड करना, टोकनाइज़ करना और डिकोडिंग लूप चलाना - ये सभी क्लाइंट-साइड होते हैं। पेज लोड होने के बाद पाइपलाइन का कोई भी हिस्सा सर्वर को कॉल नहीं करता है।
Web Audio API
आपकी फ़ाइल को ब्राउज़र की अपनी ऑडियो पाइपलाइन का उपयोग करके मॉडल द्वारा अपेक्षित 16 kHz मोनो में डिकोड और रीसैंपल किया जाता है, इसलिए आपका ब्राउज़र चला सकने वाला कोई भी प्रारूप स्वीकार किया जाता है।

समझौता मॉडल आकार का है। ऑन-डिवाइस वज़न एक होस्टेड सेवा के चलने वाले वज़न का एक अंश होते हैं, इसलिए शोर वाले ऑडियो, मजबूत लहजे और ओवरलैपिंग बोलने वालों पर सटीकता कम हो जाती है - यहीं पर नीचे दिया गया क्लाउड विकल्प अपना महत्व साबित करता है।

क्या आपको उच्च सटीकता या अधिक भाषाओं की आवश्यकता है?

क्लाउड-आधारित स्पीच टू टेक्स्ट

निःशुल्क इन-ब्राउज़र टूल एक छोटा ओपन-सोर्स मॉडल चलाता है - यह स्वच्छ ऑडियो के लिए ठीक है, लेकिन यह भारी उच्चारण, शोर, या ओवरलैपिंग वक्ताओं के साथ संघर्ष कर सकता है, और केवल सीमित भाषाओं को कवर करता है। प्रसारण-ग्रेड सटीकता, कहीं अधिक व्यापक भाषा समर्थन, और SRT/VTT/TXT डाउनलोड के लिए, हमारे सशुल्क क्लाउड-आधारित स्पीच टू टेक्स्ट का उपयोग करें।

क्लाउड-आधारित स्पीच टू टेक्स्ट आज़माएँ