Subformer
Δωρεάν · Χωρίς εγγραφή · Εκτελείται στον περιηγητή σας

Δωρεάν Ομιλία σε Κείμενο σε 35+ γλώσσες

Αποθέστε οποιοδήποτε αρχείο ήχου ή βίντεο, επιλέξτε γλώσσα και αποκτήστε ένα πλήρες αντίγραφο με χρονικές σημάνσεις - όλα στο πρόγραμμα περιήγησής σας. Το μοντέλο κατεβαίνει μία φορά (~75 MB) και αποθηκεύεται τοπικά, οπότε οι επόμενες εκτελέσεις είναι άμεσες και λειτουργούν εκτός σύνδεσης.

Ιδιωτικό από προεπιλογή

Η αναγνώριση εκτελείται τοπικά. Το αρχείο ήχου σας δεν φεύγει ποτέ από τη συσκευή σας.

Άμεση μετά την πρώτη φόρτωση

Το μοντέλο έχει αποθηκευτεί στην προσωρινή μνήμη του περιηγητή σας. Οι επόμενες εκτελέσεις λειτουργούν εκτός σύνδεσης.

Δωρεάν, χωρίς εγγραφή

Χωρίς λογαριασμό, χωρίς πιστώσεις, χωρίς όριο χρήσης. Ανοίξτε και χρησιμοποιήστε.

Επιλέξτε μια γλώσσα

Στο παρασκήνιο

Η αναγνώριση ομιλίας συνήθως σημαίνει μεταφόρτωση του ήχου σας στην GPU κάποιου. Εδώ το μοντέλο εκτελείται στη δική σας μηχανή, κάτι που καθιστά το εργαλείο δωρεάν και ιδιωτικό ταυτόχρονα.

Open-source recognition model
Μια κβαντισμένη έκδοση ενός νευρωνικού μοντέλου αναγνώρισης ομιλίας ανοιχτού κώδικα, αρκετά μικρή ώστε να την κατεβάσετε μία φορά και να την κρατήσετε στο πρόγραμμα περιήγησής σας.
WebAssembly
Το περιβάλλον εκτέλεσης συμπερασμάτων μεταγλωττίζεται σε WebAssembly, έτσι ο αριθμητικός κώδικας εκτελείται σε σχεδόν εγγενή ταχύτητα μέσα σε μια καρτέλα sandbox χωρίς πρόσθετο και χωρίς εγκατάσταση.
On-device inference
Η φόρτωση του μοντέλου, η δημιουργία tokens και η εκτέλεση του βρόχου αποκωδικοποίησης γίνονται όλα από την πλευρά του πελάτη. Κανένα μέρος της διαδικασίας δεν καλεί διακομιστή μόλις φορτωθεί η σελίδα.
Web Audio API
Το αρχείο σας αποκωδικοποιείται και επαναδειγματοληπτείται σε μονοφωνικό 16 kHz που αναμένει το μοντέλο χρησιμοποιώντας την ίδια την ηχητική υποδομή του προγράμματος περιήγησης, οπότε οποιαδήποτε μορφή μπορεί να αναπαράγει το πρόγραμμα περιήγησής σας είναι αποδεκτή.

Η ανταλλαγή είναι το μέγεθος του μοντέλου. Τα βάρη στη συσκευή είναι ένα κλάσμα αυτού που εκτελεί μια φιλοξενούμενη υπηρεσία, οπότε η ακρίβεια μειώνεται σε θορυβώδη ήχο, έντονες προφορές και επικαλυπτόμενους ομιλητές - εκεί είναι που η επιλογή cloud παρακάτω αξίζει τον κόπο.

Χρειάζεστε μεγαλύτερη ακρίβεια ή περισσότερες γλώσσες;

Μετατροπή ομιλίας σε κείμενο βασισμένη στο cloud

Το δωρεάν εργαλείο εντός του προγράμματος περιήγησης χρησιμοποιεί ένα μικρό μοντέλο ανοιχτού κώδικα – ιδανικό για καθαρό ήχο, αλλά μπορεί να δυσκολευτεί με έντονες προφορές, θόρυβο ή επικαλυπτόμενους ομιλητές, και καλύπτει μόνο ένα περιορισμένο σύνολο γλωσσών. Για ακρίβεια επιπέδου εκπομπής, πολύ ευρύτερη υποστήριξη γλωσσών και λήψεις SRT/VTT/TXT, χρησιμοποιήστε την επί πληρωμή υπηρεσία μας μετατροπής ομιλίας σε κείμενο βασισμένη στο cloud.

Δοκιμάστε τη μετατροπή ομιλίας σε κείμενο βασισμένη στο cloud