Subformer
Δωρεάν · Χωρίς εγγραφή · Εκτελείται στον περιηγητή σας

Δωρεάν Spanish Ομιλία σε Κείμενο

Español

Αποθέστε ένα Spanish αρχείο ήχου ή βίντεο και αποκτήστε πλήρες αντίγραφο με χρονικές σημάνσεις - όλα στο πρόγραμμα περιήγησής σας, χωρίς εγγραφή. Το μοντέλο κατεβαίνει μία φορά (~75 MB) και αποθηκεύεται τοπικά, οπότε οι επόμενες εκτελέσεις είναι άμεσες και λειτουργούν εκτός σύνδεσης.

Ελέγχεται η υποστήριξη του προγράμματος περιήγησης…

Χρειάζεστε μεγαλύτερη ακρίβεια ή περισσότερες γλώσσες;

Μετατροπή ομιλίας σε κείμενο Spanish βασισμένη στο cloud

Το δωρεάν εργαλείο εντός του προγράμματος περιήγησης χρησιμοποιεί ένα μικρό μοντέλο ανοιχτού κώδικα – ιδανικό για καθαρό ήχο, αλλά μπορεί να δυσκολευτεί με έντονες Spanish προφορές, θόρυβο ή επικαλυπτόμενους ομιλητές, και καλύπτει μόνο ένα περιορισμένο σύνολο γλωσσών. Για ακρίβεια επιπέδου εκπομπής, πολύ ευρύτερη υποστήριξη γλωσσών και λήψεις SRT/VTT/TXT, χρησιμοποιήστε την επί πληρωμή υπηρεσία μας μετατροπής ομιλίας σε κείμενο βασισμένη στο cloud.

Δοκιμάστε τη μετατροπή ομιλίας σε κείμενο βασισμένη στο cloud

Πώς λειτουργεί

  1. 1. Αποθέστε ένα αρχείο

    Αποθέστε οποιοδήποτε Spanish αρχείο ήχου ή βίντεο - υποστηρίζονται MP3, WAV, M4A, MP4 και WEBM.

  2. 2. Μεταγράψτε

    Το πρώτο κλικ κατεβάζει το μοντέλο (~75 MB) στον περιηγητή σας. Μετά από αυτό, η αναγνώριση είναι άμεση και λειτουργεί εκτός σύνδεσης.

  3. 3. Κατεβάστε

    Αποθηκεύστε τη μεταγραφή ως TXT, SRT ή VTT. Το αρχείο ήχου και το αποτέλεσμα δεν φεύγουν ποτέ από τη συσκευή σας.

Ο ήχος σας παραμένει στη συσκευή σας

Η αναγνώριση εκτελείται εξ ολοκλήρου στο πρόγραμμα περιήγησής σας χρησιμοποιώντας WebAssembly. Τα μόνα αιτήματα δικτύου γίνονται για τη λήψη του μοντέλου και του runtime του WebAssembly - και τα δύο είναι δημόσια, στατικά αρχεία. Δεν βλέπουμε το αρχείο ήχου σας και δεν βλέπουμε τη μεταγραφή.

Πώς λειτουργεί η μεταγραφή Spanish στο πρόγραμμα περιήγησής σας

Η αναγνώρισης ομιλίας συνήθως σημαίνει μεταφόρτωση του ήχου σας στην GPU κάποιου. Εδώ το μοντέλο εκτελείται στη δική σας μηχανή, κάτι που το καθιστά δωρεάν και ιδιωτικό ταυτόχρονα.

Open-source recognition model
Ένα νευρωνικό μοντέλο ανοιχτού κώδικα εκπαιδευμένο σε πολύγλωσσο ήχο - γι' αυτό μία λήψη χειρίζεται τα Spanish χωρίς να χρειάζεται να ανακτηθεί ένα μοντέλο ειδικό για τη γλώσσα.
WebAssembly
Το περιβάλλον εκτέλεσης συμπερασμάτων μεταγλωττίζεται σε WebAssembly, έτσι ο αριθμητικός κώδικας εκτελείται σε σχεδόν εγγενή ταχύτητα μέσα σε μια καρτέλα sandbox χωρίς πρόσθετο και χωρίς εγκατάσταση.
On-device inference
Το κβαντισμένο μοντέλο ~75 MB φορτώνεται και ο βρόχος αποκωδικοποίησης οδηγείται εξ ολοκλήρου από την πλευρά του πελάτη. Κανένα μέρος της διαδικασίας δεν καλεί διακομιστή μόλις φορτωθεί η σελίδα.
Web Audio API
Το αρχείο σας αποκωδικοποιείται και επαναδειγματοληπτείται σε μονοφωνικό 16 kHz που αναμένει το μοντέλο χρησιμοποιώντας την ίδια την ηχητική υποδομή του προγράμματος περιήγησης, οπότε οποιαδήποτε μορφή μπορεί να αναπαράγει το πρόγραμμα περιήγησής σας είναι αποδεκτή.
Premium - επίσης από Subformer

Συχνές ερωτήσεις

Δοκιμάστε άλλες δωρεάν γλώσσες ομιλίας προς κείμενο