Subformer
חינמי · ללא הרשמה · פועל בדפדפן שלך

דיבור-לטקסט חינם ב-35+ שפות

גרור כל קובץ אודיו או וידאו, בחר שפה וקבל תמלול מלא עם חותמות זמן - הכל בדפדפן שלך. המודל מורד פעם אחת (~75 MB) ונשמר במטמון מקומי, כך שההרצות הבאות מיידיות ועובדות במצב לא מקוון.

פרטי כברירת מחדל

הזיהוי פועל מקומית. האודיו שלך לעולם לא יוצא מהמכשיר.

מיידי לאחר הטעינה הראשונה

המודל מאוחסן במטמון של הדפדפן שלך. ריצות נוספות פועלות במצב לא מקוון.

חינמי, ללא הרשמה

ללא חשבון, ללא קרדיטים, ללא מגבלת שימוש. פתוח לשימוש.

בחר שפה

מאחורי הקלעים

זיהוי דיבור בדרך כלל אומר העלאת האודיו שלך ל-GPU של מישהו אחר. כאן המודל רץ במחשב שלך במקום זאת, וזה מה שהופך את הכלי לחינמי ופרטי בו זמנית.

Open-source recognition model
בנייה מכומתת של מודל זיהוי דיבור נוירוני בקוד פתוח, קטן מספיק כדי להוריד פעם אחת ולשמור בדפדפן שלך.
WebAssembly
סביבת הריצה של ההסקה מקומפלת ל-WebAssembly, כך שהקוד המספרי פועל במהירות קרובה למקורית בתוך כרטיסייה מבודדת (sandboxed) ללא תוסף וללא התקנה.
On-device inference
טעינת המודל, יצירת אסימונים והפעלת לולאת הפענוח מתרחשים כולם בצד הלקוח. אף חלק מהצינור לא קורא לשרת לאחר טעינת העמוד.
Web Audio API
הקובץ שלך מפוענח ונדגם מחדש למונו 16 קילו-הרץ שהמודל מצפה לו באמצעות צינור האודיו של הדפדפן עצמו, כך שכל פורמט שהדפדפן שלך יכול לנגן מתקבל.

הפשרה היא גודל המודל. משקלים במכשיר הם חלק קטן ממה ששירות מתארח מריץ, כך שהדיוק יורד באודיו רועש, מבטאים חזקים ודוברים חופפים - שם האפשרות של הענן למטה מוכיחה את יעילותה.

זקוק לדיוק גבוה יותר או ליותר שפות?

דיבור לטקסט מבוסס ענן

הכלי החינמי בדפדפן מפעיל מודל קוד פתוח קטן - הוא בסדר עבור אודיו נקי, אך הוא עלול להתקשות עם מבטאים כבדים, רעש או דוברים חופפים, ומכסה רק קבוצה מוגבלת של שפות. לדיוק ברמת שידור, תמיכה רחבה בהרבה בשפות, והורדות SRT/VTT/TXT, השתמשו בשירות הדיבור לטקסט בתשלום מבוסס הענן שלנו.

נסה דיבור לטקסט מבוסס ענן