Subformer
ಉಚಿತ · ಸೈನ್ ಅಪ್ ಅಗತ್ಯವಿಲ್ಲ · ನಿಮ್ಮ ಬ್ರೌಸರ್‌ನಲ್ಲಿ ನಡೆಯುತ್ತದೆ

ಉಚಿತ Mandarin ಸ್ಪೀಚ್-ಟು-ಟೆಕ್ಸ್ಟ್

中文

ಒಂದು Mandarin ಆಡಿಯೋ ಅಥವಾ ವೀಡಿಯೊ ಫೈಲ್ ಅನ್ನು ಎಸೆಹಾಕಿ ಮತ್ತು ಟೈಮ್ಸ್ಟ್ಯಾಂಪ್‌ಗಳೊಂದಿಗೆ ಸಂಪೂರ್ಣ ಲಿಪ್ಯಂತರಣೆ ಪಡೆಯಿರಿ - ಎಲ್ಲವೂ ನಿಮ್ಮ ಬ್ರೌಸರ್‌ನಲ್ಲಿ, ಯಾವುದೇ ಸೈನ್‌ಅಪ್ ಅಗತ್ಯವಿಲ್ಲ. ಮಾದರಿ ಒಮ್ಮೆ (~75 MB) ಡೌನ್ಲೋಡ್ ಆಗುತ್ತದೆ ಮತ್ತು ಸ್ಥಳೀಯವಾಗಿ ಕ್ಯಾಶ್ ಆಗುತ್ತದೆ, ಆದ್ದರಿಂದ ನಂತರದ ರನ್‌ಗಳು ತಕ್ಷಣವಾಗುತ್ತವೆ ಮತ್ತು ಆಫ್‌ಲೈನ್‌ನಲ್ಲಿ ಕಾರ್ಯನಿರ್ವಹಿಸುತ್ತವೆ.

ಬ್ರೌಸರ್ ಬೆಂಬಲವನ್ನು ಪರಿಶೀಲಿಸಲಾಗುತ್ತಿದೆ…

ಹೆಚ್ಚಿನ ನಿಖರತೆ ಅಥವಾ ಹೆಚ್ಚಿನ ಭಾಷೆಗಳು ಬೇಕೇ?

ಕ್ಲೌಡ್-ಆಧಾರಿತ Mandarin ಭಾಷಣದಿಂದ ಪಠ್ಯಕ್ಕೆ

ಉಚಿತ ಇನ್-ಬ್ರೌಸರ್ ಉಪಕರಣವು ಸಣ್ಣ ಓಪನ್-ಸೋರ್ಸ್ ಮಾದರಿಯನ್ನು ನಡೆಸುತ್ತದೆ - ಇದು ಸ್ಪಷ್ಟ ಆಡಿಯೊಗೆ ಉತ್ತಮವಾಗಿದೆ, ಆದರೆ ಇದು ಭಾರೀ Mandarin ಉಚ್ಚಾರಣೆಗಳು, ಶಬ್ದ ಅಥವಾ ಅತಿಕ್ರಮಿಸುವ ಸ್ಪೀಕರ್‌ಗಳೊಂದಿಗೆ ಹೋರಾಡಬಹುದು ಮತ್ತು ಸೀಮಿತ ಭಾಷೆಗಳನ್ನು ಮಾತ್ರ ಒಳಗೊಂಡಿದೆ. ಪ್ರಸಾರ-ದರ್ಜೆಯ ನಿಖರತೆ, ಹೆಚ್ಚು ವ್ಯಾಪಕವಾದ ಭಾಷಾ ಬೆಂಬಲ ಮತ್ತು SRT/VTT/TXT ಡೌನ್‌ಲೋಡ್‌ಗಳಿಗಾಗಿ, ನಮ್ಮ ಪಾವತಿಸಿದ ಕ್ಲೌಡ್-ಆಧಾರಿತ ಭಾಷಣದಿಂದ ಪಠ್ಯಕ್ಕೆ ಬಳಸಿ.

ಕ್ಲೌಡ್-ಆಧಾರಿತ ಭಾಷಣದಿಂದ ಪಠ್ಯಕ್ಕೆ ಪ್ರಯತ್ನಿಸಿ

ಇದು ಹೇಗೆ ಕೆಲಸ ಮಾಡುತ್ತದೆ

  1. 1. ಫೈಲ್ ಎಸೆಹಾಕಿ

    ಯಾವುದೇ Mandarin ಆಡಿಯೋ ಅಥವಾ ವೀಡಿಯೊ ಅನ್ನು ಹಾಕಿ - MP3, WAV, M4A, MP4 ಮತ್ತು WEBM ಎಲ್ಲವೂ ಬೆಂಬಲಿಸಲಾಗುತ್ತದೆ.

  2. 2. ಲಿಪ್ಯಂತರಿಸಿ

    ಮೊದಲ ಕ್ಲಿಕ್‌ನಲ್ಲಿ ~75 MB ಮಾದರಿ ನಿಮ್ಮ ಬ್ರೌಸರ್‌ಗೆ ಡೌನ್ಲೋಡ್ ಆಗುತ್ತದೆ. ಅದರ ನಂತರ ಗುರುತಿಸುವಿಕೆ ತಕ್ಷಣವಾಗಿದ್ದು ಮತ್ತು ಆಫ್‌ಲೈನ್‌ನಲ್ಲಿ ಕಾರ್ಯನಿರ್ವಹಿಸುತ್ತದೆ.

  3. 3. ಡೌನ್‌ಲೋಡ್

    ಟ್ರಾನ್ಸ್ಕ್ರಿಪ್ಟ್ ಅನ್ನು TXT, SRT, ಅಥವಾ VTT ಆಗಿ ಉಳಿಸಿ. ನಿಮ್ಮ ಆಡಿಯೋ ಮತ್ತು ಫಲಿತಾಂಶವು ಎಂದಿಗೂ ನಿಮ್ಮ ಸಾಧನವನ್ನು ಹೊರಗೆ ಹೋಗುವುದಿಲ್ಲ.

ನಿಮ್ಮ ಆಡಿಯೋ ನಿಮ್ಮ ಸಾಧನದಲ್ಲೇ ಉಳಿಯುತ್ತದೆ

ಗುರುತುಮಾಡುವುದು ಸಂಪೂರ್ಣವಾಗಿ ನಿಮ್ಮ ಬ್ರೌಸರ್‌ನಲ್ಲಿ WebAssembly ಬಳಸಿ ನಡೆಯುತ್ತದೆ. ಏಕಮಾತ್ರ ನೆಟ್ವರ್ಕ್ ವಿನಂತಿಗಳು ಮಾದರಿಯನ್ನು ಮತ್ತು WebAssembly ರನ್‌ಟೈಮ್ ಅನ್ನು ಪಡೆಯುವುದಕ್ಕೆ ಇರುತ್ತವೆ - ಎರಡೂ ಸಾರ್ವಜನಿಕ, ಸ್ಥಿರ ಆಸ್ತಿಗಳು. ನಾವು ನಿಮ್ಮ ಆಡಿಯೋವನ್ನು ನೋಡುವುದಿಲ್ಲ ಮತ್ತು ಟ್ರಾನ್ಸ್ಕ್ರಿಪ್ಟ್ ಅನ್ನು ನೋಡುವುದೂ ಇಲ್ಲ.

ನಿಮ್ಮ ಬ್ರೌಸರ್‌ನಲ್ಲಿ Mandarin ಟ್ರಾನ್ಸ್‌ಕ್ರಿಪ್ಷನ್ ಹೇಗೆ ರನ್ ಆಗುತ್ತದೆ

ಸ್ಪೀಚ್ ರೆಕಗ್ನಿಷನ್ ಸಾಮಾನ್ಯವಾಗಿ ನಿಮ್ಮ ಆಡಿಯೊವನ್ನು ಬೇರೆಯವರ GPU ಗೆ ಅಪ್‌ಲೋಡ್ ಮಾಡುವುದನ್ನು ಅರ್ಥೈಸುತ್ತದೆ. ಇಲ್ಲಿ ಮಾದರಿಯು ನಿಮ್ಮ ಸ್ವಂತ ಯಂತ್ರದಲ್ಲಿ ರನ್ ಆಗುತ್ತದೆ, ಇದು ಇದನ್ನು ಉಚಿತ ಮತ್ತು ಖಾಸಗಿಯಾಗಿ ಮಾಡುತ್ತದೆ.

Open-source recognition model
ಬಹುಭಾಷಾ ಆಡಿಯೊದಲ್ಲಿ ತರಬೇತಿ ಪಡೆದ ಓಪನ್-ಸೋರ್ಸ್ ನ್ಯೂರಲ್ ಮಾದರಿ - ಅದಕ್ಕಾಗಿಯೇ ಒಂದು ಡೌನ್‌ಲೋಡ್ ಯಾವುದೇ ಭಾಷಾ-ನಿರ್ದಿಷ್ಟ ಮಾದರಿಯನ್ನು ಪಡೆಯದೆ Mandarin ಅನ್ನು ನಿರ್ವಹಿಸುತ್ತದೆ.
WebAssembly
ಇನ್‌ಫರೆನ್ಸ್ ರನ್‌ಟೈಮ್ ಅನ್ನು ವೆಬ್ ಅಸೆಂಬ್ಲಿಗೆ ಕಂಪೈಲ್ ಮಾಡಲಾಗಿದೆ, ಆದ್ದರಿಂದ ಸಂಖ್ಯಾ ಕೋಡ್ ಯಾವುದೇ ಪ್ಲಗಿನ್ ಮತ್ತು ಯಾವುದೇ ಇನ್‌ಸ್ಟಾಲ್ ಇಲ್ಲದೆ ಸ್ಯಾಂಡ್‌ಬಾಕ್ಸ್ಡ್ ಟ್ಯಾಬ್‌ನಲ್ಲಿ ಸ್ಥಳೀಯ ವೇಗದ ಸಮೀಪದಲ್ಲಿ ಕಾರ್ಯನಿರ್ವಹಿಸುತ್ತದೆ.
On-device inference
~75 MB ಕ್ವಾಂಟೈಸ್ಡ್ ಮಾದರಿಯನ್ನು ಲೋಡ್ ಮಾಡಲಾಗುತ್ತದೆ ಮತ್ತು ಡಿಕೋಡಿಂಗ್ ಲೂಪ್ ಅನ್ನು ಸಂಪೂರ್ಣವಾಗಿ ಕ್ಲೈಂಟ್-ಸೈಡ್‌ನಲ್ಲಿ ನಡೆಸಲಾಗುತ್ತದೆ. ಪುಟ ಲೋಡ್ ಆದ ನಂತರ ಪೈಪ್‌ಲೈನ್‌ನ ಯಾವುದೇ ಭಾಗವು ಸರ್ವರ್‌ಗೆ ಕರೆ ಮಾಡುವುದಿಲ್ಲ.
Web Audio API
ನಿಮ್ಮ ಫೈಲ್ ಅನ್ನು ಡಿಕೋಡ್ ಮಾಡಲಾಗುತ್ತದೆ ಮತ್ತು ಬ್ರೌಸರ್‌ನ ಸ್ವಂತ ಆಡಿಯೊ ಪೈಪ್‌ಲೈನ್ ಬಳಸಿ ಮಾದರಿಯು ನಿರೀಕ್ಷಿಸುವ 16 kHz ಮೋನೋಗೆ ಮರು-ಸ್ಯಾಂಪಲ್ ಮಾಡಲಾಗುತ್ತದೆ, ಆದ್ದರಿಂದ ನಿಮ್ಮ ಬ್ರೌಸರ್ ಪ್ಲೇ ಮಾಡಬಹುದಾದ ಯಾವುದೇ ಸ್ವರೂಪವನ್ನು ಸ್ವೀಕರಿಸಲಾಗುತ್ತದೆ.
ಪ್ರೀಮಿಯಮ್ - Subformer ನಿಂದವೂ

ಸಾಮಾನ್ಯವಾಗಿ ಕೇಳಲಾಗುವ ಪ್ರಶ್ನೆಗಳು

ಇನ್ನಿತರ ಉಚಿತ ಮಾತು-ಇಂದ ಪಠ್ಯಕ್ಕೆ ಭಾಷೆಗಳನ್ನು ಪ್ರಯತ್ನಿಸಿ