Subformer
ಉಚಿತ · ಸೈನ್ ಅಪ್ ಅಗತ್ಯವಿಲ್ಲ · ನಿಮ್ಮ ಬ್ರೌಸರ್‌ನಲ್ಲಿ ನಡೆಯುತ್ತದೆ

ಉಚಿತ Farsi ಸ್ಪೀಚ್-ಟು-ಟೆಕ್ಸ್ಟ್

فارسی

ಒಂದು Farsi ಆಡಿಯೋ ಅಥವಾ ವೀಡಿಯೊ ಫೈಲ್ ಅನ್ನು ಎಸೆಹಾಕಿ ಮತ್ತು ಟೈಮ್ಸ್ಟ್ಯಾಂಪ್‌ಗಳೊಂದಿಗೆ ಸಂಪೂರ್ಣ ಲಿಪ್ಯಂತರಣೆ ಪಡೆಯಿರಿ - ಎಲ್ಲವೂ ನಿಮ್ಮ ಬ್ರೌಸರ್‌ನಲ್ಲಿ, ಯಾವುದೇ ಸೈನ್‌ಅಪ್ ಅಗತ್ಯವಿಲ್ಲ. ಮಾದರಿ ಒಮ್ಮೆ (~75 MB) ಡೌನ್ಲೋಡ್ ಆಗುತ್ತದೆ ಮತ್ತು ಸ್ಥಳೀಯವಾಗಿ ಕ್ಯಾಶ್ ಆಗುತ್ತದೆ, ಆದ್ದರಿಂದ ನಂತರದ ರನ್‌ಗಳು ತಕ್ಷಣವಾಗುತ್ತವೆ ಮತ್ತು ಆಫ್‌ಲೈನ್‌ನಲ್ಲಿ ಕಾರ್ಯನಿರ್ವಹಿಸುತ್ತವೆ.

ಬ್ರೌಸರ್ ಬೆಂಬಲವನ್ನು ಪರಿಶೀಲಿಸಲಾಗುತ್ತಿದೆ…

ಹೆಚ್ಚಿನ ನಿಖರತೆ ಅಥವಾ ಹೆಚ್ಚಿನ ಭಾಷೆಗಳು ಬೇಕೇ?

ಕ್ಲೌಡ್-ಆಧಾರಿತ Farsi ಭಾಷಣದಿಂದ ಪಠ್ಯಕ್ಕೆ

ಉಚಿತ ಇನ್-ಬ್ರೌಸರ್ ಉಪಕರಣವು ಸಣ್ಣ ಓಪನ್-ಸೋರ್ಸ್ ಮಾದರಿಯನ್ನು ನಡೆಸುತ್ತದೆ - ಇದು ಸ್ಪಷ್ಟ ಆಡಿಯೊಗೆ ಉತ್ತಮವಾಗಿದೆ, ಆದರೆ ಇದು ಭಾರೀ Farsi ಉಚ್ಚಾರಣೆಗಳು, ಶಬ್ದ ಅಥವಾ ಅತಿಕ್ರಮಿಸುವ ಸ್ಪೀಕರ್‌ಗಳೊಂದಿಗೆ ಹೋರಾಡಬಹುದು ಮತ್ತು ಸೀಮಿತ ಭಾಷೆಗಳನ್ನು ಮಾತ್ರ ಒಳಗೊಂಡಿದೆ. ಪ್ರಸಾರ-ದರ್ಜೆಯ ನಿಖರತೆ, ಹೆಚ್ಚು ವ್ಯಾಪಕವಾದ ಭಾಷಾ ಬೆಂಬಲ ಮತ್ತು SRT/VTT/TXT ಡೌನ್‌ಲೋಡ್‌ಗಳಿಗಾಗಿ, ನಮ್ಮ ಪಾವತಿಸಿದ ಕ್ಲೌಡ್-ಆಧಾರಿತ ಭಾಷಣದಿಂದ ಪಠ್ಯಕ್ಕೆ ಬಳಸಿ.

ಕ್ಲೌಡ್-ಆಧಾರಿತ ಭಾಷಣದಿಂದ ಪಠ್ಯಕ್ಕೆ ಪ್ರಯತ್ನಿಸಿ

ಇದು ಹೇಗೆ ಕೆಲಸ ಮಾಡುತ್ತದೆ

  1. 1. ಫೈಲ್ ಎಸೆಹಾಕಿ

    ಯಾವುದೇ Farsi ಆಡಿಯೋ ಅಥವಾ ವೀಡಿಯೊ ಅನ್ನು ಹಾಕಿ - MP3, WAV, M4A, MP4 ಮತ್ತು WEBM ಎಲ್ಲವೂ ಬೆಂಬಲಿಸಲಾಗುತ್ತದೆ.

  2. 2. ಲಿಪ್ಯಂತರಿಸಿ

    ಮೊದಲ ಕ್ಲಿಕ್‌ನಲ್ಲಿ ~75 MB ಮಾದರಿ ನಿಮ್ಮ ಬ್ರೌಸರ್‌ಗೆ ಡೌನ್ಲೋಡ್ ಆಗುತ್ತದೆ. ಅದರ ನಂತರ ಗುರುತಿಸುವಿಕೆ ತಕ್ಷಣವಾಗಿದ್ದು ಮತ್ತು ಆಫ್‌ಲೈನ್‌ನಲ್ಲಿ ಕಾರ್ಯನಿರ್ವಹಿಸುತ್ತದೆ.

  3. 3. ಡೌನ್‌ಲೋಡ್

    ಟ್ರಾನ್ಸ್ಕ್ರಿಪ್ಟ್ ಅನ್ನು TXT, SRT, ಅಥವಾ VTT ಆಗಿ ಉಳಿಸಿ. ನಿಮ್ಮ ಆಡಿಯೋ ಮತ್ತು ಫಲಿತಾಂಶವು ಎಂದಿಗೂ ನಿಮ್ಮ ಸಾಧನವನ್ನು ಹೊರಗೆ ಹೋಗುವುದಿಲ್ಲ.

ನಿಮ್ಮ ಆಡಿಯೋ ನಿಮ್ಮ ಸಾಧನದಲ್ಲೇ ಉಳಿಯುತ್ತದೆ

ಗುರುತುಮಾಡುವುದು ಸಂಪೂರ್ಣವಾಗಿ ನಿಮ್ಮ ಬ್ರೌಸರ್‌ನಲ್ಲಿ WebAssembly ಬಳಸಿ ನಡೆಯುತ್ತದೆ. ಏಕಮಾತ್ರ ನೆಟ್ವರ್ಕ್ ವಿನಂತಿಗಳು ಮಾದರಿಯನ್ನು ಮತ್ತು WebAssembly ರನ್‌ಟೈಮ್ ಅನ್ನು ಪಡೆಯುವುದಕ್ಕೆ ಇರುತ್ತವೆ - ಎರಡೂ ಸಾರ್ವಜನಿಕ, ಸ್ಥಿರ ಆಸ್ತಿಗಳು. ನಾವು ನಿಮ್ಮ ಆಡಿಯೋವನ್ನು ನೋಡುವುದಿಲ್ಲ ಮತ್ತು ಟ್ರಾನ್ಸ್ಕ್ರಿಪ್ಟ್ ಅನ್ನು ನೋಡುವುದೂ ಇಲ್ಲ.

ನಿಮ್ಮ ಬ್ರೌಸರ್‌ನಲ್ಲಿ Farsi ಟ್ರಾನ್ಸ್‌ಕ್ರಿಪ್ಷನ್ ಹೇಗೆ ರನ್ ಆಗುತ್ತದೆ

ಸ್ಪೀಚ್ ರೆಕಗ್ನಿಷನ್ ಸಾಮಾನ್ಯವಾಗಿ ನಿಮ್ಮ ಆಡಿಯೊವನ್ನು ಬೇರೆಯವರ GPU ಗೆ ಅಪ್‌ಲೋಡ್ ಮಾಡುವುದನ್ನು ಅರ್ಥೈಸುತ್ತದೆ. ಇಲ್ಲಿ ಮಾದರಿಯು ನಿಮ್ಮ ಸ್ವಂತ ಯಂತ್ರದಲ್ಲಿ ರನ್ ಆಗುತ್ತದೆ, ಇದು ಇದನ್ನು ಉಚಿತ ಮತ್ತು ಖಾಸಗಿಯಾಗಿ ಮಾಡುತ್ತದೆ.

Open-source recognition model
ಬಹುಭಾಷಾ ಆಡಿಯೊದಲ್ಲಿ ತರಬೇತಿ ಪಡೆದ ಓಪನ್-ಸೋರ್ಸ್ ನ್ಯೂರಲ್ ಮಾದರಿ - ಅದಕ್ಕಾಗಿಯೇ ಒಂದು ಡೌನ್‌ಲೋಡ್ ಯಾವುದೇ ಭಾಷಾ-ನಿರ್ದಿಷ್ಟ ಮಾದರಿಯನ್ನು ಪಡೆಯದೆ Farsi ಅನ್ನು ನಿರ್ವಹಿಸುತ್ತದೆ.
WebAssembly
ಇನ್‌ಫರೆನ್ಸ್ ರನ್‌ಟೈಮ್ ಅನ್ನು ವೆಬ್ ಅಸೆಂಬ್ಲಿಗೆ ಕಂಪೈಲ್ ಮಾಡಲಾಗಿದೆ, ಆದ್ದರಿಂದ ಸಂಖ್ಯಾ ಕೋಡ್ ಯಾವುದೇ ಪ್ಲಗಿನ್ ಮತ್ತು ಯಾವುದೇ ಇನ್‌ಸ್ಟಾಲ್ ಇಲ್ಲದೆ ಸ್ಯಾಂಡ್‌ಬಾಕ್ಸ್ಡ್ ಟ್ಯಾಬ್‌ನಲ್ಲಿ ಸ್ಥಳೀಯ ವೇಗದ ಸಮೀಪದಲ್ಲಿ ಕಾರ್ಯನಿರ್ವಹಿಸುತ್ತದೆ.
On-device inference
~75 MB ಕ್ವಾಂಟೈಸ್ಡ್ ಮಾದರಿಯನ್ನು ಲೋಡ್ ಮಾಡಲಾಗುತ್ತದೆ ಮತ್ತು ಡಿಕೋಡಿಂಗ್ ಲೂಪ್ ಅನ್ನು ಸಂಪೂರ್ಣವಾಗಿ ಕ್ಲೈಂಟ್-ಸೈಡ್‌ನಲ್ಲಿ ನಡೆಸಲಾಗುತ್ತದೆ. ಪುಟ ಲೋಡ್ ಆದ ನಂತರ ಪೈಪ್‌ಲೈನ್‌ನ ಯಾವುದೇ ಭಾಗವು ಸರ್ವರ್‌ಗೆ ಕರೆ ಮಾಡುವುದಿಲ್ಲ.
Web Audio API
ನಿಮ್ಮ ಫೈಲ್ ಅನ್ನು ಡಿಕೋಡ್ ಮಾಡಲಾಗುತ್ತದೆ ಮತ್ತು ಬ್ರೌಸರ್‌ನ ಸ್ವಂತ ಆಡಿಯೊ ಪೈಪ್‌ಲೈನ್ ಬಳಸಿ ಮಾದರಿಯು ನಿರೀಕ್ಷಿಸುವ 16 kHz ಮೋನೋಗೆ ಮರು-ಸ್ಯಾಂಪಲ್ ಮಾಡಲಾಗುತ್ತದೆ, ಆದ್ದರಿಂದ ನಿಮ್ಮ ಬ್ರೌಸರ್ ಪ್ಲೇ ಮಾಡಬಹುದಾದ ಯಾವುದೇ ಸ್ವರೂಪವನ್ನು ಸ್ವೀಕರಿಸಲಾಗುತ್ತದೆ.
ಪ್ರೀಮಿಯಮ್ - Subformer ನಿಂದವೂ

ಸಾಮಾನ್ಯವಾಗಿ ಕೇಳಲಾಗುವ ಪ್ರಶ್ನೆಗಳು

ಇನ್ನಿತರ ಉಚಿತ ಮಾತು-ಇಂದ ಪಠ್ಯಕ್ಕೆ ಭಾಷೆಗಳನ್ನು ಪ್ರಯತ್ನಿಸಿ