Subformer
ឥតគិតថ្លៃ · មិនចាំបាច់ចុះឈ្មោះ · រត់នៅក្នុង browser របស់អ្នក

ឥតគិតថ្លៃ English សម្លេង​ទៅជា​អត្ថបទ

English

ទម្លាក់ឯកសារ​អូឌីយ៉ូ ឬ​វីដេអូ English មួយ ហើយទទួលបានចម្លងពេញដែលមានសម្គាល់ពេលវេលា - ទាំងអស់នៅក្នុងកម្មវិធីរុករករបស់អ្នក ដោយមិនចាំបាច់ចុះឈ្មោះ។ ម៉ូដែលត្រូវបានទាញយកម្តងទេ (~75 MB) ហើយបានរក្សាទុកនៅក្នុងតំបន់មូលដ្ឋានរបស់អ្នក ដូច្នេះការដំណើរការបន្ទាប់នឹងឆាប់រហ័ស និងអាចធ្វើបានក្រៅបណ្តាញ។

កំពុងពិនិត្យការគាំទ្ររបស់កម្មវិធីរុករក…

ត្រូវការភាពត្រឹមត្រូវខ្ពស់ជាង ឬភាសាច្រើនទៀតទេ?

ការបំប្លែងសំឡេងទៅអត្ថបទ English ដោយផ្អែកលើ Cloud

ឧបករណ៍ឥតគិតថ្លៃក្នុងកម្មវិធីរុករកដំណើរការម៉ូដែលប្រភពបើកចំហតូចមួយ - ល្អសម្រាប់សំឡេងច្បាស់ ប៉ុន្តែវាអាចមានបញ្ហាជាមួយការបញ្ចេញសំឡេង English ខ្លាំងៗ សំឡេងរំខាន ឬអ្នកនិយាយត្រួតគ្នា ហើយគ្របដណ្តប់តែសំណុំភាសាមានកំណត់ប៉ុណ្ណោះ។ សម្រាប់ភាពត្រឹមត្រូវកម្រិតផ្សាយ ការគាំទ្រភាសាទូលំទូលាយជាងមុន និងការទាញយក SRT/VTT/TXT សូមប្រើការបំប្លែងសំឡេងទៅអត្ថបទដោយផ្អែកលើ Cloud ដែលបង់ប្រាក់របស់យើង។

សាកល្បងការបំប្លែងសំឡេងទៅអត្ថបទដោយផ្អែកលើ Cloud

របៀបដំណើរការ

  1. 1. ទម្លាក់ឯកសារ

    ទម្លាក់ឯកសារ​អូឌីយ៉ូ ឬ​វីដេអូ English ណាមួយ - MP3, WAV, M4A, MP4 និង WEBM ទាំងអស់ត្រូវបានគាំទ្រ។

  2. 2. បម្លែងសម្លេងទៅជាអត្ថបទ

    ចុចដំបូងនឹងទាញយកម៉ូដែលប្រហាក់ប្រហែល ~75 MB មកកាន់កម្មវិធីរុករករបស់អ្នក។ បន្ទាប់ពីនោះ ការទទួលស្គាល់នឹងឆាប់រហ័ស និងអាចដំណើរការបានក្រៅបណ្តាញ។

  3. 3. ទាញយក

    រក្សាទុកសេចក្តីថតជា TXT, SRT, ឬ VTT។ សំឡេង និងលទ្ធផលរបស់អ្នកមិនធ្លាក់ចេញពីឧបករណ៍ទេ។

សំឡេងរបស់អ្នកនៅនៅលើឧបករណ៍របស់អ្នក

ការទទួលស្គាល់ដំណើរការទាំងស្រុងនៅក្នុងកម្មវិធីរុករកដោយប្រើ WebAssembly។ ការស្នើសុំតាមបណ្ដាញតែមួយគត់គឺសម្រាប់ទាញយកម៉ូឌែល និង runtime របស់ WebAssembly - ទាំងពីរជាសម្បត្តិសាធារណៈ ដែលមានស្ថិរភាព។ យើងមិនមើលឃើញសំឡេងរបស់អ្នក និងយើងមិនមើលឃើញសេចក្តីថត(transcript) នោះទេ។

របៀបដែលការបំប្លែង English ដំណើរការក្នុងកម្មវិធីរុករករបស់អ្នក។

ការសម្គាល់ការនិយាយជាធម្មតាមានន័យថាការផ្ទុកសំឡេងរបស់អ្នកទៅ GPU របស់នរណាម្នាក់។ នៅទីនេះ គំរូដំណើរការនៅលើម៉ាស៊ីនផ្ទាល់ខ្លួនរបស់អ្នកវិញ នោះហើយជាអ្វីដែលធ្វើឱ្យវាឥតគិតថ្លៃ និងឯកជនក្នុងពេលតែមួយ។

Open-source recognition model
គំរូសរសៃប្រសាទប្រភពបើកចំហ ដែលបានបណ្តុះបណ្តាលលើសំឡេងពហុភាសា - នោះហើយជាមូលហេតុដែលការទាញយកតែមួយដោះស្រាយ English ដោយគ្មានគំរូជាក់លាក់ភាសាដើម្បីទាញយក។
WebAssembly
ពេលដំណើរការនៃការទាញសេចក្តីសន្និដ្ឋានត្រូវបានចងក្រងទៅជា WebAssembly ដូច្នេះកូដលេខដំណើរការក្នុងល្បឿនជិតដើមនៅក្នុងផ្ទាំងដែលត្រូវបានការពារដោយគ្មានកម្មវិធីជំនួយ និងគ្មានការដំឡើង។
On-device inference
គំរូដែលបានកំណត់បរិមាណ ~75 MB ត្រូវបានផ្ទុក ហើយរង្វិលជុំឌិកូដត្រូវបានជំរុញទាំងស្រុងនៅខាងម៉ាស៊ីនភ្ញៀវ។ គ្មានអ្វីនៅក្នុងបំពង់បង្ហូរហៅទៅម៉ាស៊ីនមេទេ នៅពេលដែលទំព័របានផ្ទុក។
Web Audio API
ឯកសាររបស់អ្នកត្រូវបានឌិកូដ និងបម្លែងគំរូឡើងវិញទៅជា 16 kHz mono ដែលម៉ូដែលរំពឹងទុក ដោយប្រើបំពង់បង្ហូរអូឌីយ៉ូផ្ទាល់របស់កម្មវិធីរុករក ដូច្នេះទម្រង់ណាមួយដែលកម្មវិធីរុករករបស់អ្នកអាចចាក់បាន ត្រូវបានទទួលយក។
Premium - ផងដែរ​ពី Subformer

សំណួរញឹកញាប់

សាកល្បងភាសាផ្សេងទៀតសម្រាប់សេវាកម្មសម្លេងទៅអត្ថបទឥតគិតថ្លៃ