កម្មវិធីចម្លងសំឡេងថត ឬនាំចូលសំឡេង ចម្លងវា កំណត់អត្តសញ្ញាណអ្នកដែលកំពុងនិយាយ និង — ជាជម្រើស — ជួយអ្នកប្រែក្លាយអ្វីដែលបាននិយាយទៅជាកំណត់ចំណាំដែលអាចអនុវត្តបាន។ អ្វីគ្រប់យ៉ាងដែលរសើបនឹងស្ថិតនៅលើឧបករណ៍របស់អ្នក។
នៅលើឧបករណ៍ចាប់ពីដើមដល់ចប់។ សំឡេងមិនដែលចាកចេញពីទូរស័ព្ទរបស់អ្នកឡើយ។ ការចម្លងសំឡេងដំណើរការលើម៉ូដែល Whisper ប្រភពបើកចំហនៅក្នុងស្រុក។ ការកំណត់អត្តសញ្ញាណអ្នកនិយាយប្រើការសរសេរតាមសំឡេង pyannote និងម៉ូដែលបង្កប់ 3D-Speaker — ក៏ជាក្នុងស្រុកផងដែរ។ អ្នកអាចប្រើកម្មវិធីចម្លងសំឡេងនៅលើរបៀបជិះយន្តហោះ។ ជំហានតែមួយគត់ដែលត្រូវការបណ្តាញគឺការទាញយកម៉ូដែលម្តង។
រៀនសំឡេង មិនមែនគ្រាន់តែសំឡេងទេ។ ដាក់ឈ្មោះអ្នកនិយាយម្តង — "នោះជាមិត្តរួមការងាររបស់ខ្ញុំ Dana" — ហើយកម្មវិធីចម្លងសំឡេងនឹងដាក់ស្លាកដោយស្វ័យប្រវត្តិនៅក្នុងរាល់ការថតនាពេលអនាគតដែលនាងនិយាយ។ ទម្រង់សំឡេងត្រូវបានរក្សាទុកតែនៅលើឧបករណ៍របស់អ្នកប៉ុណ្ណោះ ហើយមិនដែលផ្ទុកឡើងទេ។
ជ្រើសរើសកម្រិតគុណភាពរបស់អ្នក។ កម្រិតចម្លងសំឡេងបីមាន៖ លឿន (មូលដ្ឋាន Whisper, ~200 MB), មានតុល្យភាព (Whisper តូច, ~600 MB), និងត្រឹមត្រូវ (Whisper medium, ~1.5 GB)។ កំណត់ចំណូលចិត្តសកល ឬ
ចម្លងការថតសំឡេងណាមួយឡើងវិញជាមួយនឹងកម្រិតផ្សេងគ្នាដោយគ្រាន់តែចុចតែម្តង។
សរសេរច្បាប់ផ្ទាល់ខ្លួនរបស់អ្នក។ ប្រែក្លាយឃ្លាដែលនិយាយទៅជាកាតស្រង់ចេញដែលមានរចនាសម្ព័ន្ធដែលអ្នកអាចធ្វើសកម្មភាពនៅពេលក្រោយ។ និយាយថា "លេងជាមួយឆ្មា" ហើយទទួលបានការងារត្រូវធ្វើ។ និយាយថា "ចូរយើងជួបគ្នាថ្ងៃអង្គារវេលាម៉ោង 3" ហើយទទួលបានព្រឹត្តិការណ៍ប្រតិទិន។ ពីរ
របៀបផ្គូផ្គង៖
- ក្រៅបណ្តាញ (ឃ្លាព្យញ្ជនៈ) — កំណត់ គ្មានសោ API ដំណើរការពេញលេញនៅលើឧបករណ៍។
- AI (ការពិពណ៌នាន័យវិទ្យា) — ជាមួយនឹងការពិពណ៌នាដែលបានកំណត់រចនាសម្ព័ន្ធ LLM ការពិពណ៌នាជាភាសាអង់គ្លេសធម្មតាចាប់យកឃ្លាដោយស្វ័យប្រវត្តិ។
AI ជាជម្រើស យកសោផ្ទាល់ខ្លួនរបស់អ្នក។ សម្រាប់ការចាត់ថ្នាក់ឯកសារ សេចក្តីសង្ខេប និងការស្រង់ចេញដ៏ឆ្លាតវៃនៃការងារត្រូវធ្វើ ព្រឹត្តិការណ៍ប្រតិទិន ការរំលឹក ការសម្រេចចិត្ត សំណួរ និងកំណត់ចំណាំ សូមភ្ជាប់អ្នកផ្តល់សេវាមួយក្នុងចំណោមអ្នកផ្តល់សេវាទាំងបី៖
- Anthropic (Claude)
- OpenAI (ChatGPT)
- Google (Gemini)
អ្នកយកសោ API។ វាត្រូវបានរក្សាទុកដោយសុវត្ថិភាពនៅលើឧបករណ៍របស់អ្នក — មិនដែលនៅលើម៉ាស៊ីនមេរបស់យើង មិនដែលនៅក្នុងការបម្រុងទុកទេ។ ការយល់ព្រមគឺជាជម្រើសចូល និងអាចដកហូតវិញបានគ្រប់ពេល។ មានតែប្រតិចារិកអត្ថបទប៉ុណ្ណោះដែលត្រូវបានផ្ញើទៅកាន់អ្នកផ្តល់សេវារបស់អ្នក
— មិនដែលបញ្ចូលសំឡេង មិនដែលបញ្ចូលឧបករណ៍បំពងសម្លេងឡើយ។ ចំនួនសរុបនៃការប្រើប្រាស់ប្រចាំខែ និងចំនួនសញ្ញាសម្ងាត់ក្នុងមួយការថតត្រូវបានបង្ហាញនៅក្នុងកម្មវិធី ដូច្នេះអ្នកតែងតែដឹងពីអ្វីដែលអ្នកកំពុងចំណាយ។
ការស្រង់ចេញនីមួយៗដកស្រង់ប្រភពរបស់វា។ ប៉ះកាតការងារត្រូវធ្វើ ព្រឹត្តិការណ៍ប្រតិទិន ឬកាតរំលឹក ដើម្បីលោតទៅពេលវេលាពិតប្រាកដនៅក្នុងសំឡេងដែលវាត្រូវបាននិយាយ។ ការស្រង់ចេញមានសម្រង់ពាក្យសំដី និងភ្ជាប់ត្រឡប់ទៅ
ផ្នែកប្រភព ដូច្នេះអ្នកអាចផ្ទៀងផ្ទាត់មុនពេលធ្វើសកម្មភាព។
អ្វីដែល Transcriptinator ពូកែ
- កំណត់ចំណាំកិច្ចប្រជុំជាមួយវាគ្មិន 2–6 នាក់
- ការសម្ភាសន៍ទម្រង់វែង ការបង្រៀន ធម្មទេសនា
- អនុស្សរណៈសំឡេងដែលត្រូវការប្រតិចារិកពិតប្រាកដ មិនមែនគ្រាន់តែការថតនោះទេ
- ការនាំចូលឧបករណ៍ថតសំឡេងវាល (WAV រួមទាំង IMA ADPCM, MP3, M4A, OGG, FLAC)
- ការកសាងលំហូរការងារផ្ទាល់ខ្លួនរបស់អ្នកជាមួយនឹងច្បាប់ផ្ទាល់ខ្លួន
អ្វីដែលវាមិនធ្វើ
- ការដាក់ចំណងជើងផ្ទាល់ក្នុងអំឡុងពេលហៅទូរស័ព្ទ — អ្វីគ្រប់យ៉ាងត្រូវបានដំណើរការបន្ទាប់ពីថត
- ការផ្ទៀងផ្ទាត់អ្នកនិយាយសម្រាប់សុវត្ថិភាព — ការផ្គូផ្គងសំឡេងគឺជាភាពងាយស្រួលនៃការដាក់ស្លាក មិនមែនការផ្ទៀងផ្ទាត់ទេ
- ការធ្វើសមកាលកម្មលើពពក — ដោយចេតនា។ ការថតសំឡេងរបស់អ្នកនៅតែស្ថិតនៅលើទូរស័ព្ទរបស់អ្នក
ឥតគិតថ្លៃ គ្មានការផ្សាយពាណិជ្ជកម្ម គ្មានការលក់បន្ថែម។ កម្មវិធី Transcriptinator គឺឥតគិតថ្លៃ ហើយនឹងនៅតែឥតគិតថ្លៃ។ គ្មានការផ្សាយពាណិជ្ជកម្ម គ្មានការទិញក្នុងកម្មវិធី គ្មានកម្រិតបុព្វលាភ។ មុខងារ AI គឺជាជម្រើសពិតប្រាកដ — កម្មវិធីដំណើរការពេញលេញដោយមិនចាំបាច់មានសេវាកម្មខាងក្រៅណាមួយឡើយ។
អ្នកបោះពុម្ពផ្សាយ៖ Cherry Blossom Development, LLC
ចម្លងសំឡេងពីឧបករណ៍ថតសំឡេងណាមួយ កំណត់អត្តសញ្ញាណអ្នកនិយាយ និងចាត់ថ្នាក់
បានដំឡើងកំណែនៅ
4 កញ្ញា 2026