រូបភាពទៅអត្ថបទ (OCR)
OCR អនឡាញឥតគិតថ្លៃ៖ ទាញយកអត្ថបទពីរូបភាព រូបថតអេក្រង់ រូបថត និង PDF ដែលបានស្កេន ជា 24 ភាសា។ ដំណើរការក្នុងកម្មវិធីរុករករបស់អ្នក គ្មានអ្វីត្រូវបានផ្ទុកឡើងទេ។
វាធ្វើអ្វី
ឧបករណ៍នេះប្រើ OCR (ការស្គាល់តួអក្សរតាមអុបទិក) ដើម្បីបំប្លែងអត្ថបទក្នុងរូបភាព ទៅជាអត្ថបទដែលអ្នកអាចចម្លង កែសម្រួល និងស្វែងរកបាន។ វាដំណើរការជាមួយរូបថតអេក្រង់ រូបថតឯកសារ ទំព័រដែលបានស្កេន និង PDF ដែលមានតែរូបភាព។ ការស្គាល់អក្សរធ្វើឡើងដោយ Tesseract ដែលជាម៉ាស៊ីន OCR កូដចំហ ដំណើរការនៅក្នុងកម្មវិធីរុករករបស់អ្នកផ្ទាល់ ដូច្នេះឯកសារមិនដែលចាកចេញពីឧបករណ៍របស់អ្នកឡើយ។ អត្ថបទតូចៗត្រូវបានពង្រីកដោយស្វ័យប្រវត្តិមុនពេលអាន ដែលកាត់បន្ថយកំហុសបានគួរឱ្យកត់សម្គាល់។
របៀបប្រើ
- ជ្រើសរើសរូបភាពមួយ ឬច្រើន ឬ PDF មួយ អូសវាមកទីនេះ ឬបិទភ្ជាប់រូបថតអេក្រង់។
- សូមពិនិត្យភាសារបស់អត្ថបទ។ ការអានចាប់ផ្តើមដោយខ្លួនឯង ប្រសិនបើអ្នកប្តូរភាសា សូមចុច ទាញយកអត្ថបទ ម្តងទៀត។
- ពិនិត្យលទ្ធផល កែអ្វីដែលអានខុស បន្ទាប់មកចម្លង ឬទាញយកជាឯកសារ .txt។
សំណួរដែលសួរញឹកញាប់
តើរូបភាពរបស់ខ្ញុំត្រូវបានផ្ទុកឡើងទេ?
ទេ។ ម៉ាស៊ីនស្គាល់អក្សរ និងទិន្នន័យភាសាត្រូវបានទាញយកមកកម្មវិធីរុករករបស់អ្នក ហើយរូបភាព និង PDF ត្រូវបានដំណើរការនៅទីនោះ។ គ្មានអ្វីត្រូវបានផ្ញើទៅម៉ាស៊ីនមេទេ ដូច្នេះវាមានសុវត្ថិភាពក្នុងការប្រើជាមួយឯកសារឯកជន។
តើវាត្រឹមត្រូវប៉ុណ្ណា?
ចំពោះអត្ថបទបោះពុម្ពច្បាស់ ភាសាដែលសរសេរជាអក្សរឡាតាំងជាធម្មតាស្គាល់តួអក្សរត្រឹមត្រូវលើសពី 99% ហើយប្រព័ន្ធអក្សរផ្សេងទៀតជាទូទៅចន្លោះពី 93% ដល់ 99%។ ភាពត្រឹមត្រូវធ្លាក់ចុះចំពោះរូបថតព្រាល ភាពផ្ទុយពណ៌ទាប ទំព័រកោង ពុម្ពអក្សរតុបតែង និងការសរសេរដោយដៃ។ ដើម្បីទទួលបានលទ្ធផលល្អបំផុត សូមប្រើរូបភាពច្បាស់ មានពន្លឺល្អ និងត្រង់ ហើយជ្រើសរើសភាសាឱ្យត្រឹមត្រូវ។
តើគាំទ្រភាសាអ្វីខ្លះ?
24 ភាសា៖ អង់គ្លេស ព័រទុយហ្គាល់ អេស្ប៉ាញ បារាំង អាល្លឺម៉ង់ អ៊ីតាលី ស៊ុយអែត អាហ្វ្រិកាន ទួរគី ឥណ្ឌូណេស៊ី ម៉ាឡេ ហ្វីលីពីន វៀតណាម រុស្ស៊ី អារ៉ាប់ អ៊ូរឌូ ហិណ្ឌី តាមិល ថៃ ខ្មែរ ជប៉ុន កូរ៉េ និងចិនអក្សរសាមញ្ញ និងចិនអក្សរបុរាណ។ អ្នកអាចផ្សំភាសាពីរ នៅពេលអត្ថបទលាយឡំភាសាទាំងពីរ។
តើវាអាចអានការសរសេរដោយដៃបានទេ?
បានតែខ្សោយប៉ុណ្ណោះ។ ម៉ាស៊ីននេះត្រូវបានបណ្តុះបណ្តាលលើអត្ថបទបោះពុម្ព៖ អក្សរធំសរសេរដាច់ៗយ៉ាងស្អាតពេលខ្លះអាចអានបាន ប៉ុន្តែការសរសេរដោយដៃជាប់ៗគ្នាជាធម្មតាចេញមកខុស។
តើវាដំណើរការជាមួយ PDF ដែលបានស្កេនទេ?
មែនហើយ។ ទំព័រនីមួយៗត្រូវបានបង្ហាញក្នុងគុណភាពបង្ហាញខ្ពស់ ហើយអានម្តងមួយៗ ហើយអ្នកអាចសម្គាល់កន្លែងដែលទំព័រនីមួយៗចាប់ផ្តើម។ ប្រសិនបើ PDF មានអត្ថបទដែលអាចជ្រើសរើសបានរួចហើយ ឧបករណ៍ PDF ទៅអត្ថបទ លឿនជាង និងត្រឹមត្រូវជាង។
Wikipedia — Optical character recognition
Wikipedia — Tesseract (software)