PDF ទៅអត្ថបទ

ស្រង់អត្ថបទពី PDF តាមអនឡាញ៖ ចម្លង ឬទាញយកជាឯកសារ .txt ម្ដងមួយទំព័រ ដោយរក្សាបន្ទាត់ និងកថាខណ្ឌ។ ឥតគិតថ្លៃ ឯកជន គ្មានការផ្ទុកឡើងទេ។

ឯកសារត្រូវបានអានដោយកម្មវិធីរុករករបស់អ្នក ហើយមិនត្រូវបានផ្ញើទៅកន្លែងណាទេ។ គ្មានការផ្ទុកឡើង និងគ្មានការរក្សាទុក។

វាធ្វើអ្វី


ឧបករណ៍នេះអានអត្ថបទរបស់ PDF ហើយប្រគល់វាវិញជាអត្ថបទធម្មតា ដែលអ្នកអាចចម្លង កែសម្រួល ឬរក្សាទុកជាឯកសារ .txt។ បន្ទាត់ និងកថាខណ្ឌត្រូវបានបង្កើតឡើងវិញពីទីតាំងនៃពាក្យនៅលើទំព័រ ហើយទំព័រអាចត្រូវបានសម្គាល់ ដើម្បីឱ្យអ្នកដឹងថាទំព័រនីមួយៗចាប់ផ្ដើមនៅឯណា។ វាដំណើរការជាមួយ PDF ណាដែលមានអត្ថបទពិត ដូចជាឯកសារដែលនាំចេញពីកម្មវិធីវាយអត្ថបទ។ ទំព័រដែលបានស្កេនជារូបភាព ហើយគ្មានអត្ថបទសម្រាប់ស្រង់ទេ។

របៀបប្រើ


  1. ជ្រើសរើស PDF។
  2. ចុច ស្រង់អត្ថបទ។ ឯកសារវែងៗចំណាយពេលពីរបីវិនាទី។
  3. ចម្លងអត្ថបទ ឬទាញយកវាជាឯកសារ .txt។

សំណួរដែលសួរញឹកញាប់


ហេតុអ្វីបានជារកមិនឃើញអត្ថបទក្នុង PDF របស់ខ្ញុំ?
ព្រោះទំព័រជារូបភាព ដូចក្នុងឯកសារដែលបានស្កេន ឬរូបថតដែលរក្សាទុកជា PDF។ ក្នុងករណីនោះ PDF គ្មានអត្ថបទនៅខាងក្នុងទេ មានតែភីកសែល ហើយការអានវាត្រូវការការសម្គាល់តួអក្សរ (OCR)។

តើប្លង់ត្រូវបានរក្សាទុកដែរឬទេ?
អត្ថបទរក្សាបន្ទាត់ និងកថាខណ្ឌរបស់វា ប៉ុន្តែមិនរក្សាពុម្ពអក្សរ ជួរឈរ ឬរូបភាពទេ។ ក្នុងឯកសារពីរជួរឈរ អត្ថបទនៃបន្ទាត់នីមួយៗអាចលាយទាំងពីរជួរឈរ។ តារាងក្លាយជាបន្ទាត់អត្ថបទដែលមានដកឃ្លារវាងក្រឡា។

តើឯកសាររបស់ខ្ញុំមានសុវត្ថិភាពទេ?
បាទ/ចាស។ PDF ត្រូវបានអានដោយកម្មវិធីរុករករបស់អ្នក ហើយមិនដែលត្រូវបានផ្ញើទៅម៉ាស៊ីនមេទេ ដូច្នេះឧបករណ៍នេះអាចប្រើជាមួយឯកសារឯកជនបាន។

តើវាដំណើរការជាមួយភាសាណាក៏បានដែរឬទេ?
បាទ/ចាស ដរាបណា PDF មានអត្ថបទពិត ហើយពុម្ពអក្សររបស់វាផ្គូផ្គងតួអក្សរបានត្រឹមត្រូវ។ PDF ចាស់ៗ ឬដែលបង្កើតមិនបានល្អខ្លះ បង្ហាញអត្ថបទត្រឹមត្រូវលើអេក្រង់ ប៉ុន្តែផ្ដល់តួអក្សរខូចនៅពេលស្រង់អត្ថបទ។ នោះជាបញ្ហារបស់ឯកសារ ហើយមានតែ OCR ទេដែលអាចសង្គ្រោះវាបាន។

Wikipedia — PDF
Wikipedia — Optical character recognition