PDF ke Teks

Ekstrak teks daripada PDF dalam talian: salin atau muat turun fail .txt, halaman demi halaman, dengan baris dan perenggan dikekalkan. Percuma, tiada muat naik.

Fail dibaca oleh pelayar anda dan tidak dihantar ke mana-mana. Tiada muat naik, tiada penyimpanan.

Apa yang ia lakukan


Alat ini membaca teks PDF dan memulangkannya sebagai teks biasa yang boleh anda salin, sunting atau simpan sebagai fail .txt. Baris dan perenggan dibina semula berdasarkan kedudukan perkataan pada halaman, dan halaman boleh ditandakan supaya anda tahu di mana setiap halaman bermula. Ia berfungsi dengan mana-mana PDF yang mengandungi teks sebenar, seperti dokumen yang dieksport daripada pemproses perkataan; halaman imbasan ialah imej dan tiada teks untuk diekstrak.

Cara menggunakannya


  1. Pilih PDF.
  2. Tekan Ekstrak teks. Dokumen panjang mengambil masa beberapa saat.
  3. Salin teks atau muat turun sebagai fail .txt.

Soalan lazim


Mengapa tiada teks ditemui dalam PDF saya?
Kerana halamannya ialah imej, seperti dalam dokumen imbasan atau foto yang disimpan sebagai PDF. Dalam keadaan itu PDF tidak mengandungi teks, hanya piksel, dan membacanya memerlukan pengecaman aksara (OCR).

Adakah susun atur dikekalkan?
Teks mengekalkan baris dan perenggannya, tetapi bukan fon, lajur atau imej. Dalam dokumen dua lajur, teks setiap baris mungkin mencampurkan kedua-dua lajur; jadual menjadi baris teks dengan ruang di antara sel.

Adakah dokumen saya selamat?
Ya. PDF dibaca oleh pelayar anda dan tidak pernah dihantar ke pelayan, jadi alat ini boleh digunakan dengan dokumen peribadi.

Adakah ia berfungsi dengan sebarang bahasa?
Ya, selagi PDF mengandungi teks sebenar dan fonnya memetakan aksara dengan betul. Sesetengah PDF lama atau yang dibuat dengan buruk memaparkan teks yang betul pada skrin tetapi memberikan aksara bercelaru apabila teks diekstrak; itu masalah fail, dan hanya OCR boleh memulihkannya.

Wikipedia — PDF
Wikipedia — Optical character recognition