PDF 轉文字

線上擷取 PDF 中的文字:逐頁擷取並保留原有的行和段落,可直接複製或下載為 .txt 檔案。免費、私密,檔案不會上傳到任何地方。

檔案由你的瀏覽器讀取,不會傳送到任何地方。沒有上傳,也沒有儲存。

它做什麼


這個工具讀取 PDF 中的文字,並以純文字形式傳回,你可以複製、編輯或儲存為 .txt 檔案。行和段落會依頁面上文字的位置重建,還可以標記每一頁的開頭位置。適用於任何包含真實文字的 PDF,例如從文書處理軟體匯出的文件;掃描頁面是影像,沒有可擷取的文字。

使用方式


  1. 選擇 PDF。
  2. 按下「擷取文字」。較長的文件需要幾秒鐘。
  3. 複製文字或將其下載為 .txt 檔案。

常見問題


為什麼在我的 PDF 中找不到文字?
因為頁面是影像,例如掃描的文件或儲存為 PDF 的照片。這種情況下 PDF 裡沒有文字,只有像素,要讀取它需要文字辨識(OCR)。

版面會保留嗎?
文字會保留行和段落,但不保留字型、分欄或圖片。在雙欄文件中,每行文字可能混合兩欄的內容;表格會變成儲存格之間以空格分隔的文字行。

我的文件安全嗎?
安全。PDF 由你的瀏覽器讀取,從不傳送到伺服器,因此可以用於私人文件。

支援所有語言嗎?
支援,只要 PDF 包含真實文字,且其字型正確對應了字元。一些舊的或製作不當的 PDF 在螢幕上顯示正常,但擷取時會出現亂碼;這是檔案本身的問題,只有 OCR 才能復原。

Wikipedia — PDF
Wikipedia — Optical character recognition