圖片轉文字(OCR)

免費線上OCR文字辨識:從圖片、螢幕截圖、照片和掃描的PDF中擷取文字,支援24種語言。完全在瀏覽器中執行,任何檔案都不會上傳。

也可以將檔案拖曳到這裡,或按 Ctrl+V(Mac 上為 ⌘+V)貼上螢幕截圖。 文字由您的瀏覽器辨識。檔案不會傳送到任何地方:不上傳,也不儲存。
每種語言只需下載一次(1 到 3 MB),之後會儲存在瀏覽器中。如果文字夾雜拉丁字母的單字,請加入英文作為第二語言。

它做什麼


本工具使用OCR(光學字元辨識)將圖片中的文字轉換成可複製、編輯和搜尋的文字。適用於螢幕截圖、文件照片、掃描頁面以及只有影像的PDF。辨識由開放原始碼OCR引擎Tesseract在您自己的瀏覽器中執行,檔案絕不會離開您的裝置。小字會在辨識前自動放大,能明顯減少錯誤。

使用方式


  1. 選擇一張或多張圖片或一個PDF,拖曳到這裡,或貼上螢幕截圖。
  2. 確認文字的語言。辨識會自動開始;如果變更了語言,請再按一次「擷取文字」。
  3. 檢查結果,修正辨識錯誤的地方,再複製或下載為 .txt 檔案。

常見問題


我的圖片會被上傳嗎?
不會。辨識引擎和語言資料會下載到您的瀏覽器,圖片和PDF都在那裡處理。不會傳送任何內容到伺服器,因此可安心用於私人文件。

準確度如何?
對於清晰的印刷文字,拉丁字母語言的字元正確率通常超過99%,其他文字一般介於93%到99%之間。照片模糊、對比度低、頁面彎曲、裝飾字型和手寫字都會降低準確度。想要最佳結果,請使用清晰、光線充足且端正的影像,並選擇正確的語言。

支援哪些語言?
24種語言:英文、葡萄牙文、西班牙文、法文、德文、義大利文、瑞典文、南非語、土耳其文、印尼文、馬來文、菲律賓文、越南文、俄文、阿拉伯文、烏爾都文、印地文、泰米爾文、泰文、高棉文、日文、韓文,以及簡體中文和繁體中文。文字混用兩種語言時,可同時選擇這兩種語言。

可以辨識手寫字嗎?
效果不佳。引擎是以印刷文字訓練的:工整的大寫印刷體有時可以辨識,但連筆手寫通常會辨識錯誤。

支援掃描的PDF嗎?
支援。每一頁都會以高解析度轉譯並依序辨識,還可以標記每頁的起始位置。如果PDF已含有可選取的文字,使用「PDF 轉文字」工具會更快、更精確。

Wikipedia — Optical character recognition
Wikipedia — Tesseract (software)