什麼是圖片轉文字(OCR)?
這個圖片轉文字工具使用 OCR(光學字元辨識)讀取圖片中的印刷文字,並轉換成純文字。不必再手動打出紙本文件或截圖裡的內容,只要選擇圖片,就能直接複製結果。
工具在瀏覽器內執行開放原始碼 OCR 引擎 Tesseract,因此圖片完全不會上傳到伺服器。只有第一次會下載引擎與語言資料(每種語言 1~3 MB),之後會直接從瀏覽器儲存空間載入。中文辨識使用的是繁體中文資料。
使用方法
- 點選選擇圖片挑選照片或掃描檔,或按 Ctrl+V 貼上截圖。
- 選擇圖片中文字的語言。只勾選實際出現的語言,辨識會更快、更準確。
- 進度條到 100% 後,文字會顯示在下方欄位,辨識錯誤可以直接在欄位中修改。
- 點選複製文字或儲存 .txt 帶走結果。
提高辨識準確度的訣竅
- 請在光線充足的地方正面拍攝文件。歪斜或有陰影的照片準確度會大幅下降。
- 字高在 20 像素以上較容易辨識。小字請放大後只拍那一部分(較小的圖片會自動放大)。
- 遇到彩色背景或模糊照片時,請保持開啟灰階+對比強化。
- 只選擇文件中有的語言。多選其他語言時,文字可能被誤認成其他文字系統中外形相似的字元。
- 表格、手寫字、直書(直排)文字與裝飾字型的準確度較低。
各語言的下載大小
| 語言 | 下載大小 |
|---|---|
| OCR 引擎(共用,只需一次) | 約 1.4 MB |
| 繁體中文 | 約 1.7 MB |
| 英文 | 約 3.0 MB |
| 西班牙文 | 約 2.1 MB |
| 日文 | 約 2.0 MB |
| 韓文、德文、法文、葡萄牙文、義大利文 | 各 0.7~1.7 MB |
下載的資料會保留在瀏覽器儲存空間中,下次就能立即開始辨識。使用行動網路時,建議第一次先在 Wi-Fi 環境下使用。
常見問題
圖片會上傳到伺服器嗎?
不會。文字辨識完全在你裝置上的瀏覽器中進行。只會下載 OCR 引擎與語言資料,圖片和擷取出的文字都不會傳送到任何地方。
可以辨識手寫字嗎?
工整的正楷有時可以辨識,但引擎是針對印刷文字訓練的,手寫字的準確度偏低。
可以從 PDF 擷取文字嗎?
只支援圖片檔。掃描的 PDF 請先用 PDF 轉圖片將頁面轉成 JPG。如果 PDF 中的文字可以選取,直接在 PDF 閱讀器中複製會更準確。
為什麼第一次比較慢?
第一次需要下載 OCR 引擎與語言資料。之後會使用已儲存的資料,通常幾秒內就能完成辨識;非常大的照片會花比較久。
支援直書的中文或日文嗎?
引擎主要針對橫書調整,直書文字的辨識效果較差,建議用於橫書內容。另外,中文資料為繁體中文,簡體中文的準確度會較低。