OCR · 圖片/PDF 轉文字 的運作方式
OCR 工具使用完全在你瀏覽器內執行的 tesseract.js,將掃描的圖片或以圖片為基礎的 PDF 轉換為可複製、搜尋和編輯的文字。你從選擇器中選擇文件語言,相關的語言模型下載至你的瀏覽器一次,此後所有辨識工作都可從快取的模型離線執行。轉換過程中,你的掃描檔案從不傳送至任何伺服器。
辨識準確性在很大程度上取決於掃描品質。200 DPI 或以上的清晰高對比掃描,背景雜訊極少且頁面對齊良好,可產生最佳效果。模糊、低解析度或重度壓縮的 JPEG、有多欄或複雜版面的頁面,以及手寫文字,都會降低準確性。工具輸出純文字區塊;如需保留表格或多欄版面等結構化輸出,需要後處理。對彎曲的掃描件在 OCR 前先執行「PDF 糾偏」工具,通常可改善辨識率。