無需上傳, 100% 本機處理, 無需帳戶

讓掃描版 PDF 變得可搜尋

拖入掃描版 PDF,取得疊加隱形可搜尋文字層的相同頁面。辨識完全在瀏覽器中執行(裝置端,首次載入後可離線),不會上傳任何內容。

PDF OCR · 讓掃描檔可搜尋 的運作方式

PDF OCR 會把一份掃描 PDF(也就是只由頁面影像組成、沒有真正文字的檔案)變成可搜尋的 PDF:頁面影像維持不變,只是在每個辨識出的字詞上方,疊加一層看不見的文字層。用任何 PDF 閱讀器打開結果,你現在就能用 Ctrl+F 找字、選取並複製一段文字,或讓搜尋引擎為文件建立索引,這些都是純掃描檔做不到的事。辨識本身是用 tesseract.js 完成的(和 OCR 工具用的是同一套自架 OCR 引擎),頁面渲染則用 pdf.js;兩者都完全在你的瀏覽器分頁中執行,檔案不會被上傳。

這個工具對自己能做什麼、不能做什麼很誠實。它不會重建版面、表格或字型,也不是可編輯文件轉換工具:看得見的頁面仍然是一張圖片,和來源掃描檔一模一樣,只是外觀底下多了一層隱藏的文字。辨識準確度取決於掃描品質,適用的仍是任何 OCR 引擎共通的建議:至少 200 DPI、對比清晰、頁面端正。如果你只需要純文字內容,而不需要能在裡面搜尋的 PDF,OCR 工具會直接產生 .txt 檔,處理這類需求也更快。

PDF OCR · 讓掃描檔可搜尋 的分步使用說明

  1. 把你的掃描 PDF(每頁一張頁面影像,沒有既有文字層)拖進上傳區域。
  2. 從語言下拉選單中選擇文件的主要語言。
  3. 如果這是你第一次使用這個工具,請等待 tesseract.js 引擎下載完成(只需要下載一次)。
  4. 點擊執行,等待每一頁依序完成渲染與辨識。
  5. 下載可搜尋的 PDF:外觀不變,但底下多了一層文字。

常見使用情境

  • 一份掃描合約需要變得可搜尋,這樣才能用 Ctrl+F 找到特定條款,而不必逐頁閱讀。
  • 一批掃描發票要放進文件檔案庫,而該檔案庫的搜尋索引只讀取真正的 PDF 文字。
  • 一份拍照或掃描的表單,需要讓上面的印刷文字變成可選取的內容,才能把某一段複製進電子郵件。
  • 一批德文掃描報告需要支援全文搜尋;在執行工具前,先把語言選為德文。

常見問題

這和純 OCR 工具有什麼不同?

OCR 工具會把純文字擷取到一個 .txt 檔,完全捨棄原始版面和圖片。PDF OCR 則會保留原本的 PDF 頁面影像,外觀完全不變,只在底下加上一層看不見、可搜尋的文字。只想要文字內容時用 OCR;想讓文件仍然維持 PDF 格式,但又能搜尋、選取內容時,用 PDF OCR。

輸出的 PDF 外觀會和我的掃描檔不一樣嗎?

不會。每一頁都是從你的來源 PDF 渲染出來,再重新嵌入成影像,像素上和原始掃描檔幾乎一致(JPEG 重新編碼可能帶來的差異除外)。辨識出的文字會以完全透明的方式疊在上面,所以視覺上不會多出任何東西;只有透過文字搜尋或文字選取,才會發現這層額外的文字。

工具會重建表格、欄位或字型嗎?

不會。輸出仍然把頁面保留成單一的扁平影像;隱形文字層會依辨識出的字詞位置排列,但不會保留表格結構,也不會超出 tesseract.js 自己推斷的多欄閱讀順序,更不會保留原始字型。這是一層可搜尋性,不是把文件轉成可編輯文字的轉換。

處理過程中,我的掃描文件會被送到任何地方嗎?

不會。從本站下載 tesseract.js 引擎與語言包之後(第一次使用時只需下載一次,大小為幾 MB),之後每一次頁面渲染與辨識,都完全在你的瀏覽器分頁中進行。掃描合約、醫療紀錄或其他敏感文件,絕不會送達伺服器。

為什麼一份長 PDF 要處理比較久?

每一頁都會先渲染成影像,再個別執行 OCR,整個過程都在你的瀏覽器分頁中完成,所以處理時間會隨頁數增加。進度條反映的是逐頁的真實進度,檔案上限也設在 80 MB,確保整個流程不會超出瀏覽器分頁能負荷的記憶體。

如果我的 PDF 已經有可選取的文字呢?

對已經帶有真正文字層的 PDF 執行 OCR 沒有必要:用閱讀器打開它,按 Ctrl+F 就已經能用了。這個工具是為了處理只有頁面影像、底下沒有文字的 PDF 而設計的,這常見於平台式掃描器的輸出,或是把拍攝的文件「列印成 PDF」的結果。