無需上傳, 100% 本機處理, 無需帳戶

操作教學

讓掃描 PDF 變成可以搜尋

掃描出來的 PDF 看起來像一份普通文件,但其實是一張頁面的圖片:按 Ctrl+F 什麼都找不到,也無法選取或複製任何一個字。PDF OCR 工具能在不改變檔案本質的前提下解決這個問題。它讀取每一頁的影像,用裝置端的 OCR 引擎辨識文字,再把辨識出的文字以看不見的方式疊在同一張影像上,所以 PDF 看起來、印出來都和原本一模一樣,但現在能被搜尋、能被選取文字。檔案不會離開你的裝置。

逐步教學

  1. 打開 PDF OCR 工具,拖入你的掃描 PDF。只接受 PDF 檔案,檔案大小上限為 80 MB;一般的多頁掃描檔遠遠不到這個上限。
  2. 從下拉選單選擇文件的語言(英文、法文、德文、西班牙文、葡萄牙文或義大利文),如果想要,也可以編輯輸出檔名,預設會自動保留 .pdf 副檔名。
  3. 點擊「執行」,等待每一頁處理完成。每一頁都會先渲染、跑過 OCR 引擎、加上專屬的隱形文字層,才會處理下一頁,所以長文件會比單頁文件花更久的時間。下載結果:它打開和列印出來都和原本完全一樣,但 Ctrl+F、選取文字和複製貼上現在都能用了。

可搜尋 PDF 還是純文字:你真正需要哪一種

這個工具和純 OCR 工具解決的是同一個根本問題,也就是辨識掃描影像中的文字,但保留的東西不一樣。OCR 工具會丟掉頁面影像,回傳一份純 .txt 檔:如果你想把文字貼進編輯器、翻譯或以文字方式搜尋,而不在乎保留文件原本的外觀,就用這個。這裡的 PDF OCR 工具會讓原始 PDF(包括頁面影像)完全維持原樣,只在底下加上一層隱形文字:如果文件仍需要以 PDF 的形式列印、寄送或封存,但你也想能搜尋或複製其中內容,就用這個。兩個工具都不會把版面重建成帶有真實字型和表格的可編輯文字;兩者都是從同一份辨識文字出發,只是包裝方式不同。

為什麼結果取決於掃描品質,限制又在哪裡

辨識準確度取決於來源影像的品質,這一點和純 OCR 一樣:乾淨、端正、解析度落在 200 到 300 DPI 左右的掃描檔,辨識結果可靠;模糊的照片、歪斜的頁面或濃重的陰影,會產生更多辨識錯誤的文字。如果某一頁掃歪了,先用 PDF 校正工具把它擺正,再跑 OCR,讓辨識步驟讀到的是水平的文字。這個工具支援六種語言(英文、法文、德文、西班牙文、葡萄牙文、義大利文);不支援的語言,辨識結果不會正確。處理是一頁一頁在你的瀏覽器分頁中進行的,所以幾十頁的文件會比兩頁的掃描檔明顯花更久,檔案上限為 80 MB。輸出的 PDF 體積通常也和原檔差不多,因為頁面影像本身沒有被動過;如果之後需要更小的檔案,可以再跑一次 PDF 壓縮工具。

隱形文字層是怎麼建立的

每一頁 PDF 會先在你的瀏覽器中點陣化成畫布影像,這一步和 PDF 轉圖片工具用的是同一種渲染方式。OCR 引擎(編譯成 WebAssembly 的 Tesseract)讀取這張影像,回傳每個辨識出的單字,連同它的邊界框,也就是它在頁面上的位置。接著,這些文字會被畫回原始 PDF 頁面的副本上,位置對應辨識結果,但透明度為零,所以視覺上完全沒有變化:你看到、印出來的頁面影像,仍然是被掃描的那一張,疊在最上層。PDF 檢視器的搜尋與文字選取功能,只會去讀取這層隱形文字,這就是為什麼檔案能變得可搜尋、可選取,卻不會改變外觀。渲染、辨識和重組這一整套流程,都發生在你的瀏覽器分頁裡;PDF 是從本機磁碟讀取的,絕不會被傳送到任何地方。

本指南使用的工具

常見問題

可搜尋的 PDF,外觀和列印結果還會和原始掃描檔一模一樣嗎?

會。這個工具完全不會修改頁面影像,只會在底下加一層隱形文字。不論在螢幕上還是印在紙上,輸出結果和你拖入的掃描檔在視覺上完全相同。改變的是,檢視器的搜尋與文字選取功能現在能找到並抓取辨識出的文字,因為它們讀的是那層隱藏圖層。

為什麼有了純 OCR 工具,還需要這個工具?

它們是用同一個辨識步驟,回應不同的需求。OCR 工具給你一份純文字檔,如果你打算貼上、編輯或翻譯這些文字,又不需要把文件留成 PDF,這正是你要的。這個工具則讓檔案仍然是一份 PDF,原始頁面影像完整保留,如果文件仍需要照原樣列印、封存或寄送,同時你也想能搜尋或複製其中的文字,這正是你要的。

來源