讓 PDF 可搜尋

讓 PDF 可搜尋在你的裝置上以 tesseract.js 執行 OCR,再把每一頁重建為「掃描圖片 + 依辨識詞定位的隱形文字層」。產出的檔案在任何 PDF 閱讀器都能搜尋、複製。免費、零上傳,語言模型快取後可離線使用。

PDFerret 吉祥物:準備上工的白貂

把掃描 PDF 拖進來,加上可搜尋文字層

檔案留在你的巢:全都在你的裝置上處理,絕不上傳。

使用方式

  1. 1放入掃描 PDF,選擇辨識語言。
  2. 2選擇掃描解析度(150 快、300 較準)。
  3. 3按「辨識」,頁面會在你的裝置上逐一處理。
  4. 4下載可搜尋 PDF,並在閱讀器裡試著搜尋一個詞。

常見問題

文字層會跟圖片完全對齊嗎?

對齊依辨識到的詞定位,乾淨的掃描通常只差幾個像素。頁面歪斜、藝術字型或解析度低時,反白位置可能偏離可見文字。搜尋與複製仍然可用,視覺對位在端正清晰的掃描上最準確。

為什麼檔案變大了?

每一頁都以點陣圖片加上文字層保存,這是在不把檔案外傳的前提下讓掃描可搜尋的必然代價。若在意大小,之後再跑一次壓縮工具即可。

如果頁面本來就有文字層,會保留嗎?

不會。處理的頁面會重建為圖片加隱形文字,原本的文字層會被辨識結果取代。如果你的 PDF 本來就能選取文字,其實不需要這個工具。

相關工具