讓 PDF 可搜尋
讓 PDF 可搜尋在你的裝置上以 tesseract.js 執行 OCR,再把每一頁重建為「掃描圖片 + 依辨識詞定位的隱形文字層」。產出的檔案在任何 PDF 閱讀器都能搜尋、複製。免費、零上傳,語言模型快取後可離線使用。

把掃描 PDF 拖進來,加上可搜尋文字層
檔案留在你的巢:全都在你的裝置上處理,絕不上傳。
使用方式
- 1放入掃描 PDF,選擇辨識語言。
- 2選擇掃描解析度(150 快、300 較準)。
- 3按「辨識」,頁面會在你的裝置上逐一處理。
- 4下載可搜尋 PDF,並在閱讀器裡試著搜尋一個詞。
常見問題
文字層會跟圖片完全對齊嗎?
對齊依辨識到的詞定位,乾淨的掃描通常只差幾個像素。頁面歪斜、藝術字型或解析度低時,反白位置可能偏離可見文字。搜尋與複製仍然可用,視覺對位在端正清晰的掃描上最準確。
為什麼檔案變大了?
每一頁都以點陣圖片加上文字層保存,這是在不把檔案外傳的前提下讓掃描可搜尋的必然代價。若在意大小,之後再跑一次壓縮工具即可。
如果頁面本來就有文字層,會保留嗎?
不會。處理的頁面會重建為圖片加隱形文字,原本的文字層會被辨識結果取代。如果你的 PDF 本來就能選取文字,其實不需要這個工具。