PDF 轉 Markdown

PDF 轉 Markdown 在文字抽取之上加入結構啟發式:以字級判斷標題、清單符號轉為項目符號或編號、換行段落重新組合、重複出現的頁首頁尾自動剔除。適合把 PDF 內容餵給 LLM 或筆記軟體。

PDFerret 吉祥物:準備上工的白貂

把 PDF 拖進來抽出 Markdown

檔案留在你的巢:全都在你的裝置上處理,絕不上傳。

使用方式

  1. 1放入有文字層的 PDF(純掃描請先 OCR)。
  2. 2需要時可選頁面範圍。
  3. 3按「抽出」,在編輯框裡檢視 Markdown。
  4. 4複製到剪貼簿或下載 .md 檔。

常見問題

Markdown 輸出的還原度如何?

這是啟發式結果,不是版面重建。標題來自相對字級、清單來自行首符號,表格或多欄版面會以一般段落呈現。若只要純文字不要結構,PDF 轉文字工具才是誠實的選擇。

對 LLM 和 AI 工具有什麼好處?

Markdown 保留了標題層級與清單結構,語言模型和筆記軟體解析起來遠比純文字傾印好。整個流程都在你的裝置上完成,私人文件不會為了產生檔案而外流。

我的 PDF 是掃描件,結果是空的,怎麼辦?

掃描頁面只有像素、沒有文字。請先用 OCR 工具辨識文字,或使用可搜尋 PDF 工具,再從結果抽出 Markdown。

相關工具