這個工具會在瀏覽器中逐頁讀取 PDF,把可選取的文字整理成純文字結果。您可以處理整份文件,也可以指定起始頁與結束頁,只擷取需要的頁面範圍。
如果 PDF 只是掃描影像,檔案內沒有內嵌文字,輸出結果可能會是空白。遇到這種情況時,請先把頁面匯出或截成圖片,再用圖片 OCR 取得辨識文字。
關於這個主題的常見疑問與實用解答。
選擇 PDF 後,工具會自動擷取檔案內已存在的文字。保留「擷取全部頁面」即可處理整份文件,也可以輸入起始頁與結束頁,只處理需要的範圍。結果會保留每頁對應的原始 PDF 頁碼。
除非 PDF 已經含有 OCR 文字層,否則無法擷取。純圖片頁面沒有可供這個工具讀取的內嵌文字,因此結果可能是空白。請先將頁面匯出或截成圖片,再用圖片 OCR 辨識文字。
可以。關閉「擷取全部頁面」,再輸入需要的第一頁與最後一頁。工具會擷取這段連續範圍內的每一頁,並在結果中保留原始頁碼;目前無法在同一次處理中合併多段不連續範圍。
不會。輸出是依 PDF 提供的順序收集而成的純文字,不會保留字型、圖片、表格儲存格、欄位或頁面視覺排版,因此複雜的多欄文件可能會出現不同的文字順序。
可以。搜尋會檢查所有已擷取頁面,並讓你移到包含結果的頁面。你可以複製目前頁面、複製全文,或將目前選取的「原文」或「整理後」版本下載為 TXT 檔。
「原文」會保留擷取結果不變;「整理後」只會統一換行、移除行尾半形空白並縮減過多空白行。它不會改寫文字、不使用 OCR 或 AI、不重建多欄排版,也不會轉成 Markdown,而且可隨時切回原文。