PDF轉文字
將 PDF 的文字圖層擷取為 .txt 檔。掃描(純圖片)PDF 無法擷取文字。
此工具不會上傳您的檔案。關閉分頁後不會留下任何內容。
將檔案拖放到此處,或
選擇檔案支援格式: PDF · 或按 Ctrl+V 貼上
只要內容,不要排版
有時候排版本身就是麻煩。你可能要從報告裡引用幾段、把整份文件貼進翻譯工具或對話框、統計字數,或是在一堆檔案裡找某一條條款。純文字檔可以直接丟進任何編輯器、試算表或程式裡處理。
輸出是UTF-8編碼,中文和各種符號都不會變成亂碼,文字順序依照PDF內部記錄的次序。這個次序不一定等於閱讀順序:雙欄頁面可能左右交錯,表格會變成對不齊的一行行文字,頁首頁尾則在每一頁重複出現。真正拿去用之前,先從頭看過一遍最保險。
掃描件什麼都抓不出來,因為頁面裡放的是文字的影像而不是文字本身,負責讀它的是pdf-ocr。若想把同樣的文字變成可編輯的Word檔,可以用pdf-to-docx,不過那邊一樣只帶文字,版面同樣不會保留。抽取在瀏覽器裡完成,檔案不會被送到任何地方。
使用方法
- 1
選擇一個 PDF。
- 2
可選:設定頁面範圍。
- 3
按下開始並下載結果。
常見問題
- 結果是空的。
- 掃描 PDF 沒有文字圖層。此類檔案請使用 AI 轉換工具。
- 換行看起來不對。
- PDF 不儲存行結構,只能依位置推斷。多欄排版可能會交錯。