แปลง PDF เป็นข้อความ
ดึงชั้นข้อความของ PDF ออกเป็นไฟล์ .txt ไฟล์สแกน (มีแต่รูป) จะไม่ได้ข้อความ
เครื่องมือนี้ไม่อัปโหลดไฟล์ของคุณ ปิดแท็บแล้วไม่มีอะไรเหลืออยู่
ลากและวางไฟล์ที่นี่ หรือ
เลือกไฟล์รองรับ: PDF · หรือวางด้วย Ctrl+V
อยากได้เนื้อความ ไม่ได้อยากได้หน้ากระดาษ
บางครั้งสิ่งที่ต้องการไม่ใช่เอกสารสวย ๆ แต่เป็นตัวหนังสือข้างใน เช่น คัดข้อความในระเบียบไปใส่โน้ต ค้นหาศัพท์คำเดียวในคู่มือสองร้อยหน้า หรือดึงเนื้อหารายงานไปย่อด้วยเครื่องมืออื่น การลากแถบเลือกข้อความทีละหน้าในโปรแกรมอ่าน PDF ใช้เวลามากกว่าการดึงออกมาทีเดียวทั้งไฟล์
ผลลัพธ์เป็นไฟล์ .txt แบบ UTF-8 สระและวรรณยุกต์ภาษาไทยจึงไม่เพี้ยนไม่ว่าจะเปิดที่ไหน สิ่งที่หายไปคือการจัดหน้า เอกสารสองคอลัมน์อาจอ่านสลับไปมา ตารางกลายเป็นบรรทัดเรียงกัน ส่วนหัวกระดาษและเลขหน้าจะโผล่ซ้ำทุกครั้งที่ขึ้นหน้าใหม่ สำหรับการอ่านและการค้นหาเรื่องนี้ไม่เป็นอุปสรรค แต่อย่าคาดหวังว่าจะประกอบเอกสารเดิมกลับคืนมาได้จากไฟล์นี้
หน้าที่มาจากการสแกนจะไม่ได้ข้อความออกมาเลย เพราะสำหรับคอมพิวเตอร์แล้วตัวอักษรบนนั้นเป็นเพียงส่วนหนึ่งของรูปภาพ เอกสารแบบนั้นต้องใช้เครื่องมือ OCR ถ้าต้องการนำไปแก้ไขต่อใน Word เครื่องมือแปลง PDF เป็น Word จะให้ไฟล์ .docx มา แม้สิ่งที่ติดไปด้วยจะมีเพียงตัวหนังสือเช่นกัน การดึงข้อความทำในเบราว์เซอร์โดยไม่อัปโหลดไฟล์
วิธีใช้
- 1
เลือก PDF
- 2
กำหนดช่วงหน้าหากต้องการ
- 3
คลิกเริ่มแล้วดาวน์โหลดผลลัพธ์
คำถามที่พบบ่อย
- ผลลัพธ์ว่างเปล่า
- PDF ที่สแกนไม่มีชั้นข้อความ ใช้เครื่องมือแปลงด้วย AI สำหรับไฟล์เหล่านั้น
- การขึ้นบรรทัดดูแปลก
- PDF ไม่เก็บโครงสร้างบรรทัด จึงต้องคาดเดาจากตำแหน่ง เลย์เอาต์หลายคอลัมน์อาจสลับกัน