แปลง PDF เป็นข้อความ

ดึงชั้นข้อความของ PDF ออกเป็นไฟล์ .txt ไฟล์สแกน (มีแต่รูป) จะไม่ได้ข้อความ

เครื่องมือนี้ไม่อัปโหลดไฟล์ของคุณ ปิดแท็บแล้วไม่มีอะไรเหลืออยู่

ลากและวางไฟล์ที่นี่ หรือ

เลือกไฟล์

รองรับ: PDF · หรือวางด้วย Ctrl+V

อยากได้เนื้อความ ไม่ได้อยากได้หน้ากระดาษ

บางครั้งสิ่งที่ต้องการไม่ใช่เอกสารสวย ๆ แต่เป็นตัวหนังสือข้างใน เช่น คัดข้อความในระเบียบไปใส่โน้ต ค้นหาศัพท์คำเดียวในคู่มือสองร้อยหน้า หรือดึงเนื้อหารายงานไปย่อด้วยเครื่องมืออื่น การลากแถบเลือกข้อความทีละหน้าในโปรแกรมอ่าน PDF ใช้เวลามากกว่าการดึงออกมาทีเดียวทั้งไฟล์

ผลลัพธ์เป็นไฟล์ .txt แบบ UTF-8 สระและวรรณยุกต์ภาษาไทยจึงไม่เพี้ยนไม่ว่าจะเปิดที่ไหน สิ่งที่หายไปคือการจัดหน้า เอกสารสองคอลัมน์อาจอ่านสลับไปมา ตารางกลายเป็นบรรทัดเรียงกัน ส่วนหัวกระดาษและเลขหน้าจะโผล่ซ้ำทุกครั้งที่ขึ้นหน้าใหม่ สำหรับการอ่านและการค้นหาเรื่องนี้ไม่เป็นอุปสรรค แต่อย่าคาดหวังว่าจะประกอบเอกสารเดิมกลับคืนมาได้จากไฟล์นี้

หน้าที่มาจากการสแกนจะไม่ได้ข้อความออกมาเลย เพราะสำหรับคอมพิวเตอร์แล้วตัวอักษรบนนั้นเป็นเพียงส่วนหนึ่งของรูปภาพ เอกสารแบบนั้นต้องใช้เครื่องมือ OCR ถ้าต้องการนำไปแก้ไขต่อใน Word เครื่องมือแปลง PDF เป็น Word จะให้ไฟล์ .docx มา แม้สิ่งที่ติดไปด้วยจะมีเพียงตัวหนังสือเช่นกัน การดึงข้อความทำในเบราว์เซอร์โดยไม่อัปโหลดไฟล์

วิธีใช้

  1. 1

    เลือก PDF

  2. 2

    กำหนดช่วงหน้าหากต้องการ

  3. 3

    คลิกเริ่มแล้วดาวน์โหลดผลลัพธ์

คำถามที่พบบ่อย

ผลลัพธ์ว่างเปล่า
PDF ที่สแกนไม่มีชั้นข้อความ ใช้เครื่องมือแปลงด้วย AI สำหรับไฟล์เหล่านั้น
การขึ้นบรรทัดดูแปลก
PDF ไม่เก็บโครงสร้างบรรทัด จึงต้องคาดเดาจากตำแหน่ง เลย์เอาต์หลายคอลัมน์อาจสลับกัน

เครื่องมือที่เกี่ยวข้อง