PDF ke Teks

Ekstrak lapisan teks PDF ke dalam fail .txt. PDF yang diimbas (imej sahaja) tidak menghasilkan teks.

Alat ini tidak memuat naik fail anda. Tutup tab dan tiada apa yang tertinggal.

Seret & lepaskan fail di sini, atau

Pilih fail

Disokong: PDF · atau tampal dengan Ctrl+V

Kandungannya diperlukan, bukan rupa halamannya

Kadangkala yang diperlukan bukan dokumen yang kemas, tetapi ayatnya: memetik peruntukan ke dalam nota, mencari satu istilah dalam pekeliling 200 halaman, atau mengambil kandungan laporan untuk diringkaskan dengan alat lain. Menanda teks halaman demi halaman dalam pembaca PDF jauh lebih memenatkan berbanding menariknya sekali gus.

Hasilnya ialah fail .txt dalam format UTF-8, jadi huruf dan tanda baca bahasa Melayu kekal utuh di mana-mana ia dibuka. Apa yang ditinggalkan ialah susun aturnya: dokumen dua lajur mungkin terbaca berselang-seli, jadual bertukar menjadi barisan teks, manakala kepala surat dan nombor halaman muncul pada setiap pertukaran halaman. Untuk membaca dan mencari kandungan hal itu tidak mengganggu, tetapi fail ini bukan untuk mencetak semula dokumen asal.

Halaman hasil imbasan tidak akan menghasilkan apa-apa, kerana bagi komputer huruf di situ hanyalah sebahagian daripada gambar; gunakan alat OCR untuk dokumen seperti itu. Jika hasilnya mahu terus disunting dalam Word, alat PDF ke Word memberikan fail .docx, walaupun apa yang dibawa ke sana juga hanya teks. Pengekstrakan teks dilakukan dalam pelayar tanpa memuat naik fail.

Cara menggunakan

  1. 1

    Pilih PDF.

  2. 2

    Tetapkan julat halaman jika perlu.

  3. 3

    Klik Mula dan muat turun hasil.

Soalan lazim

Hasilnya kosong.
PDF imbasan tiada lapisan teks. Gunakan alat penukaran AI untuk fail tersebut.
Pemisah baris kelihatan pelik.
PDF tidak menyimpan struktur baris; ia diagak daripada kedudukan. Susun atur berbilang lajur mungkin bercampur.

Alat berkaitan