PDF ke Teks

Ekstrak lapisan teks PDF ke file .txt. PDF hasil scan (hanya gambar) tidak menghasilkan teks.

Alat ini tidak mengunggah file Anda. Tutup tab dan tidak ada yang tersisa.

Seret & lepas file di sini, atau

Pilih file

Didukung: PDF · atau tempel dengan Ctrl+V

Butuh isinya, bukan tampilan halamannya

Kadang yang diperlukan bukan dokumen cantik, melainkan kalimatnya: mengutip peraturan ke dalam catatan, mencari satu istilah di dokumen 200 halaman, atau menyalin isi laporan untuk diringkas dengan alat lain. Menyorot teks halaman demi halaman di aplikasi pembaca PDF jauh lebih lama daripada menariknya sekaligus.

Hasilnya berupa berkas .txt berformat UTF-8, jadi huruf dan tanda baca bahasa Indonesia tetap utuh saat dibuka di mana pun. Yang ditinggalkan adalah tata letaknya: dokumen dua kolom bisa terbaca berselang-seling, tabel menjadi deretan baris, serta kop dan nomor halaman ikut muncul di setiap pergantian halaman. Untuk membaca dan mencari isi hal itu tidak mengganggu, tetapi jangan berharap bisa mencetak ulang dokumennya dari sini.

Halaman hasil pindaian tidak akan menghasilkan apa-apa, karena bagi komputer huruf di situ hanyalah gambar; gunakan alat OCR untuk dokumen semacam itu. Kalau hasilnya ingin langsung diedit di Word, alat PDF ke Word memberi berkas .docx, meskipun yang terbawa ke sana juga hanya teksnya. Pengambilan teks dilakukan di browser tanpa mengunggah berkas.

Cara pakai

  1. 1

    Pilih PDF.

  2. 2

    Atur rentang halaman jika perlu.

  3. 3

    Klik Mulai dan unduh hasilnya.

Pertanyaan umum

Hasilnya kosong.
PDF hasil scan tidak punya lapisan teks. Gunakan alat konversi AI untuk itu.
Pemisah barisnya aneh.
PDF tidak menyimpan struktur baris; ini ditebak dari posisi. Tata letak multi-kolom bisa tercampur.

Alat terkait