OCR PDF

Kenali teks Korea dan Inggris dalam PDF hasil scan dan hasilkan PDF yang bisa dicari plus file teks.

Alat ini tidak mengunggah file Anda. Tutup tab dan tidak ada yang tersisa.

Seret & lepas file di sini, atau

Pilih file

Didukung: PDF · atau tempel dengan Ctrl+V

Dokumen yang tidak bisa dicari isinya

Kontrak lama yang sudah dipindai terlihat seperti PDF biasa, tetapi Ctrl+F tidak menemukan satu kata pun dan teksnya tidak bisa disorot. Penyebabnya sederhana: setiap halaman sebenarnya adalah gambar, dan huruf di dalamnya tidak berbeda dari pola pada foto. Pengenalan teks mengubah gambar itu menjadi huruf yang bisa dibaca komputer.

Bahasa Indonesia tidak termasuk dalam daftar bahasa yang didukung; pilihan yang tersedia adalah Korea dan Inggris, Inggris, Korea, Jepang dan Inggris, serta Mandarin Sederhana dan Inggris. Untuk dokumen berhuruf Latin Anda boleh saja mencoba pilihan bahasa Inggris atas pertimbangan sendiri, tetapi perlakukan hasilnya sebagai naskah kasar yang harus dibaca ulang dan dibetulkan sendiri, bukan sebagai salinan yang langsung siap pakai. Kualitas pindaian sangat menentukan: 300 dpi, halaman lurus tidak miring, pencahayaan rata, dan tanpa bayangan tangan atau ponsel yang jatuh ke kertas.

Hasilnya bisa diambil sebagai teks biasa atau sebagai PDF yang dapat dicari, yaitu tampilan gambar aslinya tetap utuh dengan lapisan teks tak terlihat di belakangnya. Jangan memakai hasil pengenalan untuk angka penting seperti nominal kontrak tanpa mencocokkannya dengan dokumen asli. Pengenalan berjalan di perangkat Anda, jadi dokumen sensitif tidak berpindah ke server mana pun.

Cara pakai

  1. 1

    Pilih PDF hasil scan.

  2. 2

    Periksa bahasa dan klik Mulai.

  3. 3

    Unduh PDF yang bisa dicari dan .txt.

Pertanyaan umum

Berapa lama prosesnya?
Sekitar 3–10 detik per halaman. Pengoperasian pertama mengunduh ~4 MB data bahasa.
Akurasinya?
Tinggi untuk cetakan bersih, lebih rendah untuk scan buram atau tulisan tangan. Struktur tabel tidak dikenali.

Alat terkait