OCR
Kenal pasti teks Korea dan Inggeris dalam PDF imbasan dan hasilkan PDF boleh dicari serta fail teks.
Alat ini tidak memuat naik fail anda. Tutup tab dan tiada apa yang tertinggal.
Seret & lepaskan fail di sini, atau
Pilih failDisokong: PDF · atau tampal dengan Ctrl+V
Dokumen imbasan yang tidak boleh dicari
Kontrak lama yang telah diimbas kelihatan seperti PDF biasa, tetapi Ctrl+F tidak menemui satu perkataan pun dan teksnya tidak boleh ditanda. Sebabnya mudah: setiap halaman sebenarnya sekeping gambar, dan huruf di dalamnya tidak berbeza daripada corak pada sebarang foto. Pengecaman teks menukarkan gambar itu kepada huruf yang boleh dibaca komputer.
Bahasa Melayu tidak termasuk dalam senarai bahasa yang disokong; pilihan yang ada ialah Korea dan Inggeris, Inggeris, Korea, Jepun dan Inggeris, serta Cina Ringkas dan Inggeris. Bagi dokumen bertulisan Rumi, anda boleh mencuba pilihan bahasa Inggeris atas pertimbangan sendiri, tetapi anggaplah hasilnya sebagai draf kasar yang perlu dibaca semula dan dibetulkan sendiri, bukan salinan yang boleh terus digunakan. Mutu imbasan sangat menentukan: 300 dpi, halaman lurus tidak senget, pencahayaan sekata, dan tanpa bayang tangan atau telefon yang jatuh ke atas kertas.
Hasilnya boleh diambil sebagai teks biasa atau sebagai PDF boleh cari, iaitu paparan gambar asal kekal seperti sedia ada dengan lapisan teks halimunan di belakangnya. Jangan gunakan hasil pengecaman bagi nombor penting seperti jumlah dalam kontrak tanpa memadankannya dengan dokumen asal. Pengecaman berjalan pada peranti anda, jadi dokumen sulit tidak berpindah ke mana-mana pelayan.
Cara menggunakan
- 1
Pilih PDF imbasan.
- 2
Semak bahasa dan klik Mula.
- 3
Muat turun PDF boleh dicari dan .txt.
Soalan lazim
- Berapa lama masa diambil?
- Kira-kira 3–10 saat setiap halaman. Larian pertama memuat turun ~4 MB data bahasa.
- Ketepatan?
- Tinggi untuk cetakan bersih, lebih rendah untuk imbasan kabur atau tulisan tangan. Struktur jadual tidak dikenal pasti.