OCR
تعرّف على النص الكوري والإنجليزي في ملفات PDF الممسوحة وأنتج ملف PDF قابلًا للبحث بالإضافة إلى ملف نصي.
هذه الأداة لا ترفع ملفاتك. أغلق التبويب ولن يبقى أي شيء.
اسحب الملفات وأفلتها هنا، أو
اختر الملفاتالمدعوم: PDF · أو الصق باستخدام Ctrl+V
البحث داخل مستند ممسوح ضوئياً
أمامك نسخة ممسوحة من عقد قديم أو من مراسلة خرجت من الأرشيف، وحين تبحث فيها عن كلمة لا تظهر أي نتيجة، ولا تستطيع نسخ سطر واحد منها. السبب بسيط: تلك الصفحات صور، ولا توجد داخلها بيانات نصية أصلاً. يقرأ التعرّف الضوئي الحروف من الصورة ويحوّلها إلى نص.
تختار لغة التعرّف من قائمة تضم الإنجليزية والكورية واليابانية والصينية المبسّطة، وليست العربية من بينها، فلا تعطي الأداة نتيجة موثوقة مع النص العربي ولا تصلح لأرشيف عربي. ودقة النتيجة مرهونة بجودة المسح: دقة ثلاثمئة نقطة في البوصة، وورقة مستوية غير مائلة، وإضاءة متساوية بلا ظلال. ويمكنك اختيار المخرجات نصاً مجرداً، أو ملف PDF قابلاً للبحث تُضاف فيه طبقة نص غير مرئية فوق الصورة، فيبقى شكل الصفحة كما هو ويصبح البحث فيها ممكناً.
الخط اليدوي والصور منخفضة الدقة والصفحات الممسوحة مائلة والكلمات الواقعة فوق أختام أو خطوط ترفع نسبة الخطأ ارتفاعاً ملحوظاً. لذلك راجع الأرقام والأسماء بعينك بعد معالجة أي مستند مهم. ويعمل التعرّف داخل متصفحك، فلا تُرسل مستنداتك الممسوحة إلى أي خادم.
طريقة الاستخدام
- 1
حدد ملف PDF ممسوحًا.
- 2
تحقق من اللغات وانقر على ابدأ.
- 3
نزّل ملف PDF القابل للبحث وملف .txt.
الأسئلة الشائعة
- كم يستغرق؟
- حوالي 3–10 ثوانٍ لكل صفحة. التشغيل الأول ينزّل ~4 ميغابايت من بيانات اللغة.
- الدقة؟
- عالية للمطبوعات النظيفة، وأقل للمسح الضبابي أو خط اليد. بنية الجداول لا يتم التعرف عليها.