OCR

स्कैन की गई PDF में कोरियाई और अंग्रेज़ी टेक्स्ट पहचानें और खोजने योग्य PDF के साथ टेक्स्ट फ़ाइल बनाएँ।

यह टूल आपकी फ़ाइलें अपलोड नहीं करता। टैब बंद करें और कुछ भी पीछे नहीं बचता।

फ़ाइलें यहाँ ड्रैग करके छोड़ें, या

फ़ाइलें चुनें

समर्थित: PDF · या Ctrl+V से पेस्ट करें

स्कैन की हुई फ़ाइल में सर्च करना

पुराने एग्रीमेंट या दफ़्तर के रिकॉर्ड की स्कैन कॉपी सामने है, लेकिन उसमें सर्च करने पर कुछ नहीं मिलता और एक लाइन तक कॉपी नहीं होती। वजह सीधी है, वे पेज असल में तस्वीरें हैं और उनके अंदर टेक्स्ट जैसा कुछ है ही नहीं। OCR तस्वीर में दिख रहे अक्षरों को पहचानकर टेक्स्ट में बदलता है।

पहचान की भाषा एक लिस्ट में से चुननी होती है, जिसमें अंग्रेज़ी, कोरियन, जापानी और सरलीकृत चीनी शामिल हैं, पर हिंदी नहीं; देवनागरी में लिखे दस्तावेज़ों पर इसका नतीजा भरोसे लायक नहीं होता, इसलिए हिंदी रिकॉर्ड के लिए यह सही औज़ार नहीं है। नतीजा कितना सही आएगा, यह पूरी तरह स्कैन की क्वालिटी पर टिका है: 300 dpi रेज़ॉल्यूशन, सीधा रखा हुआ पन्ना और बिना परछाईं की एक जैसी रोशनी बड़ा फ़र्क़ डालती है। आउटपुट या तो सादा टेक्स्ट लिया जा सकता है, या ऐसी सर्च होने लायक PDF जिसमें तस्वीर के ऊपर अदृश्य टेक्स्ट लेयर जुड़ जाती है और पेज देखने में बिल्कुल वैसा ही रहता है।

हाथ की लिखावट, कम रेज़ॉल्यूशन की तस्वीरें, टेढ़े स्कैन और मुहर या लाइनों के ऊपर पड़े शब्द ग़लतियाँ काफ़ी बढ़ा देते हैं। इसलिए किसी ज़रूरी दस्तावेज़ के बाद नाम और अंक ख़ुद मिलाकर देख लें। पहचान का काम आपके ब्राउज़र में चलता है, यानी स्कैन किए दस्तावेज़ किसी सर्वर पर नहीं जाते।

उपयोग कैसे करें

  1. 1

    स्कैन की गई PDF चुनें।

  2. 2

    भाषाएँ जाँचें और शुरू करें पर क्लिक करें।

  3. 3

    खोजने योग्य PDF और .txt डाउनलोड करें।

अक्सर पूछे जाने वाले प्रश्न

कितना समय लगता है?
प्रति पेज लगभग 3–10 सेकंड। पहली बार ~4 MB भाषा डेटा डाउनलोड होता है।
सटीकता?
साफ़ प्रिंट के लिए उच्च, धुंधले स्कैन या हस्तलेख के लिए कम। टेबल संरचना नहीं पहचानी जाती।

संबंधित टूल