PDF को टेक्स्ट में बदलें

PDF की टेक्स्ट लेयर को .txt फ़ाइल में निकालें। स्कैन की गई (सिर्फ़ इमेज) PDF से टेक्स्ट नहीं मिलता।

यह टूल आपकी फ़ाइलें अपलोड नहीं करता। टैब बंद करें और कुछ भी पीछे नहीं बचता।

फ़ाइलें यहाँ ड्रैग करके छोड़ें, या

फ़ाइलें चुनें

समर्थित: PDF · या Ctrl+V से पेस्ट करें

फ़ॉर्मैटिंग नहीं, सिर्फ़ टेक्स्ट चाहिए

तीन सौ पेज के नियमों में कोई लाइन ढूँढनी हो, थीसिस से कोट निकालने हों, या PDF का डेटा एक्सेल शीट या किसी स्क्रिप्ट में ले जाना हो, ऐसे कामों में पेज का डिज़ाइन बीच में आता है। ज़रूरत सिर्फ़ सादे टेक्स्ट की होती है। यह टूल PDF का टेक्स्ट निकालकर UTF-8 में .txt फ़ाइल बना देता है।

आउटपुट सचमुच सादा टेक्स्ट होता है, यानी फ़ॉन्ट, साइज़, रंग, टेबल की लाइनें और कॉलम की जमावट कुछ नहीं बचता। दो कॉलम वाले पेजों में लाइनें कभी-कभी आपस में मिल जाती हैं और क्रम अजीब हो जाता है, इसलिए रिसर्च पेपर जैसी फ़ाइलों में नतीजा एक बार पढ़ लेना बेहतर है। UTF-8 की वजह से देवनागरी और मात्राएँ सही रहती हैं, और अगर खोलने पर अजीब चिह्न दिखें तो गड़बड़ी फ़ाइल में नहीं, उस प्रोग्राम की एन्कोडिंग सेटिंग में है।

स्कैन की हुई PDF से कुछ नहीं मिलेगा, क्योंकि वहाँ अक्षर असल में तस्वीर हैं; उस स्थिति में OCR टूल इस्तेमाल करें। अगर टेक्स्ट के साथ थोड़ी-बहुत फ़ॉर्मैटिंग भी चाहिए तो Word वाला टूल ज़्यादा सही रहेगा। फ़ाइल ब्राउज़र में ही प्रोसेस होती है और उसकी कोई कॉपी कहीं सेव नहीं होती।

उपयोग कैसे करें

  1. 1

    एक PDF चुनें।

  2. 2

    चाहें तो पेज रेंज सेट करें।

  3. 3

    शुरू करें पर क्लिक करें और परिणाम डाउनलोड करें।

अक्सर पूछे जाने वाले प्रश्न

परिणाम खाली है।
स्कैन की गई PDF में टेक्स्ट लेयर नहीं होती। उनके लिए AI कन्वर्ज़न टूल इस्तेमाल करें।
लाइन ब्रेक अजीब दिखते हैं।
PDF लाइन संरचना सेव नहीं करती; यह स्थितियों से अनुमानित होती है। बहु-स्तंभ लेआउट आपस में मिल सकते हैं।

संबंधित टूल