PDF को टेक्स्ट में बदलें
PDF की टेक्स्ट लेयर को .txt फ़ाइल में निकालें। स्कैन की गई (सिर्फ़ इमेज) PDF से टेक्स्ट नहीं मिलता।
यह टूल आपकी फ़ाइलें अपलोड नहीं करता। टैब बंद करें और कुछ भी पीछे नहीं बचता।
फ़ाइलें यहाँ ड्रैग करके छोड़ें, या
फ़ाइलें चुनेंसमर्थित: PDF · या Ctrl+V से पेस्ट करें
फ़ॉर्मैटिंग नहीं, सिर्फ़ टेक्स्ट चाहिए
तीन सौ पेज के नियमों में कोई लाइन ढूँढनी हो, थीसिस से कोट निकालने हों, या PDF का डेटा एक्सेल शीट या किसी स्क्रिप्ट में ले जाना हो, ऐसे कामों में पेज का डिज़ाइन बीच में आता है। ज़रूरत सिर्फ़ सादे टेक्स्ट की होती है। यह टूल PDF का टेक्स्ट निकालकर UTF-8 में .txt फ़ाइल बना देता है।
आउटपुट सचमुच सादा टेक्स्ट होता है, यानी फ़ॉन्ट, साइज़, रंग, टेबल की लाइनें और कॉलम की जमावट कुछ नहीं बचता। दो कॉलम वाले पेजों में लाइनें कभी-कभी आपस में मिल जाती हैं और क्रम अजीब हो जाता है, इसलिए रिसर्च पेपर जैसी फ़ाइलों में नतीजा एक बार पढ़ लेना बेहतर है। UTF-8 की वजह से देवनागरी और मात्राएँ सही रहती हैं, और अगर खोलने पर अजीब चिह्न दिखें तो गड़बड़ी फ़ाइल में नहीं, उस प्रोग्राम की एन्कोडिंग सेटिंग में है।
स्कैन की हुई PDF से कुछ नहीं मिलेगा, क्योंकि वहाँ अक्षर असल में तस्वीर हैं; उस स्थिति में OCR टूल इस्तेमाल करें। अगर टेक्स्ट के साथ थोड़ी-बहुत फ़ॉर्मैटिंग भी चाहिए तो Word वाला टूल ज़्यादा सही रहेगा। फ़ाइल ब्राउज़र में ही प्रोसेस होती है और उसकी कोई कॉपी कहीं सेव नहीं होती।
उपयोग कैसे करें
- 1
एक PDF चुनें।
- 2
चाहें तो पेज रेंज सेट करें।
- 3
शुरू करें पर क्लिक करें और परिणाम डाउनलोड करें।
अक्सर पूछे जाने वाले प्रश्न
- परिणाम खाली है।
- स्कैन की गई PDF में टेक्स्ट लेयर नहीं होती। उनके लिए AI कन्वर्ज़न टूल इस्तेमाल करें।
- लाइन ब्रेक अजीब दिखते हैं।
- PDF लाइन संरचना सेव नहीं करती; यह स्थितियों से अनुमानित होती है। बहु-स्तंभ लेआउट आपस में मिल सकते हैं।