पीडीएफ अपलोड करें
यह केवल टेक्स्ट निकालता है। सिर्फ इमेज वाले स्कैन से टेक्स्ट नहीं मिलेगा।
निकालने का तरीका
आउटपुट
युक्तियाँ
- यह एम्बेडेड टेक्स्ट पढ़ता है। OCR शामिल नहीं है, इसलिए सिर्फ स्कैन की गई इमेज PDF से टेक्स्ट नहीं निकलेगा।
- अनुच्छेद मोड पंक्ति-अंत हटाकर टेक्स्ट को दोबारा उपयोग करने में आसान बनाता है।
- रेंज 1-आधारित पेज नंबर का उपयोग करती है, जैसे `1-3,5`।
पहले से टेक्स्ट परत वाली PDF से टेक्स्ट निकालें
यह टूल PDF में एम्बेड किया गया चयन योग्य टेक्स्ट पढ़ता है। यह रिपोर्ट, अनुबंध, फ़ॉर्म और ऐसे दस्तावेज़ों के लिए है जिनका टेक्स्ट PDF व्यूअर में चुना या कॉपी किया जा सकता है।
OCR शामिल नहीं है
PDF स्कैन या केवल फ़ोटो वाली हो तो पहले OCR चलाएँ, फिर पहचाना गया टेक्स्ट निकालें। केवल इमेज वाले पेजों से बहुत कम या कोई आउटपुट नहीं मिल सकता।
संयुक्त या हर पेज का आउटपुट
- संयुक्त टेक्स्ट: एक लगातार TXT फ़ाइल में कॉपी, खोज, नोट और संपादन के लिए।
- हर पेज का टेक्स्ट: समीक्षा, उद्धरण, पेज संदर्भ और मूल PDF से तुलना के लिए।
लेआउट की सीमा
टेक्स्ट निकालना पढ़ने योग्य परत सुरक्षित रखता है, ठीक दृश्य लेआउट नहीं। कॉलम, तालिका, हेडर, फुटर और अलग जगह रखा टेक्स्ट एक्सपोर्ट के बाद हाथ से साफ़ करना पड़ सकता है।
अक्सर पूछे जाने वाले प्रश्न
क्या यह टूल OCR करता है?
नहीं। यह PDF में पहले से मौजूद टेक्स्ट निकालता है। स्कैन की इमेज वाले पेजों पर पहले OCR टूल उपयोग करें।
क्या टेक्स्ट को पेज के अनुसार अलग रख सकता हूँ?
उद्धरण, पेज संदर्भ या समीक्षा के लिए पेज मोड चुनें। संपादन या खोज के लिए एक लगातार ब्लॉक चाहिए तो संयुक्त आउटपुट चुनें।
टेक्स्ट का क्रम पेज लेआउट से अलग क्यों है?
PDF टेक्स्ट दृश्य स्थानों में संग्रहीत होता है, हमेशा अनुच्छेदों में नहीं। जटिल लेआउट, तालिका और कॉलम को हाथ से साफ़ करना पड़ सकता है।
क्या केवल चुने पेजों से टेक्स्ट निकाल सकता हूँ?
हाँ। केवल ज़रूरी पेज पढ़ने के लिए 1-3,5 जैसी रेंज दें।
क्या मेरी PDF फ़ाइलें अपलोड होती हैं?
नहीं। टेक्स्ट आपके ब्राउज़र में निकाला जाता है और फ़ाइलें सर्वर पर अपलोड नहीं होतीं।