PDFora
Pricing सभी टूल
🔤

PDF से टेक्स्ट

PDF का पूरा सिलेक्ट होने वाला टेक्स्ट निकालकर .txt फ़ाइल में सहेजिए।

🔒 आपकी फ़ाइलें आपके ब्राउज़र में ही प्रोसेस होती हैं और कभी अपलोड नहीं होतीं।
1

अपलोड करें

अपनी फ़ाइल चुनें या खींचकर छोड़ें।

2

सेट करें

अपने विकल्प चुनें — सब कुछ आपके ब्राउज़र में होता है।

3

डाउनलोड करें

तैयार फ़ाइल तुरंत सेव करें। कोई वॉटरमार्क नहीं।

PDF फ़ाइलों से टेक्स्ट निकालिए और उसे ऐसे सादे .txt दस्तावेज़ में सहेजिए जिसे कहीं भी खोला जा सके। PDF व्यूअर से हाथ से कॉपी करने पर अक्सर लाइन ब्रेक गड़बड़ा जाते हैं, अक्षर छूट जाते हैं, और लंबे दस्तावेज़ों में तो घंटों लग जाते हैं। यह PDF to Text टूल हर पेज की हर लाइन का सिलेक्ट होने वाला टेक्स्ट एक ही बार में खींच लेता है और आपको एक साफ़ फ़ाइल देता है — मुफ़्त, बिना साइनअप और दस्तावेज़ की लंबाई पर बिना किसी सीमा के।

एक्सट्रैक्शन आपके ब्राउज़र में लोकल रूप से चलता है। PDF आपके अपने डिवाइस पर ही पार्स होता है, इसलिए कोई अनुबंध, थीसिस या वित्तीय रिपोर्ट सिर्फ़ अपने शब्द निकलवाने के लिए किसी सर्वर पर अपलोड नहीं होती। यह लोकल-ओनली डिज़ाइन इसे तेज़ भी बनाता है; सैकड़ों पेजों वाली फ़ाइलों में भी अपलोड का इंतज़ार नहीं करना पड़ता। टैब बंद होते ही आपके दस्तावेज़ का कोई निशान कहीं नहीं बचता।

एक ईमानदार चेतावनी: यह टूल PDF के भीतर मौजूद टेक्स्ट लेयर पढ़ता है। स्कैन किए गए दस्तावेज़ और फ़ोटो खींचे गए पेज सिर्फ़ तस्वीरें होते हैं और उनमें निकालने लायक कोई टेक्स्ट लेयर नहीं होती, इसलिए नतीजा ख़ाली आएगा। उनके लिए OCR टूल इस्तेमाल कीजिए, जो तस्वीर के अक्षरों को पहचानकर उन्हें असली टेक्स्ट में बदल देता है।

ऑनलाइन PDF से टेक्स्ट कैसे निकालें

  1. PDF to Text टूल खोलिए और अपना PDF पेज पर छोड़ दीजिए, या अपने डिवाइस से ब्राउज़ करके चुन लीजिए।
  2. फ़ाइल सीधे आपके ब्राउज़र में पार्स होती है; इस दौरान कुछ भी अपलोड नहीं होता।
  3. एक छोटी जाँच: अगर आप किसी सामान्य PDF व्यूअर में टेक्स्ट सिलेक्ट और कॉपी कर पाते हैं, तो एक्सट्रैक्शन काम करेगा। अगर पेज स्कैन हैं, तो OCR टूल पर चले जाइए।
  4. Extract पर क्लिक कीजिए ताकि हर पेज का टेक्स्ट क्रम से निकाला जा सके।
  5. बनने वाली .txt फ़ाइल डाउनलोड कर लीजिए।
  6. उसे किसी भी टेक्स्ट एडिटर में खोलिए और अगर आगे के काम के लिए ज़रूरी हो तो स्पेसिंग या लाइन ब्रेक ठीक कर लीजिए।

When to use this tool

  • किसी शोध पत्र का पूरा टेक्स्ट .txt फ़ाइल में निकालिए ताकि आप अपने नोट्स ऐप में उसे खोज सकें, उद्धृत कर सकें और उस पर टिप्पणी कर सकें।
  • किसी अनुबंध की भाषा निकालकर दो वर्ज़न की तुलना डिफ़ टूल में लाइन-दर-लाइन कीजिए, PDF अगल-बगल रखकर आँखें गड़ाने की जगह।
  • किसी ईबुक या रिपोर्ट को सादे टेक्स्ट में लाइए ताकि लंबे सफ़र में स्क्रीन रीडर या टेक्स्ट-टू-स्पीच ऐप उसे पढ़ सके।
  • किसी लंबे दस्तावेज़ का टेक्स्ट ऐसे ट्रांसलेशन टूल या AI समराइज़र को दीजिए जो सादा टेक्स्ट लेता है लेकिन PDF अपलोड नहीं।
  • किसी पुराने PDF की लिखाई वापस पाइए जब मूल Word फ़ाइल कब की ग़ायब हो चुकी हो और आपको उसे दोबारा एडिट करना हो।
  • सप्लायर के PDF कैटलॉग से प्रोडक्ट विवरण या स्पेसिफ़िकेशन उठाइए और स्टोर लिस्टिंग में पेस्ट कीजिए।

Tips for the best results

  • पहले PDF की जाँच कीजिए: उसे खोलकर कोई वाक्य सिलेक्ट करने की कोशिश कीजिए। अगर कुछ भी हाइलाइट नहीं होता, तो वह स्कैन है — टेक्स्ट एक्सट्रैक्शन की जगह OCR चलाइए।
  • शोध पत्रों जैसे कई कॉलम वाले लेआउट का टेक्स्ट कभी-कभी ऐसे क्रम में निकलता है जो कॉलम के बीच कूदता रहता है। भरोसा करने से पहले आउटपुट पर नज़र डाल लीजिए।
  • हेडर, फ़ुटर और पेज नंबर भी मुख्य टेक्स्ट के साथ चले आते हैं। एडिटर में एक फ़ाइंड-एंड-रिप्लेस से बार-बार दोहराई गई ऐसी लाइनें झट से हट जाती हैं।
  • सादा .txt डिज़ाइन से ही पूरी फ़ॉर्मैटिंग हटा देता है। अगर आपको कभी बोल्ड, टेबल या लेआउट दोबारा चाहिए हो, तो मूल PDF संभालकर रखिए।
  • बहुत लंबे दस्तावेज़ों के लिए .txt आउटपुट में कोई ऐसा वाक्यांश खोजिए जो आप जानते हों कि आख़िर के पास आता है — यह पक्का करने का तेज़ तरीक़ा है कि हर पेज पकड़ा गया।

अक्सर पूछे जाने वाले सवाल

मेरे PDF से ख़ाली टेक्स्ट फ़ाइल क्यों बनी?

दस्तावेज़ लगभग निश्चित रूप से कोई स्कैन या फ़ोटो है, जिसमें असली टेक्स्ट की जगह शब्दों की तस्वीरें होती हैं। उसे OCR टूल से चलाइए, जो तस्वीरों में अक्षर पहचानकर एडिट होने लायक टेक्स्ट बनाता है।

क्या एक्सट्रैक्शन के दौरान मेरा दस्तावेज़ अपलोड होता है?

नहीं। PDF पूरी तरह आपके ब्राउज़र में, आपके डिवाइस पर पढ़ा जाता है। कुछ भी किसी सर्वर पर भेजा, सहेजा या लॉग नहीं किया जाता, और कानूनी व वित्तीय काग़ज़ात के लिए यही आप चाहते भी हैं।

क्या बोल्ड, फ़ॉन्ट और टेबल जैसी फ़ॉर्मैटिंग बची रहती है?

नहीं। आउटपुट सादा टेक्स्ट होता है, इसलिए स्टाइलिंग और लेआउट छूट जाते हैं और टेबल लाइनों में बदल जाती हैं। यही समझौता .txt को हर जगह चलने वाला और आसानी से प्रोसेस होने वाला बनाता है।

क्या मैं बहुत बड़े PDF से टेक्स्ट निकाल सकता हूँ?

हाँ। पेज की कोई सीमा नहीं है, और चूँकि अपलोड का कोई चरण ही नहीं है, 500 पेज के दस्तावेज़ भी जल्दी प्रोसेस होते हैं। व्यवहार में इकलौती सीमा आपके डिवाइस की मेमोरी है।

क्या टेक्स्ट सही क्रम में निकलेगा?

सामान्य एक-कॉलम वाले दस्तावेज़ों में हाँ, पेज-दर-पेज। कॉलम, साइडबार या टेक्स्ट बॉक्स वाले जटिल लेआउट उस क्रम से अलग पढ़े जा सकते हैं जिस क्रम में आँख चलती है, इसलिए उन्हें एक बार देख लीजिए।

क्या यह सचमुच मुफ़्त है और बिना अकाउंट के?

हाँ। न साइनअप, न किसी चीज़ पर वॉटरमार्क, और न ही इस पर कोई सीमा कि आप कितने PDF को टेक्स्ट में बदलें। यह डेस्कटॉप या मोबाइल के किसी भी आधुनिक ब्राउज़र में काम करता है।