अपने ब्राउज़र में PDF को टेक्स्ट में बदलें और एक साधारण TXT फाइल डाउनलोड करें। जब जरूरत हो तब टेक्स्ट पहचान (OCR) का उपयोग करें, और जब न हो तो इसे बंद रखें।
या अपनी फ़ाइल खींचें, पेस्ट करें, या क्लाउड से चुनें
PDF को टेक्स्ट में बदलना दो अलग-अलग काम हो सकते हैं, और यह कनवर्टर आपको वही चुनने देता है जिसकी आपको जरूरत है। ज़्यादातर PDFs में पहले से वास्तविक अक्षर होते हैं, तो सिर्फ टेक्स्ट पढ़कर निकाला जाता है। स्कैन की गई PDF में इसके बजाय पन्नों की तस्वीरें होती हैं, और उनमें मौजूद अक्षरों को निकाले जाने से पहले पहचानना पड़ता है।
टेक्स्ट पहचान डिफ़ॉल्ट रूप से बंद रहती है, और यह जानबूझकर है। जिस PDF में असली टेक्स्ट लेयर हो, वह इसके बिना तेज और ज़्यादा सटीक रूप से कनवर्ट होती है, क्योंकि शब्दों को चित्र से समझने के बजाय सीधे कॉपी किया जाता है। जब फ़ाइल को इसकी जरूरत न हो, तब पहचान चालू करने से सिर्फ़ सटीकता कम होती है।
आप एक पल में पहचान सकते हैं कि आपके पास किस तरह की फ़ाइल है। किसी भी रीडर में PDF खोलें और किसी एक पंक्ति पर ड्रैग करें। अगर शब्द हाइलाइट होते हैं, तो OCR टॉगल बंद रखें। अगर कुछ हाइलाइट नहीं होता, तो इसे चालू करें और पहचान द्वारा समर्थित 124 स्रोत भाषाओं में से अपने दस्तावेज़ की भाषा चुनें।
PDF से टेक्स्ट निकालने पर एक ऐसा पेज, जिसे आप सिर्फ़ देख सकते हैं, इस्तेमाल करने लायक शब्दों में बदल जाता है। कनवर्टर जो भी टेक्स्ट पाता है, उसे एक साधारण टेक्स्ट फ़ाइल में लिख देता है, ताकि आप कोई उद्धरण कॉपी कर सकें, कोई पैराग्राफ ईमेल में पेस्ट कर सकें, या किसी भी एडिटर में फाइंड कमांड से पूरे दस्तावेज़ में खोज कर सकें।
यही वे काम हैं जो लोग आम तौर पर सोचते हैं: किसी पेपर से संदर्भ निकालना, किसी रिपोर्ट से आंकड़े उठाना, या किसी लंबे दस्तावेज़ को किसी राइटिंग टूल में ले जाना। कुछ भी दोबारा टाइप नहीं करना पड़ता और न ही हाथ से ट्रांसक्राइब करना पड़ता है।
आप एक साथ कई PDFs अपलोड कर सकते हैं। हर फ़ाइल अलग से कनवर्ट होती है और अपनी-अपनी टेक्स्ट फ़ाइल के रूप में वापस मिलती है, जिन पर एक ही OCR सेटिंग और एक ही भाषा सभी पर लागू होती है। किसी अकाउंट की जरूरत नहीं और कोई ईमेल पता नहीं माँगा जाता।
.txt फ़ाइल एक्सटेंशन का उपयोग सादा टेक्स्ट फ़ाइलों के लिए किया जाता है। इन फ़ाइलों में टेक्स्ट कई पंक्तियों के रूप में होता है और इन्हें अलग-अलग प्लेटफ़ॉर्म और डिवाइस पर कई तरह के टेक्स्ट एडिटर में खोला जा सकता है। टेक्स्ट में कोई फ़ॉर्मैटिंग नहीं होती है।
इसीलिए PDF से TXT में जाने का मतलब किसी डॉक्यूमेंट फ़ॉर्मेट में जाने से अलग है। फ़ाइल किसी भी कंप्यूटर और किसी भी फोन पर खुल जाती है, पढ़ने के लिए किसी लाइसेंस की जरूरत नहीं होती, और वह तब भी पढ़ने लायक रहती है जब मूल फ़ाइल बनाने वाला प्रोग्राम बदल चुका हो।
फ़ाइल एक्सटेंशन: .txt, MIME टाइप: text/plain
विकिपीडिया पर TXTएक प्लेन टेक्स्ट फ़ाइल में पेज नहीं, शब्द रहते हैं। कनवर्ज़न के बाद यह बचता है और यह नहीं।
| PDF से | TXT फ़ाइल में |
|---|---|
| शब्द और लाइन ब्रेक | रखे जाते हैं |
| रीडिंग ऑर्डर | ऊपर से नीचे तक रखा जाता है |
| बोल्ड, इटैलिक और फॉन्ट्स | हटा दिए जाते हैं |
| इमेज, लोगो और चार्ट | हटा दिए जाते हैं |
| टेबल | ग्रिड के बिना टेक्स्ट के रूप में रखी जाती हैं |
| मल्टी-कॉलम पेज | एक कॉलम में बहा दिए जाते हैं |
| हेडर, फुटर और पेज नंबर | टेक्स्ट के साथ ही लिख दिए जाते हैं |
एक प्लेन टेक्स्ट फ़ाइल शब्दों को रखती है, लेआउट को नहीं। जब फॉर्मेटिंग शब्दों जितनी ही अहम हो, तब PDF से Word ऐप ज़्यादा सही विकल्प है।
PDF में शब्द पेज लेआउट में बंद रहते हैं। ये वे स्थितियाँ हैं जहाँ उन्हें साधारण रूप में निकालने से सबसे ज़्यादा काम बचता है।
पेपर, रिपोर्ट और किताबें अक्सर PDF में शेयर की जाती हैं। टेक्स्ट एक बार निकालें और जिन हिस्सों की जरूरत हो उन्हें नोट्स में पेस्ट करें, बजाय उन्हें दोबारा टाइप करने के।
टेक्स्ट फ़ाइल किसी भी एडिटर में खुल जाती है, ताकि आप पेज दर पेज पढ़ने के बजाय सीधे किसी नाम, तारीख या राशि पर जा सकें।
ट्रांसलेटर, राइटिंग टूल, स्क्रीन रीडर और स्प्रेडशीट सभी प्लेन टेक्स्ट लेते हैं। TXT वह फ़ॉर्मेट है जिसे लगभग हर टूल बिना किसी कनवर्टर के स्वीकार कर लेता है।
जो PDF लोग कन्वर्ट करते हैं वे अक्सर कॉन्ट्रैक्ट, इनवॉइस या निजी पत्राचार होते हैं। इन्हें यहाँ ठीक-ठीक कैसे संभाला जाता है, यह रहा।
हर अपलोड और डाउनलोड एन्क्रिप्टेड कनेक्शन पर चलता है, ताकि आपकी फाइलें ट्रांज़िट में पढ़ी न जा सकें।
प्रोसेसिंग यूरोपीय संघ के अंदर प्रमाणित डाटा सेंटरों में होती है।
टेक्स्ट पहचान पूरी तरह स्वचालित है। कोई भी आपके स्कैन या दस्तावेज़ नहीं पढ़ता, और कुछ भी थर्ड पार्टी के साथ साझा नहीं किया जाता।
अपनी PDF अपलोड करें।
अगर PDF स्कैन है तो OCR चालू करें। जब फ़ाइल में टेक्स्ट पहले से सेलेक्ट किया जा सकता हो तो इसे बंद रखें।
मेनू से अपने दस्तावेज़ की भाषा चुनें (वैकल्पिक)।
"Start" पर क्लिक करें और रूपांतरण पूरा होने तक प्रतीक्षा करें।
हाँ। PDF को टेक्स्ट में कनवर्ट करना मुफ्त है, इसके लिए किसी अकाउंट की जरूरत नहीं, और कोई ईमेल पता नहीं माँगा जाता। फ़ाइल अपलोड करें, कनवर्ज़न शुरू करें और टेक्स्ट डाउनलोड करें। सिर्फ़ बहुत बड़ी फ़ाइलों और लंबे बैच के लिए प्लान मायने रखता है।
ऊपर PDF अपलोड करें, अगर फ़ाइल में टेक्स्ट पहले से सेलेक्ट किया जा सकता हो तो OCR टॉगल बंद रखें, और कनवर्ज़न शुरू करें। नतीजा एक प्लेन टेक्स्ट फ़ाइल होती है जिसे आप डाउनलोड कर सकते हैं और किसी भी एडिटर में खोल सकते हैं। कुछ भी इंस्टॉल करने की जरूरत नहीं।
अगर शब्द उन पर ड्रैग करने पर हाइलाइट होते हैं, तो आप उन्हें सीधे अपने PDF रीडर से कॉपी कर सकते हैं। अगर वे हाइलाइट नहीं होते, तो पेज इमेज है और कुछ भी सेलेक्ट नहीं किया जा सकता। PDF को टेक्स्ट में कनवर्ट करने से यह समस्या हल हो जाती है, क्योंकि आउटपुट एक टेक्स्ट फ़ाइल होती है जिससे आप आसानी से कॉपी कर सकते हैं।
यही वह फ़ॉर्मेट है जिसे यह कनवर्टर लिखता है। TXT प्लेन टेक्स्ट फ़ॉर्मेट है, इसलिए आपकी डाउनलोड की गई फ़ाइल का एक्सटेंशन .txt होता है और मीडिया टाइप text/plain। यह Notepad, TextEdit, किसी भी कोड एडिटर और किसी भी फोन पर बिना अतिरिक्त सॉफ्टवेयर के खुल जाती है।
क्योंकि ज़्यादातर PDFs को इसकी जरूरत नहीं होती। जिस PDF में असली टेक्स्ट लेयर हो, वह ज़्यादा तेज और सटीक रूप से कनवर्ट होती है जब शब्दों को इमेज से पहचानने के बजाय सीधे कॉपी किया जाता है। OCR सिर्फ़ तभी चालू करें जब पेज स्कैन या फ़ोटो हों, और इसके साथ ही भाषा चयन दिखेगा।
हाँ, जब OCR चालू हो। पहचान पेज की इमेज से अक्षर पढ़ती है और उन्हें टेक्स्ट फ़ाइल में लिख देती है। अगर आप ज़्यादातर स्कैन को ही कनवर्ट करते हैं, तो scanned PDF to text app वही परिणाम पाने का और ज़्यादा सीधा तरीका है।
यह 124 स्रोत भाषाओं को पहचानता है। यूरोपीय भाषाओं के साथ सूची में हिंदी, बांग्ला, तमिल, उर्दू, अरबी, थाई, जापानी, कोरियाई और चीनी (सरलीकृत और पारंपरिक, दोनों रूपों में) शामिल हैं। सबसे अच्छे नतीजे के लिए अपने दस्तावेज़ की भाषा चुनें।
हाँ। जितने PDF आपको चाहिए, उन्हें जोड़ें और वे एक ही बार में कनवर्ट हो जाएँगे, हर फ़ाइल अलग टेक्स्ट फ़ाइल के रूप में मिलेगी, जिसमें वही OCR सेटिंग और वही भाषा लागू होगी।
स्कैन किए गए दस्तावेज़ों और छवियों से महत्वपूर्ण टेक्स्ट को OCR (Optिकल कैरेक्टर रिकग्निशन) के साथ डिजिटाइज़ करें। छवियों से टेक्स्ट को ऑनलाइन आसानी से निकालें।
लेख पढ़ेंइनमें से हर टूल ब्राउज़र में चलता है। न इंस्टॉल की जरूरत, न अकाउंट की, और इनके पीछे एक जैसा टेक्स्ट रिकग्निशन काम करता है।