PDF से टेक्स्ट OCR कन्वर्टर

अपने ब्राउज़र में PDF को टेक्स्ट में बदलें और एक साधारण TXT फाइल डाउनलोड करें। जब जरूरत हो तब टेक्स्ट पहचान (OCR) का उपयोग करें, और जब न हो तो इसे बंद रखें।

अपनी फ़ाइल अपलोड करें

या अपनी फ़ाइल खींचें, पेस्ट करें, या क्लाउड से चुनें

URL पेस्ट करें नमूना आज़माएँ
Google Drive Dropbox OneDrive
100% मुफ्त कोई इंस्टॉलेशन नहीं सुरक्षित और निजी
विज्ञापन
इन पर भरोसा किया गया
eBay Booking.com University of Michigan Cornell University Columbia University
इस टूल को रेट करें
0/5 · 0 वोट

OCR के साथ या बिना PDF को टेक्स्ट में बदलें

PDF को टेक्स्ट में बदलना दो अलग-अलग काम हो सकते हैं, और यह कनवर्टर आपको वही चुनने देता है जिसकी आपको जरूरत है। ज़्यादातर PDFs में पहले से वास्तविक अक्षर होते हैं, तो सिर्फ टेक्स्ट पढ़कर निकाला जाता है। स्कैन की गई PDF में इसके बजाय पन्नों की तस्वीरें होती हैं, और उनमें मौजूद अक्षरों को निकाले जाने से पहले पहचानना पड़ता है।

टेक्स्ट पहचान डिफ़ॉल्ट रूप से बंद रहती है, और यह जानबूझकर है। जिस PDF में असली टेक्स्ट लेयर हो, वह इसके बिना तेज और ज़्यादा सटीक रूप से कनवर्ट होती है, क्योंकि शब्दों को चित्र से समझने के बजाय सीधे कॉपी किया जाता है। जब फ़ाइल को इसकी जरूरत न हो, तब पहचान चालू करने से सिर्फ़ सटीकता कम होती है।

आप एक पल में पहचान सकते हैं कि आपके पास किस तरह की फ़ाइल है। किसी भी रीडर में PDF खोलें और किसी एक पंक्ति पर ड्रैग करें। अगर शब्द हाइलाइट होते हैं, तो OCR टॉगल बंद रखें। अगर कुछ हाइलाइट नहीं होता, तो इसे चालू करें और पहचान द्वारा समर्थित 124 स्रोत भाषाओं में से अपने दस्तावेज़ की भाषा चुनें।

एक भी शब्द दोबारा टाइप किए बिना PDF से टेक्स्ट निकालें

PDF से टेक्स्ट निकालने पर एक ऐसा पेज, जिसे आप सिर्फ़ देख सकते हैं, इस्तेमाल करने लायक शब्दों में बदल जाता है। कनवर्टर जो भी टेक्स्ट पाता है, उसे एक साधारण टेक्स्ट फ़ाइल में लिख देता है, ताकि आप कोई उद्धरण कॉपी कर सकें, कोई पैराग्राफ ईमेल में पेस्ट कर सकें, या किसी भी एडिटर में फाइंड कमांड से पूरे दस्तावेज़ में खोज कर सकें।

यही वे काम हैं जो लोग आम तौर पर सोचते हैं: किसी पेपर से संदर्भ निकालना, किसी रिपोर्ट से आंकड़े उठाना, या किसी लंबे दस्तावेज़ को किसी राइटिंग टूल में ले जाना। कुछ भी दोबारा टाइप नहीं करना पड़ता और न ही हाथ से ट्रांसक्राइब करना पड़ता है।

आप एक साथ कई PDFs अपलोड कर सकते हैं। हर फ़ाइल अलग से कनवर्ट होती है और अपनी-अपनी टेक्स्ट फ़ाइल के रूप में वापस मिलती है, जिन पर एक ही OCR सेटिंग और एक ही भाषा सभी पर लागू होती है। किसी अकाउंट की जरूरत नहीं और कोई ईमेल पता नहीं माँगा जाता।

TXT फ़ाइल क्या है?

.txt फ़ाइल एक्सटेंशन का उपयोग सादा टेक्स्ट फ़ाइलों के लिए किया जाता है। इन फ़ाइलों में टेक्स्ट कई पंक्तियों के रूप में होता है और इन्हें अलग-अलग प्लेटफ़ॉर्म और डिवाइस पर कई तरह के टेक्स्ट एडिटर में खोला जा सकता है। टेक्स्ट में कोई फ़ॉर्मैटिंग नहीं होती है।

इसीलिए PDF से TXT में जाने का मतलब किसी डॉक्यूमेंट फ़ॉर्मेट में जाने से अलग है। फ़ाइल किसी भी कंप्यूटर और किसी भी फोन पर खुल जाती है, पढ़ने के लिए किसी लाइसेंस की जरूरत नहीं होती, और वह तब भी पढ़ने लायक रहती है जब मूल फ़ाइल बनाने वाला प्रोग्राम बदल चुका हो।

फ़ाइल एक्सटेंशन: .txt, MIME टाइप: text/plain

विकिपीडिया पर TXT

PDF से TXT: टेक्स्ट फ़ाइल क्या रखती है

एक प्लेन टेक्स्ट फ़ाइल में पेज नहीं, शब्द रहते हैं। कनवर्ज़न के बाद यह बचता है और यह नहीं।

PDF से TXT फ़ाइल में
शब्द और लाइन ब्रेक रखे जाते हैं
रीडिंग ऑर्डर ऊपर से नीचे तक रखा जाता है
बोल्ड, इटैलिक और फॉन्ट्स हटा दिए जाते हैं
इमेज, लोगो और चार्ट हटा दिए जाते हैं
टेबल ग्रिड के बिना टेक्स्ट के रूप में रखी जाती हैं
मल्टी-कॉलम पेज एक कॉलम में बहा दिए जाते हैं
हेडर, फुटर और पेज नंबर टेक्स्ट के साथ ही लिख दिए जाते हैं

एक प्लेन टेक्स्ट फ़ाइल शब्दों को रखती है, लेआउट को नहीं। जब फॉर्मेटिंग शब्दों जितनी ही अहम हो, तब PDF से Word ऐप ज़्यादा सही विकल्प है।

PDF से टेक्स्ट कनवर्ज़न कब सही विकल्प है

PDF में शब्द पेज लेआउट में बंद रहते हैं। ये वे स्थितियाँ हैं जहाँ उन्हें साधारण रूप में निकालने से सबसे ज़्यादा काम बचता है।

उद्धरण और रिसर्च

पेपर, रिपोर्ट और किताबें अक्सर PDF में शेयर की जाती हैं। टेक्स्ट एक बार निकालें और जिन हिस्सों की जरूरत हो उन्हें नोट्स में पेस्ट करें, बजाय उन्हें दोबारा टाइप करने के।

लंबे दस्तावेज़ में खोज करना

टेक्स्ट फ़ाइल किसी भी एडिटर में खुल जाती है, ताकि आप पेज दर पेज पढ़ने के बजाय सीधे किसी नाम, तारीख या राशि पर जा सकें।

टेक्स्ट को किसी दूसरे टूल में देना

ट्रांसलेटर, राइटिंग टूल, स्क्रीन रीडर और स्प्रेडशीट सभी प्लेन टेक्स्ट लेते हैं। TXT वह फ़ॉर्मेट है जिसे लगभग हर टूल बिना किसी कनवर्टर के स्वीकार कर लेता है।

आपका डेटा, सुरक्षित

जो PDF लोग कन्वर्ट करते हैं वे अक्सर कॉन्ट्रैक्ट, इनवॉइस या निजी पत्राचार होते हैं। इन्हें यहाँ ठीक-ठीक कैसे संभाला जाता है, यह रहा।

TLS एन्क्रिप्शन

हर अपलोड और डाउनलोड एन्क्रिप्टेड कनेक्शन पर चलता है, ताकि आपकी फाइलें ट्रांज़िट में पढ़ी न जा सकें।

ISO 27001 डाटा सेंटर

प्रोसेसिंग यूरोपीय संघ के अंदर प्रमाणित डाटा सेंटरों में होती है।

कोई मानव एक्सेस नहीं

टेक्स्ट पहचान पूरी तरह स्वचालित है। कोई भी आपके स्कैन या दस्तावेज़ नहीं पढ़ता, और कुछ भी थर्ड पार्टी के साथ साझा नहीं किया जाता।

PDF को टेक्स्ट में कैसे बदलें?

1

अपलोड

अपनी PDF अपलोड करें।

2

चुनें

अगर PDF स्कैन है तो OCR चालू करें। जब फ़ाइल में टेक्स्ट पहले से सेलेक्ट किया जा सकता हो तो इसे बंद रखें।

3

समायोजित करें

मेनू से अपने दस्तावेज़ की भाषा चुनें (वैकल्पिक)।

4

कनवर्ट करें

"Start" पर क्लिक करें और रूपांतरण पूरा होने तक प्रतीक्षा करें।

PDF से टेक्स्ट से जुड़े सवाल

क्या यह PDF से टेक्स्ट कनवर्टर मुफ्त है?

हाँ। PDF को टेक्स्ट में कनवर्ट करना मुफ्त है, इसके लिए किसी अकाउंट की जरूरत नहीं, और कोई ईमेल पता नहीं माँगा जाता। फ़ाइल अपलोड करें, कनवर्ज़न शुरू करें और टेक्स्ट डाउनलोड करें। सिर्फ़ बहुत बड़ी फ़ाइलों और लंबे बैच के लिए प्लान मायने रखता है।

PDF को टेक्स्ट में कैसे कनवर्ट करें?

ऊपर PDF अपलोड करें, अगर फ़ाइल में टेक्स्ट पहले से सेलेक्ट किया जा सकता हो तो OCR टॉगल बंद रखें, और कनवर्ज़न शुरू करें। नतीजा एक प्लेन टेक्स्ट फ़ाइल होती है जिसे आप डाउनलोड कर सकते हैं और किसी भी एडिटर में खोल सकते हैं। कुछ भी इंस्टॉल करने की जरूरत नहीं।

मैं PDF से टेक्स्ट कैसे कॉपी करूँ?

अगर शब्द उन पर ड्रैग करने पर हाइलाइट होते हैं, तो आप उन्हें सीधे अपने PDF रीडर से कॉपी कर सकते हैं। अगर वे हाइलाइट नहीं होते, तो पेज इमेज है और कुछ भी सेलेक्ट नहीं किया जा सकता। PDF को टेक्स्ट में कनवर्ट करने से यह समस्या हल हो जाती है, क्योंकि आउटपुट एक टेक्स्ट फ़ाइल होती है जिससे आप आसानी से कॉपी कर सकते हैं।

क्या मैं PDF को TXT में भी कनवर्ट कर सकता हूँ?

यही वह फ़ॉर्मेट है जिसे यह कनवर्टर लिखता है। TXT प्लेन टेक्स्ट फ़ॉर्मेट है, इसलिए आपकी डाउनलोड की गई फ़ाइल का एक्सटेंशन .txt होता है और मीडिया टाइप text/plain। यह Notepad, TextEdit, किसी भी कोड एडिटर और किसी भी फोन पर बिना अतिरिक्त सॉफ्टवेयर के खुल जाती है।

डिफ़ॉल्ट रूप से OCR बंद क्यों है?

क्योंकि ज़्यादातर PDFs को इसकी जरूरत नहीं होती। जिस PDF में असली टेक्स्ट लेयर हो, वह ज़्यादा तेज और सटीक रूप से कनवर्ट होती है जब शब्दों को इमेज से पहचानने के बजाय सीधे कॉपी किया जाता है। OCR सिर्फ़ तभी चालू करें जब पेज स्कैन या फ़ोटो हों, और इसके साथ ही भाषा चयन दिखेगा।

क्या यह PDF से टेक्स्ट कनवर्टर स्कैन की गई PDF पर काम करता है?

हाँ, जब OCR चालू हो। पहचान पेज की इमेज से अक्षर पढ़ती है और उन्हें टेक्स्ट फ़ाइल में लिख देती है। अगर आप ज़्यादातर स्कैन को ही कनवर्ट करते हैं, तो scanned PDF to text app वही परिणाम पाने का और ज़्यादा सीधा तरीका है।

टेक्स्ट पहचान किन भाषाओं को पढ़ सकती है?

यह 124 स्रोत भाषाओं को पहचानता है। यूरोपीय भाषाओं के साथ सूची में हिंदी, बांग्ला, तमिल, उर्दू, अरबी, थाई, जापानी, कोरियाई और चीनी (सरलीकृत और पारंपरिक, दोनों रूपों में) शामिल हैं। सबसे अच्छे नतीजे के लिए अपने दस्तावेज़ की भाषा चुनें।

क्या मैं एक साथ कई PDF को टेक्स्ट में बदल सकता हूँ?

हाँ। जितने PDF आपको चाहिए, उन्हें जोड़ें और वे एक ही बार में कनवर्ट हो जाएँगे, हर फ़ाइल अलग टेक्स्ट फ़ाइल के रूप में मिलेगी, जिसमें वही OCR सेटिंग और वही भाषा लागू होगी।

टेक्स्ट रिकग्निशन के बारे में और जानकारी

पीले डेस्क पर एक खुली किताब, स्कैनर ब्रैकेट से घिरी हुई, जिसके पेज पर Save Valuable Text With OCR शीर्षक छपा हुआ है
कैसे करें

OCR के साथ महत्वपूर्ण टेक्स्ट सहेजें

स्कैन किए गए दस्तावेज़ों और छवियों से महत्वपूर्ण टेक्स्ट को OCR (Optिकल कैरेक्टर रिकग्निशन) के साथ डिजिटाइज़ करें। छवियों से टेक्स्ट को ऑनलाइन आसानी से निकालें।

लेख पढ़ें