स्कैन किए गए दस्तावेज़ों को सर्च करने योग्य PDF में बदलें। कीवर्ड, नंबर, नाम और अन्य शब्दों से अपने स्कैन, दस्तावेज़ और PDF की सामग्री में खोजें।
या अपनी फ़ाइल खींचें, पेस्ट करें, या क्लाउड से चुनें
आप कुछ भी अपलोड करने से पहले ऐप आपकी फ़ाइल के साथ क्या करता है।
अपने दस्तावेज़ों को डिजिटल रूप में बदलना और एक डिजिटल ऑफिस चलाना न केवल पर्यावरण के लिए अच्छा है, बल्कि यह वह समय भी बचाता है जो आप आमतौर पर फोल्डर दर फोल्डर खोजने में लगाते हैं। हालांकि, कई स्कैन केवल स्कैन किए गए दस्तावेज़ों की छवियाँ ही होते हैं। इन्हें फ़ाइल नाम के अलावा खोजा नहीं जा सकता।
किसी स्कैन को खोजने योग्य बनाकर, स्कैन की हुई छवि में एक अतिरिक्त टेक्स्ट लेयर जोड़ दी जाती है, जिससे एक तथाकथित हाइब्रिड PDF बनती है। यह टेक्स्ट लेयर आपको PDF के अंदर कीवर्ड, राशि और अन्य संख्याएँ, नाम या विषयों को खोजने की सुविधा देती है।
इसलिए एक खोजने योग्य PDF बिल्कुल वैसा ही दिखता है जैसा स्कैन जिससे वह बना है। पेज, मुहरें और हस्तलिपि सब अपनी जगह पर रहते हैं। फर्क नीचे होता है, जहाँ असली अक्षरों की एक लेयर आपके पाठक, आपके कंप्यूटर और आपके डॉक्यूमेंट मैनेजर के पढ़ने के लिए इंतज़ार करती है।
फ़ाइल एक्सटेंशन: .pdf, MIME प्रकार: application/pdf
विकिपीडिया पर PDFयह ऐप एक PDF लेता है और बदले में एक PDF देता है। दस्तावेज़ के रूप में कुछ भी नहीं बदलता। पेज अपना आकार रखते हैं, स्कैन अपने निशान रखते हैं, और उनके पीछे पहचाने गए टेक्स्ट की एक छुपी हुई लेयर लिखी जाती है।
यही बात इसे उन ऐप्स से अलग करती है जो फ़ाइल से टेक्स्ट निकाल लेते हैं। वे आपको शब्द एक साधारण टेक्स्ट फ़ाइल में देते हैं और लेआउट को पीछे छोड़ देते हैं। यह वाला लेआउट को जैसा है वैसा छोड़ता है, ताकि आप एक ऐसा दस्तावेज़ रखें जिसे आप आगे भेज सकें, प्रिंट कर सकें या साइन कर सकें, और यह साथ ही टेक्स्ट फ़ाइल की तरह खोजने योग्य भी रहता है।
अपलोड PDF होना चाहिए। अगर आपके पास फोटो या इमेज फ़ाइल है, तो JPG to PDF और PNG to PDF ऐप आपके लिए PDF बनाते हैं और उसी समय वही टेक्स्ट पहचान चलाते हैं।
टेक्स्ट पहचान किसी पेज को उस भाषा के मॉडल के आधार पर पढ़ती है जिसकी उसे उम्मीद होती है, इसलिए उस भाषा का नाम देना नतीजे के लिए सबसे ज़्यादा उपयोगी काम है जो आप कर सकते हैं। यह सेटिंग अपलोडर के पास होती है और यही अकेली पसंद है जो ऐप आपसे पूछता है।
यह एक समय में एक से अधिक भाषा ले सकता है। अंग्रेज़ी कवर पेज और जर्मन अनुबंध वाला कॉन्ट्रैक्ट दोनों चुने होने पर बेहतर पढ़ा जाएगा, और वही बात उस स्कैन पर भी लागू होती है जिसमें लैटिन स्क्रिप्ट के साथ अरबी, सिरिलिक या चीनी मिश्रित हो।
सूची में 124 स्रोत भाषाएँ हैं, जिनमें अरबी, हिंदी, थाई, वियतनामी, चीनी (सरलीकृत और पारंपरिक दोनों रूपों में), और अज़रबैजानी, सर्बियाई और उज़्बेक की सिरिलिक लिपियाँ शामिल हैं। अगर आप कुछ नहीं बदलते तो आपके लिए अंग्रेज़ी पहले से चुनी हुई रहती है।
टेक्स्ट पहचान हर पेज को बराबर नहीं पढ़ती। यहाँ वह है जो आप अपनी फ़ाइल से उम्मीद कर सकते हैं।
| आपके पास जो PDF है | क्या इसे खोजने योग्य बनाया जा सकता है | क्या करें |
|---|---|---|
| छपे हुए पेजों का एक समतल स्कैन | हाँ | इसे अपलोड करें और दस्तावेज़ की भाषा चुनें। यह वही फ़ाइल है जिसके लिए ऐप बनाया गया है। |
| फ़ोन से फोटो खींचा हुआ पेज | अधिकतर | छायाएँ, कोण और मुड़ा हुआ रीढ़ हिस्सा सभी सटीकता घटाते हैं। जहाँ संभव हो, समतल और समान रोशनी में फोटो लें। |
| हल्की कॉपी, फैक्स या हस्तलिपि | आंशिक रूप से | प्रिंट और हस्तलिपि एक जैसे सवाल नहीं हैं। खामियों की उम्मीद करें और भरोसा करने से पहले नतीजा पढ़ें। |
| ऐसा PDF जिसका टेक्स्ट आप पहले ही चुन सकते हैं | कुछ जोड़ने की ज़रूरत नहीं | यह पहले से ही खोजने योग्य है। अगर आप केवल शब्दों को अलग फ़ाइल में चाहते हैं, तो PDF to Text का उपयोग करें। |
| पासवर्ड-संरक्षित या क्षतिग्रस्त PDF | नहीं | ऐप इसे खोल नहीं सकता। पहले सुरक्षा हटाएँ या फ़ाइल को ठीक करें, फिर दोबारा अपलोड करें। |
| JPG, PNG या अन्य इमेज फ़ाइल | यहां नहीं | JPG to PDF और PNG to PDF PDF बनाते हैं और वही पहचान चलाते हैं। |
पहचान की गुणवत्ता स्कैन की गुणवत्ता पर निर्भर करती है। तिरछा पेज, कम रेज़ोल्यूशन या कागज़ पर छाया, सब सटीकता घटाते हैं, इसलिए दस्तावेज़ को फाइल करने से पहले नतीजा पढ़ लेना बेहतर है।
स्कैन और खोजने योग्य PDF स्क्रीन पर एक जैसे दिखते हैं। ये तीन काम केवल उनमें से एक कर सकता है।
किसी भी PDF रीडर में Find कमांड सीधे उस शब्द पर ले जाती है जो आपने टाइप किया है। 90 पेज के लीज़ पर यह एक खोज और एक दोपहर के बीच का अंतर है।
डेस्कटॉप सर्च और ज़्यादातर क्लाउड ड्राइव PDF के अंदर टेक्स्ट लेयर पढ़ते हैं। एक खोजने योग्य PDF नतीजों में उसके अंदर लिखी बात से मिलता है, केवल फ़ाइल नाम से नहीं।
स्कैन पर कर्सर खींचने से कुछ नहीं होता, क्योंकि वहाँ चुनने के लिए कुछ है ही नहीं। एक खोजने योग्य PDF आपको एक पैराग्राफ़ उठाकर मेल या नोट में पेस्ट करने देता है।
जो कागज़ात आप स्कैन करते हैं और जो दस्तावेज़ आप कन्वर्ट करते हैं, वे निजी हो सकते हैं। यहाँ बताया है कि आपकी फाइलों को ठीक-ठीक कैसे संभाला जाता है।
हर अपलोड और डाउनलोड एन्क्रिप्टेड कनेक्शन पर चलता है, ताकि आपकी फाइलें ट्रांज़िट में पढ़ी न जा सकें।
टेक्स्ट पहचान पूरी तरह स्वचालित है। कोई भी आपके स्कैन या दस्तावेज़ नहीं पढ़ता, और कुछ भी थर्ड पार्टी के साथ साझा नहीं किया जाता।
केवल उतना ही प्रोसेस किया जाता है जितना कनवर्ज़न के लिए ज़रूरी है। आपकी फ़ाइलें कभी भी AI मॉडल ट्रेन करने के लिए उपयोग नहीं की जातीं।
वह PDF अपलोड करें जिसे आप खोजने योग्य बनाना चाहते हैं। स्कैन किए हुए और फोटो लिए हुए दोनों तरह के पेज काम करते हैं।
सूची से अपने PDF दस्तावेज़ की भाषा चुनें (वैकल्पिक)।
"Start" पर क्लिक करें। थोड़ी प्रतीक्षा के बाद आपका दस्तावेज़ तैयार हो जाएगा।
Searchable PDF एक स्कैन होता है जिसके पीछे असली टेक्स्ट की एक परत होती है। पेज बिल्कुल वैसे ही दिखते हैं जैसे कागज पर थे, लेकिन नीचे के शब्दों को खोजा, चुना और कॉपी किया जा सकता है। इसे हाइब्रिड PDF भी कहा जाता है, क्योंकि यह एक ही फाइल में तस्वीर और टेक्स्ट दोनों रखता है।
ऊपर PDF अपलोड करें, दस्तावेज़ की भाषा चुनें और Start दबाएं। Text recognition पेजों को पढ़ती है, जो टेक्स्ट मिलती है उसे एक छिपी परत में लिखती है और PDF वापस दे देती है। आप एक साथ कई PDF अपलोड कर सकते हैं, और हर फाइल अलग-अलग वापस मिलती है।
हाँ। PDF को searchable बनाना मुफ्त है, इसके लिए न तो साइन-अप चाहिए और न ही कोई क्रेडिट लगता है। कोई प्लान केवल बहुत बड़े दस्तावेज़ों और लंबी बैच प्रोसेसिंग के लिए ही मायने रखता है।
नहीं। अगर आप कर्सर से किसी लाइन पर ड्रैग कर सकते हैं और शब्द हाईलाइट होते हैं, तो PDF में पहले से ही टेक्स्ट लेयर है और वह searchable है। दोबारा चलाने से कुछ नहीं बदलेगा। अगर आप शब्दों को अलग फाइल में चाहते हैं, तो इसकी जगह PDF to Text ऐप का उपयोग करें।
यह 124 स्रोत भाषाएं पढ़ सकता है, जिनमें अरबी, हिंदी, थाई, वियतनामी, चीनी (सरलीकृत और पारंपरिक), और अज़रबैजानी, सर्बियाई और उज़्बेक की सिरिलिक रूप शामिल हैं। दस्तावेज़ में जो भी भाषाएं हों, वे सब चुनें, क्योंकि मिश्रित पेज तभी सबसे अच्छा पढ़ा जाता है जब उसकी सभी भाषाएं चुनी गई हों।
रिकॉग्निशन की गुणवत्ता स्कैन की गुणवत्ता पर निर्भर करती है। टेढ़ा पेज, कम रेज़ॉल्यूशन, कागज पर छाया या हाथ से लिया गया फोटो, सभी से सटीकता कम होती है, और हस्तलिखित टेक्स्ट प्रिंट से भी ज्यादा कठिन होता है। जहां संभव हो, 300 dpi पर सीधा स्कैन करें और शुरू करने से पहले दस्तावेज़ की भाषा सेट करें।
इस ऐप से नहीं। यह टेक्स्ट लेयर जोड़ती है, हटाती नहीं। PDF को non-searchable बनाने का मतलब है हर पेज को दोबारा सिर्फ इमेज में बदल देना, जो इसका उल्टा काम है, और यहां मौजूद कोई भी टूल ऐसा नहीं करता।
अपलोड और डाउनलोड एन्क्रिप्टेड कनेक्शन पर होते हैं, प्रोसेसिंग यूरोपीय संघ के अंदर प्रमाणित डाटा सेंटरों में होती है, और पूरी प्रक्रिया स्वचालित है, इसलिए कोई भी आपके दस्तावेज़ नहीं पढ़ता। आपकी फाइलों का कभी भी AI मॉडल ट्रेन करने के लिए उपयोग नहीं किया जाता और आप उनके अधिकार अपने पास ही रखते हैं।
स्कैन किए गए दस्तावेज़ों और छवियों से महत्वपूर्ण टेक्स्ट को OCR (Optिकल कैरेक्टर रिकग्निशन) के साथ डिजिटाइज़ करें। छवियों से टेक्स्ट को ऑनलाइन आसानी से निकालें।
लेख पढ़ेंइनमें से हर टूल ब्राउज़र में चलता है। न इंस्टॉल की जरूरत, न अकाउंट की, और इनके पीछे एक जैसा टेक्स्ट रिकग्निशन काम करता है।