স্ক্যান করা ডকুমেন্টকে অনুসন্ধানযোগ্য PDF-এ রূপান্তর করুন। কীওয়ার্ড, সংখ্যা, নাম এবং আরও অনেক কিছুর সাহায্যে আপনার স্ক্যান, ডকুমেন্ট ও PDF-এর ভেতরের কনটেন্ট অনুসন্ধান করুন।
অথবা ড্র্যাগ ও ড্রপ করুন, পেস্ট করুন, বা ক্লাউড থেকে নির্বাচন করুন
আপনি কিছু আপলোড করার আগে, এই অ্যাপ আপনার ফাইলের সাথে কী করে।
আপনার ডকুমেন্টগুলো ডিজিটাল করা এবং ডিজিটাল অফিস চালানো পরিবেশের জন্য ভালো হওয়ার পাশাপাশি, সাধারণত ফোল্ডারে খুঁজতে যে প্রচুর সময় লাগে সেটাও বাঁচায়। তবে অনেক স্ক্যান করা ফাইলে শুধু ডকুমেন্টের ছবি থাকে। এগুলোতে, ফাইলের নাম ছাড়া আর কিছু খুঁজে পাওয়া যায় না।
কোনো স্ক্যানকে সার্চযোগ্য করলে, স্ক্যান করা ছবিতে একটি অতিরিক্ত টেক্সট লেয়ার যোগ করা হয়, যাকে হাইব্রিড PDF বলা হয়। এই টেক্সট লেয়ার আপনাকে PDF এর ভেতরে কীওয়ার্ড, পরিমাণ ও অন্যান্য সংখ্যা, নাম বা বিষয়বস্তু খুঁজতে সাহায্য করে।
একটি সার্চযোগ্য PDF তাই দেখতে ঠিক তার উৎস স্ক্যানের মতোই থাকে। পেজ, সিলমোহর আর হাতের লেখা সব আগের জায়গাতেই থাকে। পার্থক্যটা থাকে নিচে, যেখানে আসল অক্ষরের একটি লেয়ার আপনার পাঠক, আপনার কম্পিউটার আর আপনার ডকুমেন্ট ম্যানেজারের পড়ার জন্য অপেক্ষা করে।
ফাইল এক্সটেনশন: .pdf, MIME টাইপ: application/pdf
উইকিপিডিয়ায় PDFএই অ্যাপ একটি PDF নেয় এবং আবার একটি PDF ফেরত দেয়। ডকুমেন্টের চেহারায় কিছুই বদলায় না। পেজের সাইজ একই থাকে, স্ক্যানের দাগচিহ্ন টিকে থাকে, আর তাদের পেছনে লেখা হয় স্বীকৃত টেক্সটের একটি লুকানো লেয়ার।
এটাই একে সেই অ্যাপগুলো থেকে আলাদা করে যারা ফাইল থেকে শুধু টেক্সট টেনে বের করে। ওগুলো আপনাকে সাদামাটা টেক্সট ফাইলে শব্দগুলো দিয়ে লেআউট ফেলে রাখে। এটি লেআউটকে অক্ষত রাখে, তাই আপনার কাছে এমন একটি ডকুমেন্ট থাকে যা আপনি পাঠাতে, প্রিন্ট করতে বা সই করতে পারেন, আর সেটি আবার টেক্সট ফাইলের মতোই সার্চ করা যায়।
আপলোডটি অবশ্যই PDF হতে হবে। যদি আপনার কাছে তার বদলে কোনো ছবি বা ইমেজ ফাইল থাকে, তাহলে JPG to PDF এবং PNG to PDF অ্যাপগুলো আপনার জন্য PDF বানায় এবং একই সাথে তাতেই টেক্সট রিকগনিশন চালায়।
টেক্সট রিকগনিশন কোনো পেজকে সেই ভাষার মডেলের সঙ্গে মিলিয়ে পড়ে, যে ভাষা সে আশা করে পাবে, তাই সেই ভাষার নাম বলা ফলাফলের জন্য আপনার করা সবচেয়ে কাজে লাগা কাজ। এই সেটিং আপলোডারের পাশে থাকে এবং এটিই একমাত্র পছন্দ যা অ্যাপ আপনাকে করতে বলে।
এটি একসাথে একাধিক ভাষা নেয়। ইংরেজি কভার পেজ আর জার্মান সংযোজনসহ কোনো চুক্তি, বা ল্যাটিন লিপির সাথে আরবি, সিরিলিক বা চাইনিজ মিশ্রিত কোনো স্ক্যান, সব কটি ভাষা একসাথে বাছলে সবচেয়ে ভালোভাবে পড়া যায়।
তালিকায় আছে 124টি উৎস ভাষা; তার মধ্যে আছে আরবি, হিন্দি, থাই, ভিয়েতনামি, সরলীকৃত ও প্রথাগত উভয় রূপে চাইনিজ, আর আজারবাইজানী, সার্বিয়ান ও উজবেকের সিরিলিক রূপ। আপনি কিছু না বদলালে ইংরেজি আগেই বাছাই করা থাকে।
টেক্সট রিকগনিশন সব পেজ সমানভাবে ভালো পড়ে না। আপনার হাতে থাকা ফাইল থেকে কী আশা করা যায়, সেটি এখানে আছে।
| আপনার যে PDF আছে | এটিকে কি সার্চযোগ্য করা যাবে | কি করবেন |
|---|---|---|
| প্রিন্টেড পেজের সমতল স্ক্যান | হ্যাঁ | এটি আপলোড করুন এবং ডকুমেন্টের ভাষা বেছে নিন। এই ধরনের ফাইলের জন্যই অ্যাপটি বানানো। |
| মোবাইল ফোনে তোলা একটি পেজ | সাধারণত | ছায়া, কোন ও বাঁকানো বাইন্ডিং সবই নির্ভুলতা কমায়। যতটা সম্ভব সরল ও সমান আলোতে ছবি তুলুন। |
| ফিকে কপি, ফ্যাক্স বা হাতের লেখা | আংশিক | প্রিন্ট আর হাতের লেখা এক ধরনের সমস্যা নয়। ফাঁকফোঁকর থাকবে বলে ধরে নিন এবং ব্যবহার করার আগে ফলাফল পড়ে নিন। |
| যার টেক্সট আপনি আগেই সিলেক্ট করতে পারেন এমন PDF | যোগ করার কিছু নেই | এটি আগেই সার্চযোগ্য। আপনি যদি শুধু টেক্সট আলাদা ফাইলে চান, তাহলে PDF to Text ব্যবহার করুন। |
| পাসওয়ার্ড-প্রটেক্টেড বা ক্ষতিগ্রস্ত PDF | না | অ্যাপটি এটি খুলতে পারে না। আগে সুরক্ষা সরান বা ফাইলটি ঠিক করুন, তারপর আবার আপলোড করুন। |
| JPG, PNG বা অন্য কোনো ইমেজ ফাইল | এখানে নয় | JPG to PDF এবং PNG to PDF PDF বানায় এবং একই রিকগনিশন চালায়। |
রিকগনিশনের মান স্ক্যানের মানের ওপর নির্ভর করে। কাগজ বেঁকে থাকা, কম রেজোলিউশন বা পেজের উপর দিয়ে ছায়া পড়া সবই নির্ভুলতা কমায়, তাই ডকুমেন্ট ফাইল করে রাখার আগে ফলাফল পড়ে নেওয়া সঠিক।
স্ক্যান আর সার্চযোগ্য PDF স্ক্রিনে দেখতে একই রকম। কিন্তু কেবল এদের মধ্যে একটিই যে তিনটি কাজ করতে পারে সেগুলো হলো:
যেকোনো PDF রিডারে ফাইন্ড কমান্ড আপনার টাইপ করা শব্দেই সোজা চলে যায়। ৯০ পৃষ্ঠার লিজে সেটিই পার্থক্য, সার্চ করার আর বিকেল কাটানোর।
ডেস্কটপ সার্চ আর বেশির ভাগ ক্লাউড ড্রাইভ PDF-এর ভেতরের টেক্সট লেয়ার পড়ে। একটি সার্চযোগ্য PDF ফলাফলে উঠে আসে এর ভেতরে লেখা শব্দ দিয়ে, শুধু ফাইলের নাম দিয়ে নয়।
স্ক্যানের উপর কার্সর টেনে নিলে কিছুই হয় না, কারণ সিলেক্ট করার মতো কিছুই নেই। একটি সার্চযোগ্য PDF আপনাকে একটি অনুচ্ছেদ তুলে নিয়ে ইমেল বা নোটে পেস্ট করতে দেয়।
আপনি যে কাগজ স্ক্যান করেন আর যে ডকুমেন্ট কনভার্ট করেন, সেগুলো ব্যক্তিগত হতে পারে। আপনার ফাইল কীভাবে হ্যান্ডেল করা হয়, তা এখানে স্পষ্ট করে দেওয়া হয়েছে।
প্রতিটি আপলোড এবং ডাউনলোড এনক্রিপ্টেড কানেকশনের মাধ্যমে চলে, তাই ট্রান্সফারের সময় আপনার ফাইল পড়া যায় না।
টেক্সট রিকগনিশন পুরোপুরি স্বয়ংক্রিয়। কেউ আপনার স্ক্যান বা ডকুমেন্ট পড়ে না, এবং কিছুই তৃতীয় পক্ষের সঙ্গে শেয়ার করা হয় না।
কনভার্সনের জন্য যা প্রয়োজন কেবল সেটাই প্রক্রিয়াকৃত হয়। আপনার ফাইল কখনোই AI মডেল ট্রেন করতে ব্যবহার করা হয় না।
যে PDF-টি আপনি সার্চযোগ্য করতে চান সেটি আপলোড করুন। স্ক্যান করা পেজ আর ছবি তোলা পেজ দুটোই কাজ করে।
তালিকা থেকে ডকুমেন্টের ভাষা বাছাই করুন (ঐচ্ছিক)।
"Start" এ ক্লিক করুন। অল্প অপেক্ষার পর আপনার ডকুমেন্ট প্রস্তুত হবে।
Searchable PDF হলো এমন একটি স্ক্যান, যার পেছনে আসল টেক্সটের একটি লেয়ার থাকে। পৃষ্ঠাগুলো এখনও ঠিক কাগজের মতোই দেখায়, কিন্তু নিচের শব্দগুলো অনুসন্ধান, নির্বাচন এবং কপি করা যায়। একে hybrid PDF-ও বলা হয়, কারণ এটি এক ফাইলেই ছবি এবং টেক্সট দুটোই রাখে।
উপরের PDF ফাইলটি আপলোড করুন, নথির ভাষা বেছে নিন এবং Start চাপুন। টেক্সট রিকগনিশন পৃষ্ঠাগুলো পড়ে, যা পায় তা একটি লুকানো লেয়ারে লিখে PDF আবার ফেরত দেয়। একসঙ্গে কয়েকটি PDF দেওয়া যেতে পারে, এবং প্রতিটি আলাদা করে ফেরত আসে।
হ্যাঁ। PDF searchable করা ফ্রি, এতে সাইন আপের দরকার নেই এবং কোনো ক্রেডিট লাগে না। শুধু খুব বড় নথি এবং দীর্ঘ ব্যাচের ক্ষেত্রে প্ল্যান গুরুত্বপূর্ণ হয়।
না। যদি আপনি কার্সর টেনে একটি লাইনের ওপর নিলে শব্দগুলো হাইলাইট হয়, তাহলে PDF-এ আগে থেকেই একটি টেক্সট লেয়ার আছে এবং এটি আগেই searchable। আবার চালালে কিছু বাড়ে না। আপনি যদি শুধু আলাদা ফাইলে শব্দগুলো চান, তাহলে এর বদলে PDF to Text অ্যাপ ব্যবহার করুন।
এটি 124টি উৎস ভাষা পড়তে পারে, যার মধ্যে রয়েছে আরবি, হিন্দি, থাই, ভিয়েতনামি, সরলীকৃত ও প্রথাগত চীনা, এবং আজারবাইজানি, সার্বিয়ান ও উজবেকের সিরিলিক রূপ। নথিতে যে যে ভাষা আছে সবই নির্বাচন করুন, কারণ মিশ্র পৃষ্ঠা তখনই সবচেয়ে ভালোভাবে পড়া যায় যখন সব ভাষাই তালিকাভুক্ত থাকে।
রিকগনিশনের মান নির্ভর করে স্ক্যানের মানের ওপর। কাত হওয়া পৃষ্ঠা, কম রেজল্যুশন, কাগজের ওপর ছায়া পড়া বা হাতে তোলা কোনো ছবি সবই নির্ভুলতা কমায়, আর হাতের লেখা আবার প্রিন্টের চেয়ে কঠিন। সম্ভব হলে সমতলভাবে 300 dpi-তে স্ক্যান করুন, এবং শুরু করার আগে নথির ভাষা সেট করুন।
এই অ্যাপ দিয়ে তা সম্ভব নয়। এটি টেক্সট লেয়ার যোগ করে, সরায় না। একটি PDF non-searchable করতে হলে প্রতিটি পৃষ্ঠাকে আবার ইমেজে ফ্ল্যাট করতে হয়, যা একেবারে উল্টো কাজ, এবং এখানে থাকা কোনো টুলই তা করে না।
আপলোড ও ডাউনলোড এনক্রিপ্টেড সংযোগের মাধ্যমে হয়, প্রক্রিয়াকরণ হয় ইউরোপীয় ইউনিয়নের ভেতরের সার্টিফায়েড ডেটা সেন্টারে, এবং পুরো পাইপলাইন স্বয়ংক্রিয়, তাই কেউ আপনার নথি পড়ে না। আপনার ফাইল কখনোই AI মডেল প্রশিক্ষণের জন্য ব্যবহার করা হয় না এবং আপনি এগুলোর অধিকার নিজের কাছেই রাখেন।
স্ক্যান করা ডকুমেন্ট ও ছবি থেকে OCR (Optical Character Recognition) ব্যবহার করে মূল্যবান লেখা ডিজিটাইজ করুন। অনলাইনে সহজেই ছবির থেকে লেখা বের করুন।
প্রবন্ধটি পড়ুনএগুলোর প্রতিটিই ব্রাউজারের ভেতরেই চলে। কোনো ইনস্টল নেই, কোনো অ্যাকাউন্ট নেই, আর সবার পেছনেই একই টেক্সট রিকগনিশন কাজ করে।