এই JPG থেকে PDF কনভার্টারটি OCR চালাতে পারে, ফলে আপনার ছবির টেক্সট নির্বাচযোগ্য টেক্সটে পরিণত হয়।
অথবা ড্র্যাগ ও ড্রপ করুন, পেস্ট করুন, বা ক্লাউড থেকে নির্বাচন করুন
OCR কী? Optical character recognition হলো এমন একটি প্রযুক্তি যা স্ক্যান করা ডকুমেন্ট বা ছবিতে থাকা অক্ষর, সংখ্যা বা বিশেষ চিহ্ন শনাক্ত করতে ব্যবহৃত হয়। একটি OCR কনভার্টার ব্যবহার করে আপনি এমন ফাইল থেকে লেখা বের করে তা পরিবর্তন, সম্পাদনা, প্রিন্ট বা সংরক্ষণ করতে পারেন.
টেক্সট রিকগনিশন ছাড়া PDF এর ভেতরের JPG এখনও একটি ছবি মাত্র। এর ভেতরে কিছুই নির্বাচন, কপি বা অনুসন্ধান করে পাওয়া যায় না। OCR অক্ষরগুলো পড়ে এবং সেগুলোকে PDF এ আসল টেক্সট হিসেবে রেখে দেয়।
টেক্সট রিকগনিশন 124টি ভাষা পড়ে, ইংরেজি, স্প্যানিশ ও পর্তুগিজ থেকে শুরু করে হিন্দি, আরবি, রুশ ও জাপানি পর্যন্ত। আপনার পৃষ্ঠার ভাষা ঠিক করে দিন, ফলাফল বোঝার মতোভাবে বেশি নির্ভুল হবে।
এক হাতে পৃষ্ঠা ধরে আরেক হাতে ছবি তুললে কখনোই একদম চারকোনা হয় না। ডেস্কিউ স্বয়ংক্রিয়ভাবে বাঁকা স্ক্যান বা ছবিকে সোজা করে, এতে টেক্সট রিকগনিশনের কাজ অনেক সহজ হয়ে যায়।
একটি JPG তে থাকে পিক্সেল, অক্ষর নয়। এটিকে সরাসরি PDF এ রাখলে পৃষ্ঠা ঠিকই দেখায়, কিন্তু কম্পিউটার তখনও এটিকে কেবল একটি ফটোগ্রাফ হিসেবে দেখে: কোনো শব্দ নির্বাচন করা যায় না, কোনো উদ্ধৃতি কপি করা যায় না, আর অনুসন্ধানে কিছুই পাওয়া যায় না।
টেক্সট রিকগনিশন এই অবস্থাটাই বদলায়। এটি ছবির ভেতরের আকারগুলো পড়ে, সেগুলো কোন অক্ষর তা নির্ধারণ করে, আর সেই অক্ষরগুলোকে ছবির পাশে PDF এ রেখে দেয়। পৃষ্ঠা দেখতে আপনার আসলের মতোই থাকে, আর শব্দগুলো আসল শব্দের মতো আচরণ করে।
কনভার্সন শুরুর আগে OCR অপশন চালু করুন। এটি বন্ধ রাখলে আপনি ঠিকঠাকই একটি PDF পাবেন, কিন্তু যে কোনো সার্চ বক্সে পেস্ট করলে সেটি পুরোপুরি অপাঠ্য থেকে যাবে।
JPG এবং JPEG একই ইমেজ ফরম্যাট, কেবল ফাইল এক্সটেনশন আলাদা। পুরোনো Windows সংস্করণে তিন অক্ষরের বেশি ফাইল এক্সটেনশন নেওয়া যেত না, তাই সেখানে .jpg ব্যবহার করা হত, আর Mac ও UNIX সিস্টেমগুলো .jpeg ব্যবহার করত।
এখন যদিও উইন্ডোজ কম্পিউটারগুলো বড় .jpeg এক্সটেনশনসহ ফাইল সমর্থন করে, তিন অক্ষরের এক্সটেনশনটিই বেশি ব্যবহৃত হয়। অতিরিক্ত অক্ষরটি ছাড়া JPG এবং JPEG ছবির মধ্যে বাস্তবে কোনো পার্থক্য নেই।
এখানে দুটিই নেওয়া হয়, এবং দুটোই একইভাবে PDF এ কনভার্ট হয়।
ফাইল এক্সটেনশন: .jpg, MIME টাইপ: image/jpeg
উইকিপিডিয়ায় JPGডিফল্ট সেটিংস একটি সাধারণ ইমেজের জন্য যথেষ্ট। আসলে কেবল OCR সুইচটিই আপনার মনোযোগ চায়।
| সেটিং | এটি কী করে | কখন বদলাবেন |
|---|---|---|
| OCR ব্যবহার করুন | ছবির মধ্যে থাকা লেখাটি পড়ে এবং তা PDF এ আসল টেক্সট হিসেবে রেখে দেয়। | ছবিতে যে শব্দগুলো রাখতে চান, সেগুলো থাকলে সবসময় এটি অন করুন। |
| ভাষা | টেক্সট রিকগনিশনকে জানায় কোন অক্ষরমালা এবং শব্দভাণ্ডার আশা করতে হবে। 124টি ভাষা পাওয়া যায়। | এটি ছবির লেখার ভাষায় সেট করুন। |
| ডেস্কিউ | বাঁকা স্ক্যান বা ছবিকে স্বয়ংক্রিয়ভাবে সোজা করে। | হাতে তোলা ছবি অথবা স্ক্যানারে কোণ করে দেওয়া যে কোনো কিছুর জন্য এটি অন করুন। |
| PDF ভার্সন | আউটপুটকে নির্দিষ্ট একটি PDF স্পেসিফিকেশন (1.4 থেকে 2.0) অনুযায়ী লেখে। | যে সিস্টেমে ফাইল পাঠাবেন, সেটি নির্দিষ্ট কোনো সংস্করণ না চাইলে এটি যেমন আছে তেমনই রাখুন। |
ফ্রি প্ল্যানে এক কনভার্সনে ৫০ এমবি পর্যন্ত ৩টি ফাইল নেওয়া হয়, এবং প্রতিটি JPG আলাদা PDF হিসেবে ফেরত আসে।
প্রতিদিনের তিনটি কাজ, যেখানে মূল বিষয় ছবি নয়, ভেতরের শব্দগুলো।
অনেক স্ক্যানার ও স্ক্যানার অ্যাপ সরাসরি JPG তে সেভ করে। সেটি OCR সহ PDF এ কনভার্ট করলে আলাদা আলাদা ছবির ফোল্ডারের বদলে একটি ডকুমেন্ট পান, আর ভেতরের লেখাটাও সঙ্গে আসে।
ফোনে তোলা কোনো চুক্তি, ফর্ম বা বইয়ের পাতার ছবি। ডেস্কিউ ছবিটিকে চারকোনা করে, টেক্সট রিকগনিশন সেটি পড়ে নেয়, আর আপনি যে PDF ফেরত পান তা অন্য যে কোনো ডকুমেন্টের মতোই সার্চ করা যায়।
রিসিট, ইনভয়েস ও চিঠি সাধারণত ইমেজ হিসেবে আসে। টেক্সট রিকগনিশন সহ PDF এ কনভার্ট করলে এগুলো একবার ফাইল করলেই হয়, পরে টাকার অঙ্ক, নাম বা রেফারেন্স নম্বর দিয়ে খুঁজে পাওয়া যায়।
আপনার JPG ইমেজ আপলোড করুন।
ছবির ভেতরের টেক্সট শনাক্ত করার জন্য OCR অপশনটি চালু করুন।
আপনার JPG এর টেক্সটের ভাষা নির্বাচন করুন। (ঐচ্ছিক)
আপনার ছবি বা ইমেজ কাত হয়ে থাকলে deskewing চালু করুন। (ঐচ্ছিক)
কনভার্সন শুরু করুন। অল্প অপেক্ষার পর আপনি আপনার PDF ডকুমেন্ট ডাউনলোড করতে পারবেন।
হ্যাঁ। OCR সহ JPG থেকে PDF কনভার্ট করা ফ্রি এবং কোনো অ্যাকাউন্ট লাগে না। ইমেজ আপলোড করুন, OCR অন করুন, Start চাপুন এবং PDF ডাউনলোড করুন। বড় ফাইল ও দীর্ঘ ব্যাচের জন্যই কেবল সাবস্ক্রিপশন গুরুত্বপূর্ণ।
হ্যাঁ, যতক্ষণ না পর্যন্ত আপনি শুরুর আগেই OCR চালু রাখেন। টেক্সট রিকগনিশন শব্দগুলোকে PDF এ লিখে দেয়, তাই সেগুলো নির্বাচন, কপি এবং অনুসন্ধান করে পাওয়া যায়। OCR বন্ধ থাকলে PDF এ কেবল ছবি থাকে।
একইভাবে, শুধু একটি ধাপ বেশি। ডেস্কিউ অন করলে কোণ করে তোলা পৃষ্ঠাটি আগে সোজা হয়, আর হাতে তোলা ছবির প্রায় সবকটিই এইটাই চায়। ফোকাস করা, সমান আলোতে তোলা ছবি প্রায় ফ্ল্যাটবেড স্ক্যানের মতোই ভালোভাবে পড়া যায়।
১২৪টি, ইংরেজি, স্প্যানিশ ও পর্তুগিজ থেকে শুরু করে হিন্দি, আরবি, রুশ ও জাপানি পর্যন্ত। শুরু করার আগে আপনার পৃষ্ঠাটি যে ভাষায় লেখা, সেটি বেছে নিন, কারণ কোন অ্যালফাবেট আশা করতে হবে তা জানা থাকলে রিকগনিশন অনেক বেশি নির্ভুল হয়।
হ্যাঁ। যত দরকার তত ফাইল যোগ করুন, সব একবারে কনভার্ট হবে, প্রতিটি একই সেটিংসহ আলাদা PDF হিসেবে ফেরত আসবে। ফ্রি প্ল্যানে প্রতি কনভার্সনে ৫০ এমবি পর্যন্ত ৩টি ফাইল নেওয়া হয়।
হ্যাঁ। JPG এবং JPEG একই ফরম্যাট, শুধু ফাইল এক্সটেনশন আলাদা, এবং দুটোই এখানে নেওয়া হয়। অন্য সাধারণ ইমেজ ফরম্যাটও কাজ করে, তাই একই পাতার TIF বা BMP ফাইলও ঠিক মতো কনভার্ট হয়।
তার বদলে কোনো একটি PDF অ্যাপ ব্যবহার করুন। Make PDF searchable আপনার কাছে থাকা PDF এ শনাক্ত করা টেক্সট যোগ করে, আর PDF to text সেটি থেকে শব্দগুলো নিয়ে সেগুলোকে প্লেইন টেক্সট ফাইল হিসেবে দেয়। এই পৃষ্ঠাটি ইমেজ ফাইলের জন্য।
এটি এনক্রিপ্টেড কানেকশন দিয়ে পাঠানো হয় এবং ইউরোপে থাকা সার্ভারে স্বয়ংক্রিয়ভাবে প্রসেস করা হয়। কেউ আপনার ফাইল পড়ে বা কপি করে না, এগুলো AI মডেল প্রশিক্ষণে ব্যবহার করা হয় না, আর ডাউনলোড লিংক এলোমেলো থাকে, তাই অনুমান করা যায় না।
স্ক্যান করা ডকুমেন্ট ও ছবি থেকে OCR (Optical Character Recognition) ব্যবহার করে মূল্যবান লেখা ডিজিটাইজ করুন। অনলাইনে সহজেই ছবির থেকে লেখা বের করুন।
প্রবন্ধটি পড়ুনএখানের প্রতিটি অ্যাপ ব্রাউজারেই চলে, কিছু ইনস্টল করতে হয় না।