PDF থেকে টেক্সট OCR কনভার্টার

ব্রাউজারেই PDF কে টেক্সটে রূপান্তর করুন এবং একটি সাধারণ TXT ফাইল ডাউনলোড করুন। প্রয়োজন হলে টেক্সট রিকগনিশন ব্যবহার করুন, আর প্রয়োজন না হলে বন্ধ রাখুন।

আপনার ফাইল আপলোড করুন

অথবা ড্র্যাগ ও ড্রপ করুন, পেস্ট করুন, বা ক্লাউড থেকে নির্বাচন করুন

URL পেস্ট করুন নমুনা ব্যবহার করুন
Google Drive Dropbox OneDrive
১০০% ফ্রি ইনস্টল করার প্রয়োজন নেই নিরাপদ ও ব্যক্তিগত
বিজ্ঞাপন
বিশ্বস্ত
eBay Booking.com University of Michigan Cornell University Columbia University
এই টুলটিকে রেট করুন
0/5 · 0 ভোট

OCR সহ বা ছাড়া PDF থেকে টেক্সটে রূপান্তর

একটি PDF কে টেক্সটে রূপান্তর করা আসলে দুই ধরনের কাজ হতে পারে, আর এই কনভার্টার আপনাকে প্রয়োজনীয় কাজটি বেছে নিতে দেয়। বেশিরভাগ PDF ফাইলেই আগে থেকেই আসল অক্ষর থাকে, তাই শুধু সেই লেখা পড়তে হয়। স্ক্যান করা PDF-এ পাতার ছবি থাকে, আর সেখানকার অক্ষরগুলো বের করার আগে সেগুলো চিনে নিতে হয়।

টেক্সট শনাক্তকরণ ডিফল্টভাবে বন্ধ থাকে, আর সেটি ইচ্ছাকৃত। যেসব PDF-এ আসল টেক্সট লেয়ার থাকে, সেগুলোতে শব্দগুলো ছবির থেকে বের করার বদলে কপি করলে কাজটি দ্রুত এবং বেশি নির্ভুল হয়। যে ফাইলে OCR দরকার নেই সেখানে এটি চালু করলে কেবল নির্ভুলতাই কমবে।

আপনার ফাইলটি কোন ধরনের তা এক সেকেন্ডেই বোঝা যায়। যেকোনো রিডারে PDF খুলে একটি লাইনের ওপর ড্র্যাগ করুন। যদি শব্দগুলো হাইলাইট হয়, তাহলে OCR টগল বন্ধ রাখুন। যদি কিছুই হাইলাইট না হয়, OCR চালু করুন এবং শনাক্তকরণে সমর্থিত 124টি সোর্স ভাষা থেকে আপনার ডকুমেন্টের ভাষা বেছে নিন।

একটি শব্দও না লিখে PDF থেকে টেক্সট বের করুন

PDF থেকে টেক্সট বের করলে শুধু দেখার মতো একটি পাতা ব্যবহারযোগ্য কথায় পরিণত হয়। কনভার্টার যা পায় সবকিছুই একটি প্লেইন টেক্সট ফাইলে লিখে, যাতে আপনি সহজে কোনো উদ্ধৃতি কপি করতে পারেন, একটি অনুচ্ছেদ ইমেলে পেস্ট করতে পারেন, বা যেকোনো এডিটরে ফাইন্ড কমান্ড দিয়ে পুরো ডকুমেন্টে খুঁজতে পারেন।

এতে সাধারণত যেসব কাজের জন্য মানুষ এটি ব্যবহার করে তা কভার হয়: একটি প্রবন্ধ থেকে রেফারেন্স বের করা, কোনো রিপোর্ট থেকে সংখ্যাগুলো নেয়া, বা দীর্ঘ ডকুমেন্টের মূল অংশ লেখা-সংক্রান্ত টুলে নিয়ে যাওয়া। কিছুই হাতে লিখে বা টাইপ করে নিতে হয় না।

একসাথে একাধিক PDF আপলোড করা যায়। প্রতিটি ফাইল আলাদাভাবে কনভার্ট হয় এবং নিজস্ব টেক্সট ফাইল হিসেবে ফিরে আসে, যেখানে সবার জন্য একই OCR সেটিং এবং একই ভাষা প্রযোজ্য হয়। কোনো অ্যাকাউন্ট লাগে না, আর কোনো ইমেইল ঠিকানাও চাওয়া হয় না।

TXT ফাইল কী?

.txt ফাইল এক্সটেনশনটি সাধারণ টেক্সট ফাইলের জন্য ব্যবহৃত হয়। এসব ফাইলে লাইনে লাইনে লেখা থাকে এবং বিভিন্ন প্ল্যাটফর্ম ও ডিভাইসে নানা টেক্সট এডিটরে খোলা যায়। এই টেক্সটে কোনো ফরম্যাটিং থাকে না।

PDF থেকে TXT-তে যাওয়ার মূল কারণও এটি, ডকুমেন্ট ফরম্যাটে নয়। এই ফাইল যেকোনো কম্পিউটার ও যেকোনো ফোনে খোলে, পড়তে আলাদা লাইসেন্স লাগে না, আর যে প্রোগ্রাম দিয়ে আসল PDF বানানো হয়েছিল তা বদলে গেলেও এটি পড়া যায়।

ফাইল এক্সটেনশন: .txt, MIME টাইপ: text/plain

উইকিপিডিয়ায় TXT

PDF থেকে TXT: টেক্সট ফাইল কী রেখে দেয়

একটি প্লেইন টেক্সট ফাইল পাতার বদলে শব্দ ধরে রাখে। কনভার্সনের পর কী থাকে আর কী থাকে না, তা নিচে দেয়া হল।

PDF থেকে TXT ফাইলে
শব্দ এবং লাইন ব্রেক থেকে যায়
পড়ার ক্রম থাকে, উপরে থেকে নিচে
বোল্ড, ইটালিক এবং ফন্ট বাদ পড়ে
ছবি, লোগো এবং চার্ট বাদ পড়ে
টেবিল গ্রিড ছাড়া টেক্সট হিসেবে থাকে
মাল্টি-কলাম পেজ এক কলামে গুছিয়ে দেওয়া হয়
হেডার, ফুটার এবং পেজ নম্বর মূল টেক্সটের সঙ্গেই লেখা হয়

একটি প্লেইন টেক্সট ফাইল লে-আউট নয়, শুধু শব্দ বহন করে। যখন ফরম্যাটিং শব্দের মতোই গুরুত্বপূর্ণ, তখন PDF to Word অ্যাপটি বেশি উপযোগী।

কখন PDF থেকে টেক্সটে রূপান্তর করা ঠিক সিদ্ধান্ত

PDF-এর ভেতরের শব্দগুলো একটি নির্দিষ্ট পেজ লে-আউটে আবদ্ধ থাকে। যেসব ক্ষেত্রে এগুলোকে সরলভাবে আলাদা করা যায়, সেগুলোতেই সবচেয়ে বেশি সময় ও শ্রম বাঁচে।

উদ্ধৃতি আর গবেষণা

প্রবন্ধ, রিপোর্ট আর বই সাধারণত PDF হিসেবে ভাগ করা হয়। একবার টেক্সট বের করে নিলেই বারবার টাইপ করার বদলে আপনার নোটে সরাসরি প্রয়োজনীয় অংশগুলো পেস্ট করতে পারেন।

দীর্ঘ ডকুমেন্টে খোঁজাখুঁজি

একটি টেক্সট ফাইল যেকোনো এডিটরে খোলে, তাই আপনি পৃষ্ঠা ধরে ধরে না পড়ে সরাসরি কোনো নাম, তারিখ বা অঙ্কে চলে যেতে পারেন।

অন্য টুলে টেক্সট পাঠানো

ট্রান্সলেশন টুল, রাইটিং টুল, স্ক্রিন রিডার আর স্প্রেডশিট সবই প্লেইন টেক্সট নেয়। প্রায় সব টুলই কোনো কনভার্টার ছাড়াই TXT ফরম্যাট গ্রহণ করে।

আপনার ডেটা, সুরক্ষিত

যে PDF গুলো ব্যবহারকারীরা কনভার্ট করেন, সেগুলো প্রায়ই চুক্তি, ইনভয়েস বা ব্যক্তিগত যোগাযোগ হয়ে থাকে। আপনার ফাইলগুলো ঠিক কীভাবে সামলানো হয়, তা এখানে দেয়া হলো।

TLS এনক্রিপশন

প্রতিটি আপলোড এবং ডাউনলোড এনক্রিপ্টেড কানেকশনের মাধ্যমে চলে, তাই ট্রান্সফারের সময় আপনার ফাইল পড়া যায় না।

ISO 27001 ডেটা সেন্টার

প্রসেসিং ইউরোপীয় ইউনিয়নের ভেতরে অবস্থিত সার্টিফায়েড ডেটা সেন্টারে হয়।

মানুষের কোনো অ্যাক্সেস নেই

টেক্সট রিকগনিশন পুরোপুরি স্বয়ংক্রিয়। কেউ আপনার স্ক্যান বা ডকুমেন্ট পড়ে না, এবং কিছুই তৃতীয় পক্ষের সঙ্গে শেয়ার করা হয় না।

PDF থেকে টেক্সটে কীভাবে রূপান্তর করবেন?

1

আপলোড

আপনার PDF আপলোড করুন।

2

নির্বাচন করুন

PDF যদি স্ক্যান করা হয় OCR অন করুন। ফাইলে টেক্সট আগে থেকেই সিলেক্ট করা যায় এমন হলে OCR অফ রাখুন।

3

সমন্বয় করুন

মেনু থেকে আপনার ডকুমেন্টের ভাষা নির্বাচন করুন (ঐচ্ছিক)।

4

রূপান্তর করুন

"Start" এ ক্লিক করে রূপান্তর শেষ হওয়া পর্যন্ত অপেক্ষা করুন।

PDF থেকে টেক্সট - সাধারণ প্রশ্ন

এই PDF থেকে টেক্সট কনভার্টার কি ফ্রি?

হ্যাঁ। PDF থেকে টেক্সটে রূপান্তর ফ্রি, কোনো অ্যাকাউন্ট লাগে না, আর কোনো ইমেইল ঠিকানাও চাওয়া হয় না। শুধু ফাইল আপলোড করুন, কনভার্সন শুরু করুন এবং টেক্সট ডাউনলোড করুন। খুব বড় ফাইল বা অনেকগুলো ফাইল একসাথে কনভার্ট করতে হলে প্ল্যান কাজে আসে।

PDF কে কীভাবে টেক্সটে রূপান্তর করবেন?

উপরের জায়গায় PDF আপলোড করুন, ফাইলে থাকা টেক্সট যদি আগে থেকেই সিলেক্ট করা যায় তাহলে OCR টগল অফ রাখুন, তারপর কনভার্সন শুরু করুন। ফলাফল হবে একটি প্লেইন টেক্সট ফাইল যা আপনি ডাউনলোড করে যেকোনো এডিটরে খুলতে পারবেন। কিছুই ইনস্টল করতে হবে না।

PDF থেকে কীভাবে টেক্সট কপি করব?

শব্দগুলোর ওপর ড্র্যাগ করলে যদি সেগুলো হাইলাইট হয়, তাহলে সরাসরি আপনার PDF রিডার থেকেই কপি করতে পারবেন। যদি না হয়, তাহলে পেজটি ছবি, আর সেখান থেকে কিছু সিলেক্ট করা যাবে না। PDF থেকে টেক্সটে রূপান্তর করলে এই সমস্যা থাকে না, কারণ আউটপুট একটি টেক্সট ফাইল, যেখান থেকে আপনি অবাধে কপি করতে পারবেন।

আমি কি PDF থেকে TXT-তেও কনভার্ট করতে পারি?

এই কনভার্টার ঠিক সেটাই লিখে দেয়। TXT হলো প্লেইন টেক্সট ফরম্যাট, তাই আপনি যে ফাইল ডাউনলোড করবেন তার এক্সটেনশন হবে .txt এবং মিডিয়া টাইপ text/plain। এটি Notepad, TextEdit, যেকোনো কোড এডিটর এবং যেকোনো ফোনে অতিরিক্ত সফটওয়্যার ছাড়াই খোলে।

ডিফল্টভাবে OCR বন্ধ কেন থাকে?

কারণ বেশিরভাগ PDF-এরই এর দরকার হয় না। যেসব PDF-এ আসল টেক্সট লেয়ার থাকে, সেগুলোতে ছবির থেকে লেখার অক্ষর চিনে বের করার বদলে সরাসরি কপি করলে দ্রুত ও বেশি নির্ভুলভাবে কনভার্ট হয়। শুধু যখন পেজগুলো স্ক্যান বা ফটোগ্রাফ হয় তখনই OCR অন করুন; এর সঙ্গে ভাষা বাছাই করার অপশনও চলে আসে।

এই PDF থেকে টেক্সট কনভার্টার কি স্ক্যান করা PDF-এ কাজ করে?

হ্যাঁ, OCR অন থাকলে। শনাক্তকরণ পাতার ছবিগুলো থেকে অক্ষর পড়ে সেগুলো টেক্সট ফাইলে লিখে দেয়। আপনি যদি মূলত স্ক্যান করা ফাইলই কনভার্ট করেন, তাহলে scanned PDF to text app একই ফলাফলে যাওয়ার আরও সরাসরি পথ।

টেক্সট রিকগনিশন কোন কোন ভাষা পড়তে পারে?

এটি 124টি সোর্স ভাষা শনাক্ত করতে পারে। ইউরোপীয় ভাষার পাশাপাশি তালিকায় আছে হিন্দি, বাংলা, তামিল, উর্দু, আরবি, থাই, জাপানি, কোরিয়ান এবং চীনা (সরলীকৃত ও প্রথাগত উভয় রূপ)। সেরা ফলাফলের জন্য আপনার ডকুমেন্ট যেই ভাষায় লেখা সেই ভাষাই বেছে নিন।

আমি কি একসাথে একাধিক PDF থেকে টেক্সটে রূপান্তর করতে পারি?

হ্যাঁ। আপনার যত প্রয়োজন তত PDF যোগ করুন, এবং সেগুলো একবারে কনভার্ট হবে। প্রতিটি ফাইল আলাদা টেক্সট ফাইল হিসেবে ফেরত দেওয়া হবে, একই OCR সেটিং ও একই ভাষা প্রযোজ্য থাকবে।

টেক্সট রিকগনিশন সম্পর্কে আরও জানুন

হলুদ ডেস্কের ওপর খোলা বই, স্ক্যানার ব্র্যাকেটের ফ্রেমের ভেতরে, আর পৃষ্ঠায় বড় করে মুদ্রিত আছে শিরোনাম: Save Valuable Text With OCR
কীভাবে

OCR দিয়ে মূল্যবান লেখা সংরক্ষণ করুন

স্ক্যান করা ডকুমেন্ট ও ছবি থেকে OCR (Optical Character Recognition) ব্যবহার করে মূল্যবান লেখা ডিজিটাইজ করুন। অনলাইনে সহজেই ছবির থেকে লেখা বের করুন।

প্রবন্ধটি পড়ুন