কেন PDF থেকে Microsoft Word এ কনভার্ট করবেন? এতে আপনার PDF ফাইলগুলো এডিটযোগ্য হয়। টেক্সট কপি করুন, PDF এডিট করুন, আরও অনেক কিছু।
অথবা ড্র্যাগ ও ড্রপ করুন, পেস্ট করুন, বা ক্লাউড থেকে নির্বাচন করুন
PDF পৃষ্ঠাগুলোকে সম্পাদনাযোগ্য Word ফাইলে রূপান্তর করুন।
একটি PDF প্রতিটি লাইনে পেজে স্থির করে দেয়। PDF-কে Word-এ রূপান্তর করলে আপনি এমন একটি ডকুমেন্ট পান, যা Microsoft Word, Google Docs বা LibreOffice-এ আবার লিখতে, পুনর্গঠন করতে এবং পুনঃব্যবহার করতে পারেন।
কনভার্সন মেথড-এ OCR বেছে নিন, আর কনভার্টার প্রতিটি স্ক্যান করা পেজ থেকে অক্ষরগুলো পড়ে নেয়। Word ফাইলে যা আসে, তা এমন টেক্সট যা আপনি খুঁজে পেতে ও ঠিক করতে পারেন, কোনো পেজের ছবি নয়।
হেডিং, প্যারাগ্রাফ, লিস্ট, টেবিল এবং ছবি Word ফাইলে আবার তৈরি হয়। লেআউট মোড সব কিছু এক কলামে ঢেলে না দিয়ে পেজের বিন্যাস ধরে রাখে।
স্ক্যান করা পেজ হলো ছবি, তাই সাধারণ কনভার্সনে সেই ছবিগুলোই Word ফাইলে চলে যাবে। Conversion Method-এ Convert with OCR বেছে নিন, আর টেক্সট রিকগনিশন আগে প্রতিটি পেজ থেকে অক্ষরগুলো পড়ে নিয়ে পরে সেগুলো Word ডকুমেন্টে সম্পাদনাযোগ্য টেক্সট হিসেবে লিখে দেয়।
আপনার কাছে কোন ধরনের PDF আছে, তা দ্রুত বোঝার একটি উপায় আছে। ফাইলটি খুলে একটি লাইনের টেক্সট সিলেক্ট করার চেষ্টা করুন। লাইনটি হাইলাইট হলে ফাইলটিতে টেক্সট আগে থেকেই আছে এবং OCR-এর দরকার নেই। কিছুই হাইলাইট না হলে পেজটি ছবি এবং সেক্ষেত্রে OCR-ই সঠিক সেটিং।
OCR ডিফল্টভাবে বন্ধ থাকে, এবং সেটি ইচ্ছাকৃতভাবেই। Word, LaTeX বা কোনো পাবলিশিং টুল থেকে এক্সপোর্ট করা PDF-এ টেক্সট আগেই নির্ভুলভাবে থাকে, আর OCR ছাড়া কনভার্ট করলে প্রতিটি অক্ষর যেমন লেখা হয়েছিল তেমনই থাকে। এর ওপর আবার OCR চালানো বেশি সময় নেয় এবং ফাইলের ভেতরের টেক্সট শুধু আন্দাজ করেই বের করতে পারে।
ইনপুট হিসেবে PDF ফাইল নেয়া হয়। একসাথে কয়েকটি যোগ করলে প্রতিটি আলাদা Word ডকুমেন্ট হিসেবে ফিরে আসে।
OCR Method-এ দুটি সেটিং আছে, আর তারা ভিন্ন দিকে অগ্রাধিকার দেয়। Layout পেজের বিন্যাস ধরে রাখে, যা ফর্ম, টেবিল এবং কলামে সাজানো কিছুতে ভালো কাজ করে। Text recognition অক্ষরের নির্ভুলতাকে আগে রাখে এবং ঘন, ফিকে বা অস্বস্তিকর স্ক্যানের জন্য এটি ভালো পছন্দ।
OCR Language অন্য যেকোনো সেটিংয়ের চেয়ে ফলাফল বেশি বদলে দেয়। ১২৪টি ভাষার তালিকা থেকে আপনার ডকুমেন্টে ব্যবহৃত ভাষা বেছে নিন, আর রিকগনিশন দেখতে-একরকম অক্ষরের মধ্যে সেগুলোর ওপর নির্ভর করে সিদ্ধান্ত নেয়। কোনো ডকুমেন্টে একাধিক ভাষা থাকলে কয়েকটি একসাথে সিলেক্ট করুন।
Improve OCR রিকগনিশনের আগে পেজকে সাদাকালো বানিয়ে নেয়, যা দুর্বল বা অসম আলোয় স্ক্যান করা পেজকে আরো স্পষ্ট করে। এতে ফলাফলের রঙ চলে যায়, তাই রঙে তথ্য বহন করে এমন পেজের বদলে সাধারণ ডকুমেন্টের জন্য এটি ব্যবহার করা ভালো।
DOC হলো Microsoft Word দ্বারা চালু করা ডকুমেন্ট ফাইল ফরম্যাট, যেখানে .DOC ফাইল এক্সটেনশন ব্যবহার করা হয়। টেক্সটের পাশাপাশি, এই ফাইলগুলোতে হাইপারলিংক, ছবি, গ্রাফিক্স, টেবিল, উন্নত ফরম্যাটিং এবং অন্যান্য উপাদান থাকতে পারে।
Microsoft Office 2007 এর সাথে .DOCX ফাইল এক্সটেনশন চালু হয়। এটি Microsoft Office Open XML আন্তর্জাতিক মান ব্যবহার করে, যা ফরম্যাটটিকে আরও সহজে অ্যাক্সেসযোগ্য এবং ব্যবহারযোগ্য করে।
Microsoft Word এর নতুন সংস্করণগুলো পুরোনো DOC ফরম্যাট খুলতে পারে, কিন্তু DOCX ফাইল পুরোনো সংস্করণে খোলা যায় না। খোলা গেলেও ফরম্যাটিং ভুল হতে পারে বা ডকুমেন্টের কিছু অংশ অনুপস্থিত থাকতে পারে।
Word ফাইল Word 2003 বা তার আগের ভার্সনে খোলা না লাগলে DOCX-ই বেছে নিন।
কনভার্সন মেথডই একমাত্র পছন্দ, যা সত্যিই ফলাফল বদলে দেয়। প্রতিটি ধরনের PDF-এর জন্য যা দরকার তা এখানে।
| আপনার PDF | কনভার্সন মেথড | আপনি যা পাবেন |
|---|---|---|
| টেক্সট-ভিত্তিক PDF | রূপান্তর করুন | মূল টেক্সট, অপরিবর্তিত |
| স্ক্যান করা পেজ | OCR দিয়ে কনভার্ট করুন | Word-এ সম্পাদনাযোগ্য টেক্সট |
| কলাম, টেবিল বা ফর্ম | OCR, Layout মেথড | পেজের বিন্যাস অক্ষুণ্ণ |
| ফিকে বা হেলে থাকা স্ক্যান | OCR, Text recognition মেথড | সবচেয়ে নির্ভুল অক্ষর |
| পাসওয়ার্ড সুরক্ষিত | সাপোর্টেড নয় | সুরক্ষিত PDF কনভার্ট করা যায় না |
DOCX বা DOC আলাদা একটি পছন্দ এবং এগুলোর প্রতিটির ক্ষেত্রেই প্রযোজ্য।
PDF থেকে Word এ কনভার্ট করতে শিখুন
উপরে আপনার PDF ডকুমেন্ট আপলোড করুন।
আপনার প্রয়োজনীয় Microsoft Word সংস্করণটি নির্বাচন করুন।
ঐচ্ছিক: OCR পদ্ধতি নির্বাচন করে, সোর্স টেক্সটের ভাষা নির্দিষ্ট করে ইত্যাদির মাধ্যমে ফলাফল উন্নত করুন।
"Start" এ ক্লিক করুন.
হ্যাঁ। PDF থেকে Word কনভার্টার ফ্রি এবং কোনো অ্যাকাউন্ট প্রয়োজন নেই। PDF আপলোড করুন, DOCX বা DOC বেছে নিন, কনভার্সন মেথড-এ Convert with OCR সেট করুন এবং Word ফাইল ডাউনলোড করুন। সাবস্ক্রিপশন শুধু বড় সাইজের আপলোড, লম্বা ব্যাচ এবং অগ্রাধিকারপ্রাপ্ত প্রসেসিং যোগ করে।
স্ক্যান করা PDF আপলোড করুন, Conversion Method-এ Convert with OCR সেট করুন এবং ডকুমেন্ট যে ভাষায় লেখা সেই ভাষা বেছে নিন। টেক্সট রিকগনিশন প্রতিটি পেজ থেকে অক্ষর পড়ে নিয়ে সেগুলো Word ফাইলে সম্পাদনাযোগ্য টেক্সট হিসেবে লিখে দেয়।
OCR কী? Optical character recognition হলো এমন একটি প্রযুক্তি যা স্ক্যান করা ডকুমেন্ট বা ছবিতে থাকা অক্ষর, সংখ্যা বা বিশেষ চিহ্ন শনাক্ত করতে ব্যবহৃত হয়। একটি OCR কনভার্টার ব্যবহার করে আপনি এমন ফাইল থেকে লেখা বের করে তা পরিবর্তন, সম্পাদনা, প্রিন্ট বা সংরক্ষণ করতে পারেন.
একটি চ্যাট সহায়ক PDF পড়ে চ্যাট উইন্ডোতে আপনাকে টেক্সট আকারে ফিরিয়ে দিতে পারে। তা কোনো ডকুমেন্ট নিয়ে প্রশ্নের ক্ষেত্রে কাজে লাগে, কিন্তু পুরো ফাইলের দরকার হলে কম কার্যকর: বড় ডকুমেন্ট টান্সক্রাইব না হয়ে সংক্ষেপে তুলে ধরা হয়, আর হেডিং, টেবিল ও ছবি আবার বানানো হয় না। এই কনভার্টার প্রতিটি পেজে রিকগনিশন চালিয়ে এমন একটি Word ফাইল ফেরত দেয়, যা আপনি খুলে সম্পাদনা করতে পারবেন।
হেডিং, প্যারাগ্রাফ, লিস্ট, টেবিল এবং ছবি Word ফাইলে আবার তৈরি হয়। ভারী পেজ ডিজাইন তত ভালোভাবে আসে না: একাধিক কলাম, অস্বাভাবিক ফন্ট এবং হেডার ও ফুটার-এর মতো পেজ উপাদান অন্য জায়গায় চলে যেতে পারে। Layout মোড ফলাফলকে মূলের সবচেয়ে কাছাকাছি রাখে।
DOCX বেছে নিন। ২০০৭ সাল থেকে Microsoft Word এই ফরম্যাট ব্যবহার করছে, আর Google Docs, LibreOffice এবং Pages-ও এটি খুলতে পারে। কেবল তখনই DOC বেছে নিন যখন ফাইলটি Word 2003 বা তার আগের সংস্করণে খুলতে হবে।
মোট ১২৪টি উৎস ভাষা তালিকায় আছে, আরবি, চীনা, হিন্দি থেকে শুরু করে পোলিশ, তুর্কি এবং ভিয়েতনামিজ পর্যন্ত। শুরু করার আগে আপনার ডকুমেন্টে থাকা প্রতিটি ভাষা নির্বাচন করুন, কারণ স্বীকৃতি প্রক্রিয়ায় মিল চরিত্রগুলো আলাদা করতে এটি ব্যবহার করা হয়।
হ্যাঁ। যত PDF প্রয়োজন যোগ করুন, সবগুলো একবারেই রূপান্তরিত হবে, এবং প্রতিটি ফাইলের জন্য আলাদা Word ডকুমেন্ট ফেরত দেওয়া হবে, যেখানে একই সেটিং প্রয়োগ করা থাকে।
দুটি বিষয়েই বেশিরভাগ ব্যর্থতা ঘটে। পাসওয়ার্ড-সুরক্ষিত বা অন্যভাবে সীমাবদ্ধ PDF রূপান্তর করা যায় না, আর ক্ষতিগ্রস্ত ফাইল একদমই পড়া যায় না। দেখুন আপনার কম্পিউটারে PDF টি স্বাভাবিকভাবে খুলছে কি না, এবং এটি যেন ১০০ MB ফ্রি আপলোড সীমার মধ্যে থাকে।
প্রতিটি আপলোড ও ডাউনলোড এনক্রিপটেড সংযোগের মাধ্যমে হয় এবং সব প্রক্রিয়াকরণ ইউরোপীয় ইউনিয়নের ভেতরে ISO 27001 সার্টিফায়েড ডেটা সেন্টারে সম্পন্ন হয়। রূপান্তর সম্পূর্ণ স্বয়ংক্রিয়, তাই কেউ আপনার ডকুমেন্ট পড়ে না, তৃতীয় পক্ষের সাথে কিছুই শেয়ার করা হয় না, এবং আপনার ফাইলগুলো কখনোই AI মডেল প্রশিক্ষণের জন্য ব্যবহার করা হয় না। PDF এবং Word উভয় ফাইলের স্বত্ব ও মালিকানা আপনারই থাকে।
স্ক্যান করা ডকুমেন্ট ও ছবি থেকে OCR (Optical Character Recognition) ব্যবহার করে মূল্যবান লেখা ডিজিটাইজ করুন। অনলাইনে সহজেই ছবির থেকে লেখা বের করুন।
প্রবন্ধটি পড়ুনঅনলাইনে আপনার ফাইলের জন্য উন্নত টেক্সট শনাক্তকরণ ব্যবহার করুন। নিচের OCR টুলগুলোর একটি নির্বাচন করুন: