Bakit mag-convert mula PDF papuntang Microsoft Word? Ginagawa nitong editable ang iyong mga PDF file. Kopyahin ang text, i-edit ang mga PDF, at marami pa.
o ihulog, i-paste, o pumili mula sa cloud
Iconvert ang mga PDF page sa mai-e-edit na Word file.
Inaayos ng PDF ang bawat linya sa pahina. Kapag kinonvert mo ang PDF sa Word, magkakaroon ka ng dokumentong maaari mong i-type muli, ayusin ang pagkakabuo, at muling gamitin sa Microsoft Word, Google Docs, o LibreOffice.
Kapag inilipat sa OCR ang conversion method, binabasa ng converter ang mga letra sa bawat na-scan na pahina. Ang lalabas sa Word ay tekstong maaari mong hanapin at itama, hindi larawang pahina.
Ang mga heading, talata, listahan, talahanayan, at larawan ay muling binubuo sa Word file. Pinapanatili ng layout mode ang ayos ng pahina sa halip na ibuhos ang lahat sa iisang kolum.
Ang mga na-scan na pahina ay mga larawan, kaya kung plain conversion lang, ilalagay lang ang mga larawang iyon sa Word file mo. Itakda ang Conversion Method sa Convert with OCR at babasahin muna ng text recognition ang mga karakter sa bawat pahina, saka isusulat ang mga ito sa Word document bilang tekstong maaari mong i-edit.
May mabilis na paraan para malaman kung anong uri ng PDF ang mayroon ka. Buksan ito at subukang piliin ang isang linya ng teksto. Kung naha-highlight ang linya, dala na ng file ang teksto at hindi na kailangan ng OCR. Kung walang naha-highlight, larawan ang pahina at OCR ang setting na kailangan mo.
Naka-off ang OCR bilang default, at sinadya iyon. Ang PDF na in-export mula sa Word, LaTeX, o isang publishing tool ay mayroon nang eksaktong teksto, at ang pag-convert nito nang walang OCR ay pinapanatili ang bawat karakter tulad ng pagkakasulat. Mas mabagal ang pagtakbo ng OCR at maaari lang nitong tantiyahin ang tekstong mayroon na sa file.
PDF files ang mga input. Magdagdag ng ilan nang sabay-sabay at babalik ang bawat isa bilang sarili nitong Word document.
May dalawang setting ang OCR Method at magkaiba ang inuuna ng mga ito. Pinapanatili ng Layout ang ayos ng pahina, na bagay sa mga form, talahanayan, at anumang naka-kolum. Inuuna naman ng Text recognition ang katumpakan ng karakter at mas mainam para sa makakapal, maputla, o hindi maayos na scan.
Mas binabago ng OCR Language ang resulta kaysa anumang ibang setting. Piliin sa listahan ng 124 na wika ang mga wikang ginamit sa dokumento mo, at gagamitin ng recognition ang mga ito para pagdesisyunan ang mga karakter na magkamukha. Pumili ng ilan kapag halo-halo ang wika sa dokumento.
Ginagawang monochrome ng Improve OCR ang pahina bago ang recognition, na nagpapalinaw sa mahina o hindi pantay ang ilaw na scan. Inaalis nito ang kulay sa resulta, kaya mas bagay ito sa mga plain na dokumento at hindi sa mga pahinang mahalaga ang kulay.
Ang DOC ay ang document file format na ipinakilala ng Microsoft Word at gumagamit ng .DOC file extension. Bukod sa teksto, maaaring maglaman din ang mga file na ito ng mga hyperlink, larawan, grapiko, talahanayan, advanced na pag-format, at iba pang elemento.
Noong Microsoft Office 2007, ipinakilala ang .DOCX file extension. Ginagamit nito ang Microsoft Office Open XML international standard, na ginagawang mas madaling i-access at gamitin ang format.
Bagama't kayang buksan ng mas bagong mga bersyon ng Microsoft Word ang mas lumang DOC format, hindi mabubuksan ang mga DOCX file sa mas lumang mga bersyon. Kung mabuksan man, maaaring mali ang pag-format o may mga nawawalang bahagi ng dokumento.
Piliin ang DOCX maliban na lang kung kailangang magbukas ang Word file sa Word 2003 o mas luma.
Ang conversion method ang nag-iisang pagpipiliang talagang nagpapabago sa resulta. Ito ang kailangan ng bawat uri ng PDF.
| PDF mo | Conversion method | Ano ang makukuha mo |
|---|---|---|
| Text-based na PDF | I-convert | Ang orihinal na teksto, hindi binago |
| Na-scan na mga pahina | I-convert gamit ang OCR | Tekstong maaari mong i-edit sa Word |
| Mga kolum, talahanayan, o form | OCR, Layout method | Napananatili ang ayos ng pahina |
| Maputla o tabingi ang scan | OCR, Text recognition method | Pinakatumpak na mga karakter |
| May password na proteksyon | Hindi sinusuportahan | Hindi ma-convert ang protektadong PDF |
Hiwalay na pagpipilian ang DOCX o DOC at naa-apply sa bawat isa sa mga ito.
Alamin kung paano i-convert ang PDF sa Word
I-upload ang iyong PDF document sa itaas.
Piliin ang bersyon ng Microsoft Word na kailangan mo.
Opsyonal: Pagandahin ang resulta sa pamamagitan ng pagpili ng OCR method, pagtukoy sa wika ng source text, at iba pa.
I-click ang "Start".
Oo. Libre ang PDF to Word converter at hindi kailangan ng account. I-upload ang PDF, piliin ang DOCX o DOC, itakda ang conversion method sa Convert with OCR, at i-download ang Word file. Nagdadagdag lang ang subscription ng mas malalaking upload, mas mahahabang batch, at priority processing.
I-upload ang na-scan na PDF, itakda ang Conversion Method sa Convert with OCR, at piliin ang wikang ginamit sa dokumento. Babasahin ng text recognition ang mga karakter sa bawat pahina at isusulat ang mga ito sa Word file bilang tekstong maaaring i-edit.
Ano ang OCR? Ang optical character recognition ay ginagamit para kilalanin ang mga letra, numero, o espesyal na karakter sa na-scan na dokumento o larawan. Gamit ang OCR converter, maaari mong kunin ang teksto mula sa mga file na ito para mabago, ma-edit, ma-print, o mai-save ito.
Maaaring basahin ng chat assistant ang isang PDF at ulitin ang teksto sa chat window. Nakakatulong iyon kung may tanong ka tungkol sa dokumento at hindi gaanong kung kailangan mo ang buong file: ang mahahabang dokumento ay maa-summary sa halip na ma-transcribe, at ang mga heading, talahanayan, at larawan ay hindi muling binubuo. Pinapatakbo ng converter na ito ang recognition sa bawat pahina at ibinabalik ang Word file na maaari mong buksan at i-edit.
Ang mga heading, talata, listahan, talahanayan, at larawan ay muling binubuo sa Word file. Mas mahirap ilipat ang mabibigat na page design: ang mga multi-column na pahina, kakaibang font, at page furniture gaya ng headers at footers ay maaaring mapunta sa ibang lugar. Pinananatiling pinakamalapit sa orihinal ng layout mode ang resulta.
Piliin ang DOCX. Ito ang format na ginagamit ng Microsoft Word mula 2007, at nabubuksan din ito ng Google Docs, LibreOffice, at Pages. Pumili lang ng DOC kung kailangan talagang mabuksan ang file sa Word 2003 o mas luma.
124 na source language ang nasa listahan, mula Arabic, Chinese, at Hindi hanggang Polish, Turkish, at Vietnamese. Piliin lahat ng wika na nasa dokumento mo bago ka magsimula, dahil ginagamit ng recognition ang impormasyong ito para magkaiba ang magkahawig na mga character.
Oo. Magdagdag ng kahit ilang PDF na kailangan mo at iko-convert ang mga ito nang sabay, bawat isa ay ibabalik bilang sarili nitong Word document na may parehong settings na naka-apply.
Dalawang bagay ang karaniwang sanhi ng failure. Ang PDF na may password o may ibang restriction ay hindi pwedeng i-convert, at ang sira o corrupted na file ay hindi mababasa. Suriin kung normal na nabubuksan ang PDF sa sarili mong computer, at siguraduhing pasok ito sa 100 MB na free upload limit.
Lahat ng upload at download ay dumadaan sa encrypted na koneksyon, at ang processing ay nangyayari sa mga ISO 27001 certified na data centre sa loob ng European Union. Fully automated ang conversion, kaya walang bumabasa ng dokumento mo, walang ibinabahagi sa third parties, at hindi ginagamit ang mga file mo para mag-train ng AI models. Ikaw ang may hawak ng copyright at pagmamay-ari ng parehong PDF at Word file.
I-digitize ang mahahalagang teksto mula sa na-scan na mga dokumento at larawan gamit ang OCR (Optical Character Recognition). Madaling mag-extract ng teksto mula sa mga larawan, online.
Basahin ang artikuloGamitin ang advanced na text recognition para sa iyong mga file online. Pumili ng isa sa mga OCR tool sa ibaba: