Scanned PDF to text

Kinokonvert ng tool na ito ang mga na-scan na PDF sa nai-e-edit na text para madali kang makakopya, makapag-edit, at makapagdagdag ng content.

I-upload ang iyong file

o ihulog, i-paste, o pumili mula sa cloud

I-paste ang URL Subukan ang sample
Google Drive Dropbox OneDrive
100% libre Walang kailangang i-install Ligtas at pribado
Advertisement
Pinagkakatiwalaan Ng
eBay Booking.com University of Michigan Cornell University Columbia University
I-rate ang tool na ito
0/5 · 0 boto

Kailan kailangan ng OCR ang isang na-scan na PDF, at kailan hindi

Ang pag-convert ng na-scan na PDF sa text ay talagang dalawang magkaibang gawain, at hinahayaan ka ng converter na pumili kung alin ang tatakbo. Ang PDF na mayroon nang totoong mga character ay kailangang basahin lang. Ang PDF na naglalaman ng mga larawan ng mga pahina ay kailangang i-recognize muna, dahil wala pang text sa loob nito.

Mabilis mo silang makikilala. Buksan ang file sa kahit anong reader at subukang pumili ng isang linya. Kung naha-highlight ang mga salita, may text layer ang PDF, kaya piliin ang Convert at lalabas ang text eksakto kung paano ito naisulat. Kung walang naha-highlight, o buong pahina ang naha-highlight bilang isang bloke, iyon ay scan at kailangan nito ng optical character recognition.

Ang nag-iisang pagpiling iyon ang nagpapaliwanag sa karamihan ng hindi magandang resulta na nakukuha ng mga tao sa ibang lugar. Ang converter na iisang proseso lang ang pinapatakbo sa bawat upload ay magbabalik ng malinis na text para sa ilang file at blangkong pahina para sa iba, nang walang paliwanag. Ang pagpili mismo ng engine ang nag-aalis ng hula-hula.

Paano kopyahin ang text mula sa mga na-scan na PDF

Hindi ka papayagan ng scan na i-drag ang cursor mo sa isang pangungusap, dahil wala talagang puwedeng piliin. Nilulutas iyon ng pag-extract ng text mula sa na-scan na PDF: i-upload ang file, patakbuhin ang conversion, at makakakuha ka ng plain text file na maaari mong kopyahin, i-paste sa email, o hanapin gamit ang find command sa kahit anong editor.

Ang output ay isang .txt file, kaya nabubuksan ito sa kahit anong computer at kahit anong phone nang walang espesyal na software. Dala nito ang mga salita at line break at iniiwan ang layout, na siyang tamang palit kung ang mahalaga sa iyo ay ang nilalaman at hindi ang eksaktong kopya ng pahina.

Maraming scan ang puwedeng isabay. Bawat PDF ay kino-convert nang hiwalay at babalik bilang sarili nitong text file, na may parehong engine at parehong piniling language na naka-apply sa lahat.

Ano ang TXT file?

Ang .txt file extension ay ginagamit para sa mga plain text file. Naglalaman ang mga ito ng mga linya ng text at maaaring buksan sa maraming text editor sa iba't ibang platform at device. Ang text ay walang anumang formatting.

Iyan ang dahilan kung bakit ito ang pinakaligtas na lagyan ng text na na-recover mula sa scan. Walang bahagi ng file ang napapanis, walang kailangang lisensya para mabuksan, at nananatiling mababasa ang mga salita kahit matagal nang napalitan ang program na lumikha sa orihinal.

File extension: .txt, MIME type: text/plain

TXT sa Wikipedia

Aling OCR engine ang pipiliin

May 5 paraan para basahin ang na-scan na PDF dito, at hinahayaan ka ng settings panel na lumipat sa pagitan ng mga ito. Piliin ang tumutugma sa file na nasa harap mo.

OCR engine Piliin ito kapag
I-convert May selectable na text na ang PDF. Walang recognition na tatakbo, kaya lalabas ang mga salita eksakto kung paano sila naisulat.
Standard OCR Malinis, diretso at matalas ang scan. Ito ang pinakamabilis na ruta mula sa na-scan na PDF papuntang text.
Advanced AI-OCR Maputla, mababa ang resolution o bahagyang tabingi ang scan, at may mga character na hindi nakukuha ng standard engine.
Advanced AI-OCR+ May mga anino, hindi pantay na ilaw o nakakurba ang gulugod ng pahina, na karaniwan kapag litrato ng libro ang kinuha.
Photo OCR Ang text ay na-photograph at hindi na-scan, halimbawa isang karatula, label o screen.

Kinakilala ng converter ang 124 source languages, kasama ang simplified at traditional Chinese na may vertical layouts at ang Cyrillic na anyo ng Azerbaijani, Serbian at Uzbek. Piliin ang bawat language na lumalabas sa file mo.

Karaniwang dahilan para i-convert ang na-scan na PDF sa text

Naka-lock sa loob ng image ang mga salita sa scan. Ito ang mga sitwasyon kung saan ang pagkuha sa mga ito ang pinakamalaking tipid sa trabaho.

Mga papeles na kailangan mong hanapin

Karaniwang dumarating bilang scan ang invoices, contracts, resibo at sulat. Kapag na-extract na ang text, puwede ka nang maghanap ng halaga, petsa o pangalan sa halip na basahin ang bawat pahina.

Mga gamit sa pag-aaral at pananaliksik

Nagiging quotable ang library scans, journal articles at mga pahina ng libro. I-extract ang text nang isang beses at i-paste na lang ang mga talatang kailangan mo sa notes mo sa halip na mag-type muli.

Mga rekord at archive

Madalas nakaimbak bilang mahahabang multi-page scan ang mga lumang file. I-upload nang sabay ang ilan sa mga ito at tatapusin ng converter ang buong batch sa isang takbo.

Protektado ang data mo

Maaaring personal ang mga papel na sini-scan mo at mga dokumentong kino-convert mo. Narito kung paano eksaktong hinahandle ang mga iyo.

TLS encryption

Bawat upload at download ay dumaraan sa encrypted na koneksyon, kaya hindi mababasa ang mga file mo habang ipinapadala.

Walang human access

Ganap na awtomatiko ang text recognition. Walang bumabasa sa mga scan o dokumento mo, at walang ibinabahagi sa third parties.

ISO 27001 data centres

Nangyayari ang pagproseso sa mga certified data centre sa loob ng European Union.

Paano i-convert ang isang na-scan na PDF sa text

1

Mag-upload

I-upload ang na-scan mong PDF.

2

Pumili

Piliin ang OCR engine na akma sa file mo. Gamitin ang Convert kung selectable na ang text sa PDF.

3

Ayusin

Piliin ang wika ng iyong PDF para sa mas magagandang resulta (opsyonal).

4

I-convert

Simulan ang conversion at hintaying maging handa ang iyong download.

Scanned PDF to text FAQ

Libre ba ang scanned PDF to text converter na ito?

Oo. Libre ang pag-convert ng na-scan na PDF sa text at hindi kailangan ng account. I-upload ang file, pumili ng engine at i-download ang resulta. Nasasaklaw ng libreng limit ang mga file hanggang 100 MB, at kailangan lang ng plan para sa mas malalaking file at mas mahahabang batch.

Maaari ba akong mag-OCR ng PDF nang libre?

Oo. Standard OCR ang libreng engine at kaya nito ang karaniwang scans nang walang sign-up. Ang 3 advanced AI engine ang upgrade para sa mga pahinang hindi mabasa ng standard engine, tulad ng maputlang kopya o mga larawang kinunan sa mahinang ilaw.

Bakit kailangan ng OCR ng scanned PDF ko para ma-extract ang text?

Dahil mga larawan ng mga pahina at hindi mga character ang nasa file. Kino-kuhanan ng litrato ng scanner ang papel, kaya pattern ng pixels ang bawat salita. Binabasa ng optical character recognition ang mga pixel at isinusulat ang totoong mga character, na siyang dahilan kung bakit nagiging selectable, searchable at editable ang text.

Paano ako makakakopya ng text mula sa na-scan na PDF?

I-upload ang PDF sa itaas, pumili ng OCR engine at simulan ang conversion. Ang resulta ay plain text file na mabubuksan mo sa kahit anong editor at mapagkukuhanan mo ng kopya. Gagana lang ang direktang pagkopya mula sa PDF reader kapag may text layer na ang file.

Aling mga wika ang kayang basahin ng text recognition?

Kinakilala nito ang 124 source languages, kasama ang Chinese sa parehong simplified at traditional na anyo na may vertical layouts, at ang Cyrillic na variants ng Azerbaijani, Serbian at Uzbek. Piliin ang bawat language na lumalabas sa file, dahil pinakamagandang nababasa ang halo-halong pahina kapag lahat sila ay nakalista.

Maaari ko bang i-convert ang na-scan na PDF sa Word?

Hindi mula sa page na ito, na nagsusulat ng plain text file. Tinatago nito ang mga salita at inaalis ang layout. Para sa DOC o DOCX na may formatting, gamitin ang Convert to Word app, na nagpapatakbo ng parehong text recognition at nagsusulat ng Word document.

Bakit mali ang lumabas na na-extract na text?

Sumusunod ang kalidad ng recognition sa kalidad ng scan. Ang tabing pahina, mababang resolution, anino sa papel o larawan na kuha sa kamay ay lahat nakakasira ng accuracy. Subukan ang Advanced AI-OCR para sa hindi perpektong scans at Advanced AI-OCR+ para sa mahinang ilaw, at mag-rescan sa 300 dpi kung maaari. Ang password-protected o sira na source file ay hindi mako-convert.

Pribado ba ang mga na-scan kong dokumento?

Oo. Dumadaan ang uploads at downloads sa encrypted na koneksyon, nagaganap ang pagproseso sa certified data centres sa loob ng European Union, at awtomatiko ang buong pipeline, kaya walang sinumang nakakabasa ng scans mo. Hindi kailanman ginagamit ang mga file mo para mag-train ng AI models at nananatili sa iyo ang mga karapatan sa mga ito.

Higit pa tungkol sa text recognition

Isang nakabukas na libro sa dilaw na desk, naka-frame ng scanner brackets, na may pamagat ng artikulong Save Valuable Text With OCR na naka-print sa pahina
Paano

I-save ang Mahahalagang Teksto gamit ang OCR

I-digitize ang mahahalagang teksto mula sa na-scan na mga dokumento at larawan gamit ang OCR (Optical Character Recognition). Madaling mag-extract ng teksto mula sa mga larawan, online.

Basahin ang artikulo