Kinokonvert ng tool na ito ang mga na-scan na PDF sa nai-e-edit na text para madali kang makakopya, makapag-edit, at makapagdagdag ng content.
o ihulog, i-paste, o pumili mula sa cloud
Ang pag-convert ng na-scan na PDF sa text ay talagang dalawang magkaibang gawain, at hinahayaan ka ng converter na pumili kung alin ang tatakbo. Ang PDF na mayroon nang totoong mga character ay kailangang basahin lang. Ang PDF na naglalaman ng mga larawan ng mga pahina ay kailangang i-recognize muna, dahil wala pang text sa loob nito.
Mabilis mo silang makikilala. Buksan ang file sa kahit anong reader at subukang pumili ng isang linya. Kung naha-highlight ang mga salita, may text layer ang PDF, kaya piliin ang Convert at lalabas ang text eksakto kung paano ito naisulat. Kung walang naha-highlight, o buong pahina ang naha-highlight bilang isang bloke, iyon ay scan at kailangan nito ng optical character recognition.
Ang nag-iisang pagpiling iyon ang nagpapaliwanag sa karamihan ng hindi magandang resulta na nakukuha ng mga tao sa ibang lugar. Ang converter na iisang proseso lang ang pinapatakbo sa bawat upload ay magbabalik ng malinis na text para sa ilang file at blangkong pahina para sa iba, nang walang paliwanag. Ang pagpili mismo ng engine ang nag-aalis ng hula-hula.
Hindi ka papayagan ng scan na i-drag ang cursor mo sa isang pangungusap, dahil wala talagang puwedeng piliin. Nilulutas iyon ng pag-extract ng text mula sa na-scan na PDF: i-upload ang file, patakbuhin ang conversion, at makakakuha ka ng plain text file na maaari mong kopyahin, i-paste sa email, o hanapin gamit ang find command sa kahit anong editor.
Ang output ay isang .txt file, kaya nabubuksan ito sa kahit anong computer at kahit anong phone nang walang espesyal na software. Dala nito ang mga salita at line break at iniiwan ang layout, na siyang tamang palit kung ang mahalaga sa iyo ay ang nilalaman at hindi ang eksaktong kopya ng pahina.
Maraming scan ang puwedeng isabay. Bawat PDF ay kino-convert nang hiwalay at babalik bilang sarili nitong text file, na may parehong engine at parehong piniling language na naka-apply sa lahat.
Ang .txt file extension ay ginagamit para sa mga plain text file. Naglalaman ang mga ito ng mga linya ng text at maaaring buksan sa maraming text editor sa iba't ibang platform at device. Ang text ay walang anumang formatting.
Iyan ang dahilan kung bakit ito ang pinakaligtas na lagyan ng text na na-recover mula sa scan. Walang bahagi ng file ang napapanis, walang kailangang lisensya para mabuksan, at nananatiling mababasa ang mga salita kahit matagal nang napalitan ang program na lumikha sa orihinal.
File extension: .txt, MIME type: text/plain
TXT sa WikipediaMay 5 paraan para basahin ang na-scan na PDF dito, at hinahayaan ka ng settings panel na lumipat sa pagitan ng mga ito. Piliin ang tumutugma sa file na nasa harap mo.
| OCR engine | Piliin ito kapag |
|---|---|
| I-convert | May selectable na text na ang PDF. Walang recognition na tatakbo, kaya lalabas ang mga salita eksakto kung paano sila naisulat. |
| Standard OCR | Malinis, diretso at matalas ang scan. Ito ang pinakamabilis na ruta mula sa na-scan na PDF papuntang text. |
| Advanced AI-OCR | Maputla, mababa ang resolution o bahagyang tabingi ang scan, at may mga character na hindi nakukuha ng standard engine. |
| Advanced AI-OCR+ | May mga anino, hindi pantay na ilaw o nakakurba ang gulugod ng pahina, na karaniwan kapag litrato ng libro ang kinuha. |
| Photo OCR | Ang text ay na-photograph at hindi na-scan, halimbawa isang karatula, label o screen. |
Kinakilala ng converter ang 124 source languages, kasama ang simplified at traditional Chinese na may vertical layouts at ang Cyrillic na anyo ng Azerbaijani, Serbian at Uzbek. Piliin ang bawat language na lumalabas sa file mo.
Naka-lock sa loob ng image ang mga salita sa scan. Ito ang mga sitwasyon kung saan ang pagkuha sa mga ito ang pinakamalaking tipid sa trabaho.
Karaniwang dumarating bilang scan ang invoices, contracts, resibo at sulat. Kapag na-extract na ang text, puwede ka nang maghanap ng halaga, petsa o pangalan sa halip na basahin ang bawat pahina.
Nagiging quotable ang library scans, journal articles at mga pahina ng libro. I-extract ang text nang isang beses at i-paste na lang ang mga talatang kailangan mo sa notes mo sa halip na mag-type muli.
Madalas nakaimbak bilang mahahabang multi-page scan ang mga lumang file. I-upload nang sabay ang ilan sa mga ito at tatapusin ng converter ang buong batch sa isang takbo.
Maaaring personal ang mga papel na sini-scan mo at mga dokumentong kino-convert mo. Narito kung paano eksaktong hinahandle ang mga iyo.
Bawat upload at download ay dumaraan sa encrypted na koneksyon, kaya hindi mababasa ang mga file mo habang ipinapadala.
Ganap na awtomatiko ang text recognition. Walang bumabasa sa mga scan o dokumento mo, at walang ibinabahagi sa third parties.
Nangyayari ang pagproseso sa mga certified data centre sa loob ng European Union.
I-upload ang na-scan mong PDF.
Piliin ang OCR engine na akma sa file mo. Gamitin ang Convert kung selectable na ang text sa PDF.
Piliin ang wika ng iyong PDF para sa mas magagandang resulta (opsyonal).
Simulan ang conversion at hintaying maging handa ang iyong download.
Oo. Libre ang pag-convert ng na-scan na PDF sa text at hindi kailangan ng account. I-upload ang file, pumili ng engine at i-download ang resulta. Nasasaklaw ng libreng limit ang mga file hanggang 100 MB, at kailangan lang ng plan para sa mas malalaking file at mas mahahabang batch.
Oo. Standard OCR ang libreng engine at kaya nito ang karaniwang scans nang walang sign-up. Ang 3 advanced AI engine ang upgrade para sa mga pahinang hindi mabasa ng standard engine, tulad ng maputlang kopya o mga larawang kinunan sa mahinang ilaw.
Dahil mga larawan ng mga pahina at hindi mga character ang nasa file. Kino-kuhanan ng litrato ng scanner ang papel, kaya pattern ng pixels ang bawat salita. Binabasa ng optical character recognition ang mga pixel at isinusulat ang totoong mga character, na siyang dahilan kung bakit nagiging selectable, searchable at editable ang text.
I-upload ang PDF sa itaas, pumili ng OCR engine at simulan ang conversion. Ang resulta ay plain text file na mabubuksan mo sa kahit anong editor at mapagkukuhanan mo ng kopya. Gagana lang ang direktang pagkopya mula sa PDF reader kapag may text layer na ang file.
Kinakilala nito ang 124 source languages, kasama ang Chinese sa parehong simplified at traditional na anyo na may vertical layouts, at ang Cyrillic na variants ng Azerbaijani, Serbian at Uzbek. Piliin ang bawat language na lumalabas sa file, dahil pinakamagandang nababasa ang halo-halong pahina kapag lahat sila ay nakalista.
Hindi mula sa page na ito, na nagsusulat ng plain text file. Tinatago nito ang mga salita at inaalis ang layout. Para sa DOC o DOCX na may formatting, gamitin ang Convert to Word app, na nagpapatakbo ng parehong text recognition at nagsusulat ng Word document.
Sumusunod ang kalidad ng recognition sa kalidad ng scan. Ang tabing pahina, mababang resolution, anino sa papel o larawan na kuha sa kamay ay lahat nakakasira ng accuracy. Subukan ang Advanced AI-OCR para sa hindi perpektong scans at Advanced AI-OCR+ para sa mahinang ilaw, at mag-rescan sa 300 dpi kung maaari. Ang password-protected o sira na source file ay hindi mako-convert.
Oo. Dumadaan ang uploads at downloads sa encrypted na koneksyon, nagaganap ang pagproseso sa certified data centres sa loob ng European Union, at awtomatiko ang buong pipeline, kaya walang sinumang nakakabasa ng scans mo. Hindi kailanman ginagamit ang mga file mo para mag-train ng AI models at nananatili sa iyo ang mga karapatan sa mga ito.
I-digitize ang mahahalagang teksto mula sa na-scan na mga dokumento at larawan gamit ang OCR (Optical Character Recognition). Madaling mag-extract ng teksto mula sa mga larawan, online.
Basahin ang artikuloLahat ng ito ay tumatakbo sa browser. Walang install, walang account, at iisang text recognition ang nasa likod nito.