I-extract ang text mula sa mga scanned o kinuhanan ng litrato na dokumento.
o ihulog, i-paste, o pumili mula sa cloud
Ang na-scan na dokumento tungo sa text ay may isang layunin: makuha ang mga salita mula sa pahinang larawan lang. Nirerecord ng scanner o camera ng telepono ang papel bilang patag na imahe, kaya ang mga letra ay pixels, hindi characters. Wala sa file na iyon ang maaaring piliin, hanapin, o itama hanggang mabasa ang pahina at mailipat ito bilang text.
Ano ang OCR? Ang optical character recognition ay ginagamit para kilalanin ang mga letra, numero, o espesyal na karakter sa na-scan na dokumento o larawan. Gamit ang OCR converter, maaari mong kunin ang teksto mula sa mga file na ito para mabago, ma-edit, ma-print, o mai-save ito.
Ang ibinabalik ay isang plain text file. Nasa loob nito ang mga salita at line breaks ng dokumento, hindi ang disenyo ng pahina. Para sa karamihan ng gawain, ito mismo ang kailangan: ang gusto mo ay laman ng sulat, mga numero sa form, o ang talatang kailangan mong sagutin.
Kaya ng conversion mula na-scan na dokumento tungo sa text na magproseso ng higit sa isang file nang sabay. Idagdag ang bawat pahina ng isang ulat, o isang folder ng mga na-scan na sulat, at iko-convert nang hiwalay ang bawat file at ibabalik bilang sarili nitong text file. Nang walang account, maaari kang magpadala ng 10 scan sa isang upload.
Isang setting ang nagtatakda kung gaano kahusay gagana ang recognition, at iyon ang wika ng dokumento. Naka-select na ang English, kaya hindi na kailangang baguhin ang English na pahina. Para sa iba pa, piliin ang tumutugmang wika mula sa listahan ng 124 bago ka magsimula.
Ang mga litrato ng papel ay itinuturing na scan dito. Buksan ang pahinang ito sa telepono, i-upload ang larawan mula sa camera roll at tatakbo ang parehong recognition dito. Kung na-save ng telepono ang pahina bilang PDF imbes na larawan, mas mainam gamitin ang app na ginawa para sa PDF scans.
I-convert ang scanned PDF sa textAng .txt file extension ay ginagamit para sa mga plain text file. Naglalaman ang mga ito ng mga linya ng text at maaaring buksan sa maraming text editor sa iba't ibang platform at device. Ang text ay walang anumang formatting.
Para sa dokumentong nagsimula sa papel, plain text ang pinakaportableng format na maaari mong makuha. Napakaliit ng file, nabubuksan ito sa anumang computer o telepono nang walang lisensya, at madali mong mailalagay ang mga salita sa email, form, o translation tool nang hindi kasunod ang hitsura ng orihinal na pahina.
File extension: .txt, MIME type: text/plain
TXT sa WikipediaMababasang mabuti ng text recognition ang anumang ipinapakita ng scan. Ganito karaniwang kinalalabasan ng mga dokumentong madalas i-upload ng mga tao.
| Ang dokumento | Paano ito na-capture | Ano ang lumalabas |
|---|---|---|
| Isang naka-print na pahina sa 300 dpi | Isang office scanner o all-in-one printer | Napakalinis. Ito ang pinakamadaling uri ng dokumento na basahin. |
| Isang multi-page na ulat | Isang scan bawat pahina, naka-upload nang magkakasama | Bawat pahina ay bumabalik bilang sarili nitong text file, ayon sa pagkakasunod ng pagdagdag mo. |
| Isang litrato ng dokumento | Camera ng telepono na nakatutok mula sa ibabaw ng papel | Maganda, basta patag ang pahina, sakto sa frame at walang anino. |
| Isang form o talahanayan | Anumang scanner o camera | Lalabas ang mga salita, hindi ang mga column. Walang table structure ang plain text. |
| Maputla, nakatagilid o sulat-kamay na pahina | Lumang kopya, tabingi ang pagka-scan, o ballpen | Hindi mapagkakatiwalaan. Hindi nito inaayos ang tagilid na pahina, at hindi para sa sulat-kamay ginawa ang recognition. |
Ang na-scan na dokumentong mahirap basahin ay halos laging problema sa pag-scan. Ang muling pag-scan sa parehong pahina, patag at sa 300 dpi, ay mas nakaaayos ng resulta kaysa anumang setting sa pahinang ito.
Ito ang mga gawaing pinaka-madalas dalhin dito sa converter na ito.
May nagpadala sa iyo ng scan at ang kailangan mo ay ang mismong laman, hindi ang larawan nito. I-convert ang na-scan na dokumento tungo sa text at handa nang i-paste ang mga talata sa sagot, form, o ulat.
Saklaw ng recognition ang 124 na wika ng dokumento, kaya ang scan sa Indonesian, Arabic, Hindi o Japanese ay babalik bilang text na maaari mong i-paste diretso sa translator o search box.
I-scan ang bunton, i-upload ang mga larawan nang magkakasama at babalik ang bawat dokumento bilang sarili nitong text file. Walang kailangang i-install at hindi kailangan ng account para magawa ito.
Bawat upload at bawat download ay dumadaan sa encrypted na koneksyon, kaya hindi mababasa ang dokumento papunta sa converter o pabalik. Random na ginagawa ang link sa natapos mong text file at hindi ito mahuhulaan.
Ganap na automated ang text recognition dito. Walang nagbabasa, nagbubukas o kumokopya ng mga dokumentong pinapadala mo, walang mino-monitor, at hindi ginagamit ang iyong mga file para mag-train ng AI models.
Tumatakbo ang conversion sa mga server na nasa Europa lang, na pinapatakbo sa ilalim ng data processing agreement. Tanging ang IP address mo at petsa at oras lang ang kasama sa pagproseso kasama ng file, at para lang maiwasan ang maling paggamit ng serbisyo.
Mananatili sa iyo ang copyright at pagmamay-ari ng na-scan na dokumento at ng text file na lalabas dito. Ang pag-convert ng file dito ay hindi nagpapasa ng kahit ano kaninuman.
I-upload ang iyong na-scan na dokumento.
Piliin ang wika ng na-scan na dokumento mula sa dropdown menu (opsyonal).
I-click ang "Start" at pagkatapos ng maikling paghihintay, i-download ang na-convert mong text file.
Oo. Libre ang pag-convert ng na-scan na dokumento sa text sa bawat plan, hindi kailangan ng account at hindi kumokonsumo ng credits. I-upload ang scan, pindutin ang Start at i-download ang text file. Ang bayad na plan ay nagpapataas lang ng limit sa laki ng file at batch.
I-upload ang na-scan na dokumento sa itaas, piliin ang wikang nakasulat dito, pagkatapos ay pindutin ang Start. Babasahin ng converter ang pahina at magbabalik ng plain text file na maaari mong buksan, hanapin at i-edit sa anumang editor. Wala kang kailangang i-install.
Oo. Magdagdag ng 10 scan sa isang upload kahit walang account, at ang bawat dokumento ay ike-convert nang hiwalay at ibabalik bilang sarili nitong text file. Ang wikang pipiliin mo ay ilalapat sa lahat ng ito.
Mas mainam na gamitan ng scanned PDF to text app ang PDF scan. Nakabatay ito sa mga PDF page at hinahayaan kang pumili ng recognition engine, na may epekto sa mahahabang dokumento. Pareho ang paraan ng paggamit sa iba pa nitong bahagi.
124 na wika ng dokumento, mula English, Indonesian at Spanish hanggang Arabic, Hindi, Japanese at Korean. Piliin ang tumutugma sa mga salitang nasa pahina. English ang naka-preselect, kaya hindi na kailangang baguhin para sa English na dokumento.
Hindi, at iyon ang gamit ng text file. Maililipat ang mga salita at line break; hindi kasama ang mga column, table, header at page number, dahil walang page ang plain text. Gamitin ang convert to Word app kapag kailangan mo ang layout pabalik.
Suriin ang dalawang bagay. Una, na tumutugma ang napiling wika sa dokumento. Pangalawa, ang mismong scan: ang maputla, nakatagilid o mababang resolution na pahina ay nawawalan ng mga character, at hindi nito inaayos o nililinis ang pahina para sa iyo. Ang pag-scan muli sa 300 dpi ay nakakaayos sa karamihan ng problema.
Oo. Dumadaan ang mga ito sa encrypted na koneksyon at awtomatikong pinoproseso sa mga server sa European Union. Walang nagbabasa o kumokopya ng mga ito, hindi sila ginagamit para mag-train ng AI models, at random ang download link kaya hindi ito mahuhulaan.
I-digitize ang mahahalagang teksto mula sa na-scan na mga dokumento at larawan gamit ang OCR (Optical Character Recognition). Madaling mag-extract ng teksto mula sa mga larawan, online.
Basahin ang artikuloBawat isa sa mga ito ay tumatakbo sa browser, gamit ang parehong text recognition at wala kang kailangang i-install.