PDF to Text OCR Converter

Mag-convert ng PDF sa text sa iyong browser at i-download ito bilang plain TXT file. Nariyan ang text recognition kapag kailangan mo ito, at naka-off kapag hindi.

I-upload ang iyong file

o ihulog, i-paste, o pumili mula sa cloud

I-paste ang URL Subukan ang sample
Google Drive Dropbox OneDrive
100% libre Walang kailangang i-install Ligtas at pribado
Advertisement
Pinagkakatiwalaan Ng
eBay Booking.com University of Michigan Cornell University Columbia University
I-rate ang tool na ito
0/5 · 0 boto

PDF to text na may OCR o wala

Ang pag-convert ng PDF sa text ay maaaring mangahulugan ng dalawang magkaibang gawain, at hinahayaan ka ng converter na ito na piliin ang kailangan mo. Karamihan sa mga PDF ay mayroon nang tunay na mga character, kaya kailangang basahin lang ang text. Ang na‑scan na PDF naman ay mga larawan ng mga pahina, at kailangang makilala muna ang mga character bago may ma‑extract.

Naka-off ang text recognition bilang default, at sinadya ito. Ang PDF na may tunay na text layer ay mas mabilis at mas eksaktong nako-convert nang walang OCR, dahil kinokopya lang ang mga salita sa halip na hinuhula mula sa isang larawan. Kung bubuksan ang recognition kahit hindi ito kailangan ng file, bababa lang ang accuracy.

Madali mong malalaman kung anong klase ng file ang hawak mo. Buksan ang PDF sa anumang reader at i-drag ang cursor sa isang linya. Kung na-ha-highlight ang mga salita, huwag i-on ang OCR toggle. Kung walang na-ha-highlight, i-on ito at piliin ang wika ng dokumento mula sa 124 source languages na sinusuportahan ng recognition.

I-extract ang text mula sa PDF nang hindi nagre-retype ng kahit isang salita

Ang pag-extract ng text mula sa PDF ay ginagawang magagamit na mga salita ang pahinang dati ay tinitingnan mo lang. Isinusulat ng converter ang lahat ng makita nito sa isang plain text file, para makakapag‑copy ka ng quote, makakapag‑paste ng talata sa email, o makakapag‑search sa buong dokumento gamit ang find command sa kahit anong editor.

Sinasaklaw nito ang mga trabaho na karaniwan nang nasa isip: pagkuha ng mga reference mula sa isang papel, pagkuha ng mga figures sa isang ulat, o paglipat ng katawan ng mahabang dokumento sa isang writing tool. Walang nire-retype at walang mano‑manong transcription.

Maaari kang mag-upload ng ilang PDF nang sabay-sabay. Kinoconvert ang bawat file nang hiwalay at ibinabalik bilang sarili nitong text file, na may parehong OCR setting at parehong wika para sa lahat. Hindi kailangan ng account at hindi humihingi ng email address.

Ano ang TXT file?

Ang .txt file extension ay ginagamit para sa mga plain text file. Naglalaman ang mga ito ng mga linya ng text at maaaring buksan sa maraming text editor sa iba't ibang platform at device. Ang text ay walang anumang formatting.

Iyan ang dahilan kung bakit PDF to TXT ang pinipili sa halip na document format. Nabubuksan ang file sa anumang computer at anumang phone, hindi kailangan ng lisensya para basahin, at nananatiling nababasa kahit napalitan na ang program na gumawa sa orihinal.

File extension: .txt, MIME type: text/plain

TXT sa Wikipedia

PDF to TXT: ano ang nananatili sa text file

Mga salita lang, hindi mga pahina, ang laman ng plain text file. Ito ang mga nananatili sa conversion at ang mga hindi.

Mula sa PDF Sa TXT file
Mga salita at line break Nananatili
Reading order Nananatili, mula itaas pababa
Bold, italics at mga font Hindi isinasama
Mga larawan, logo at chart Hindi isinasama
Mga talahanayan Nananatili bilang text, walang grid
Mga pahinang may maraming column Pinagdurugtong sa isang column
Mga header, footer at page number Isinusulat kasama ng text

Tinatago ng plain text file ang mga salita, hindi ang layout. Kapag kasinghalaga ng mga salita ang formatting, mas babagay ang PDF to Word app.

Kailan tama ang pag-convert ng PDF sa text

Nakalock ang mga salita sa PDF sa page layout. Sa mga kasong ito, mas nakakatipid ng oras kapag inilabas ang text bilang plain text.

Pag-quote at pananaliksik

Ibinabahagi ang mga papel, ulat at libro bilang PDF. I-extract ang text isang beses at i-paste ang mga bahagi na kailangan mo sa notes sa halip na i-type ulit ang mga ito.

Paghahanap sa mahabang dokumento

Nabubuksan ang text file sa anumang editor, para makakalundag ka agad sa isang pangalan, petsa o halaga sa halip na magbasa ng pahina kada pahina.

Pagpapakain ng text sa ibang tool

Tumatanggap ng plain text ang mga translator, writing tool, screen reader at spreadsheet. TXT ang format na halos lahat sa kanila ay tinatanggap nang walang converter.

Protektado ang data mo

Kadalasang kontrata, invoice, o pribadong sulat ang mga PDF na kino-convert ng mga tao. Ganito eksakto hahawakan ang sa iyo.

TLS encryption

Bawat upload at download ay dumaraan sa encrypted na koneksyon, kaya hindi mababasa ang mga file mo habang ipinapadala.

ISO 27001 data centres

Nangyayari ang pagproseso sa mga certified data centre sa loob ng European Union.

Walang human access

Ganap na awtomatiko ang text recognition. Walang bumabasa sa mga scan o dokumento mo, at walang ibinabahagi sa third parties.

Paano i-convert ang PDF sa text?

1

Mag-upload

I-upload ang iyong PDF.

2

Pumili

I-on ang OCR kung scan ang PDF. Iwanan itong naka-off kapag selectable na ang text sa file.

3

Ayusin

Piliin ang wika ng iyong dokumento mula sa menu (opsyonal).

4

I-convert

I-click ang "Start" at hintayin matapos ang conversion.

PDF to text FAQ

Libre ba ang PDF to text converter na ito?

Oo. Libre ang pag-convert ng PDF sa text at hindi kailangan ng account, at hindi rin humihingi ng email address. I-upload ang file, simulan ang conversion at i-download ang text. Kailangan lang ang plan para sa napakalalaking file at mas mahahabang batch.

Paano mag-convert ng PDF sa text?

I-upload ang PDF sa itaas, iwanang naka-off ang OCR toggle kung selectable na ang text sa file, at simulan ang conversion. Ang resulta ay plain text file na maaari mong i-download at buksan sa anumang editor. Walang kailangang i-install.

Paano ko kokopyahin ang text mula sa PDF?

Kung na-ha-highlight ang mga salita kapag i-dinrag mo ang cursor sa mga ito, maaari mo silang direktang kopyahin mula sa PDF reader. Kung hindi, larawan ang pahina at walang puwedeng piliin. Nasosolusyunan ito ng pag-convert ng PDF sa text, dahil text file ang output na malaya mong makokopyahan.

Puwede ko rin bang i-convert ang PDF sa TXT?

Iyan mismo ang isinusulat ng converter na ito. TXT ang plain text format, kaya ang file na dina-download mo ay may extension na .txt at media type na text/plain. Nabubuksan ito sa Notepad, TextEdit, anumang code editor at anumang phone, nang walang dagdag na software.

Bakit naka-off ang OCR bilang default?

Dahil karamihan sa mga PDF ay hindi ito kailangan. Mas mabilis at mas eksaktong nako-convert ang PDF na may tunay na text layer kapag kinokopya lang ang mga salita sa halip na kinikilala mula sa isang larawan. I-on lang ang OCR kapag ang mga pahina ay scan o litrato, at lilitaw kasama nito ang language picker.

Gumagana ba ang PDF to text converter na ito sa na-scan na PDF?

Oo, kapag naka-on ang OCR. Binabasa ng recognition ang mga character mula sa page images at isinusulat ang mga ito sa text file. Kung karamihan sa kino-convert mo ay scans, ang scanned PDF to text app ang mas diretso ngunit pareho ang magiging resulta.

Aling mga wika ang kayang basahin ng text recognition?

Nakakakilala ito ng 124 source languages. Kasama ng mga European language, saklaw ng listahan ang Hindi, Bengali, Tamil, Urdu, Arabic, Thai, Japanese, Korean at Chinese sa parehong simplified at traditional na anyo. Piliin ang wikang gamit sa dokumento mo para sa pinakamahusay na resulta.

Pwede ba akong mag-convert ng maraming PDF sa text nang sabay-sabay?

Oo. Magdagdag lang ng maraming PDF na kailangan mo at iko-convert ang mga ito sa isang proseso, na ibinabalik bilang hiwa-hiwalay na text file, gamit ang parehong OCR setting at parehong wika.

Higit pa tungkol sa text recognition

Isang nakabukas na libro sa dilaw na desk, naka-frame ng scanner brackets, na may pamagat ng artikulong Save Valuable Text With OCR na naka-print sa pahina
Paano

I-save ang Mahahalagang Teksto gamit ang OCR

I-digitize ang mahahalagang teksto mula sa na-scan na mga dokumento at larawan gamit ang OCR (Optical Character Recognition). Madaling mag-extract ng teksto mula sa mga larawan, online.

Basahin ang artikulo