PDF escanejat a text

Aquesta eina converteix PDFs escanejats a text editable perquè puguis copiar, editar i afegir contingut fàcilment.

Puja el teu fitxer

o arrossega, enganxa o selecciona des del núvol

Enganxa l'URL Prova'n un exemple
Google Drive Dropbox OneDrive
100% gratuït No cal instal·lació Segur i privat
Anunci
De confiança per
eBay Booking.com University of Michigan Cornell University Columbia University
Valora aquesta eina
0/5 · 0 vots

Quan un PDF escanejat necessita OCR i quan no

Convertir un PDF escanejat a text són en realitat dues feines diferents, i el convertidor et permet triar quina s'executa. Un PDF que ja conté caràcters reals només s'ha de llegir. Un PDF que conté imatges de pàgines s'ha de reconèixer primer, perquè encara no hi ha text a dins.

Les pots distingir en un segon. Obre el fitxer en qualsevol lector i intenta seleccionar una línia. Si les paraules es ressalten, el PDF té una capa de text, així que tria Convertir i el text sortirà exactament tal com es va escriure. Si no es ressalta res, o tota la pàgina es ressalta com un sol bloc, és un escaneig i necessita reconeixement òptic de caràcters.

Aquesta sola tria explica la majoria dels resultats decebedors que la gent obté en altres llocs. Un convertidor que fa servir un sol camí per a cada pujada retorna text net per a alguns fitxers i una pàgina en blanc per a d'altres, sense cap explicació. Triar tu mateix el motor elimina les conjectures.

Com copiar text de documents PDF escanejats

Un escaneig no et permet arrossegar el cursor per una frase perquè no hi ha res per seleccionar. Extreure el text d'un PDF escanejat ho resol: puja el fitxer, executa la conversió i obtindràs un fitxer de text pla des del qual pots copiar, enganxar en un correu electrònic o cercar amb l'ordre de trobar en qualsevol editor.

El resultat és un fitxer .txt, així que s'obre en qualsevol ordinador i en qualsevol telèfon sense programari especial. Manté les paraules i els salts de línia i deixa enrere el disseny, que és l'intercanvi adequat quan el que vols és el contingut i no una còpia de la pàgina.

Es poden pujar diversos escanejos alhora. Cada PDF es converteix per separat i es descarrega com el seu propi fitxer de text, amb el mateix motor i la mateixa selecció d'idioma aplicats a tots.

Què és un fitxer TXT?

L'extensió de fitxer .txt s'utilitza per a fitxers de text sense format. Aquests fitxers contenen línies de text i es poden obrir amb molts editors de text en diferents plataformes i dispositius. El text no conté cap format.

Per això és el lloc més segur on desar text recuperat d'un escaneig. Res en el fitxer pot quedar obsolet, no cal cap llicència per obrir-lo i les paraules continuen llegibles molt després que el programa que va produir l'original hagi estat substituït.

Extensió de fitxer: .txt, tipus MIME: text/plain

TXT a la Viquipèdia

Quin motor OCR triar

Aquí hi ha 5 maneres de llegir un PDF escanejat, i el panell de configuració et permet canviar entre elles. Tria la que s'ajusta al fitxer que tens davant.

Motor OCR Tria'l quan
Converteix El PDF ja té text seleccionable. No s'executa cap reconeixement, així que les paraules surten exactament tal com es van escriure.
OCR estàndard L'escaneig és net, recte i nítid. Aquest és el camí més ràpid d'un PDF escanejat a text.
OCR amb IA avançada L'escaneig és tènue, de baixa resolució o lleugerament tort, i el motor estàndard perd caràcters.
OCR+ amb IA avançada La pàgina té ombres, il·luminació irregular o un llom corbat, cosa habitual quan es fotografia un llibre.
OCR de foto El text s'ha fotografiat en lloc d'escanejar-se, per exemple un rètol, una etiqueta o una pantalla.

El convertidor reconeix 124 idiomes d'origen, inclosos el xinès simplificat i tradicional amb dissenys verticals i les formes ciríl·liques de l'àzeri, el serbi i l'uzbek. Selecciona tots els idiomes que apareixen al teu fitxer.

Motius habituals per convertir un PDF escanejat a text

Les paraules d'un escaneig estan bloquejades dins d'una imatge. Aquestes són les situacions en què extreure-les estalvia més feina.

Paperassa que necessites cercar

Les factures, contractes, rebuts i cartes solen arribar com a escanejos. Amb el text extret pots cercar-hi un import, una data o un nom en lloc de llegir cada pàgina.

Material d'estudi i recerca

Els escanejos de biblioteca, articles de revista i pàgines de llibres passen a ser citables. Extreu el text un cop i enganxa els passatges que necessites a les teves notes en lloc de tornar-los a escriure.

Registres i arxius

Els fitxers més antics sovint es conserven com escanejos llargs de diverses pàgines. Puja'n diversos alhora i el convertidor processa tot el lot en una sola execució.

Les teves dades, protegides

Els papers que escaneges i els documents que converteixes poden ser personals. Així és exactament com es tracten els teus.

Xifrat TLS

Cada pujada i descàrrega es fa a través d'una connexió xifrada, de manera que els teus fitxers no es poden llegir mentre es transmeten.

Sense accés humà

El reconeixement de text és totalment automatitzat. Ningú llegeix els teus escanejos o documents, i no es comparteix res amb tercers.

Centres de dades ISO 27001

El processament té lloc en centres de dades certificats dins de la Unió Europea.

Com convertir un PDF escanejat a text

1

Puja

Puja el teu PDF escanejat.

2

Tria

Tria el motor OCR que s'ajusta al teu fitxer. Fes servir Convertir si el text del PDF ja és seleccionable.

3

Ajusta

Tria l'idioma del teu PDF per obtenir millors resultats (opcional).

4

Converteix

Inicia la conversió i espera que la teva descàrrega estigui llesta.

Preguntes freqüents sobre PDF escanejat a text

Aquest convertidor de PDF escanejat a text és gratuït?

Sí. Convertir un PDF escanejat a text és gratuït i no cal cap compte. Puja el fitxer, tria un motor i descarrega el resultat. Els fitxers de fins a 100 MB estan coberts pel límit gratuït, i un pla només és necessari per a fitxers més grans i lots més llargs.

Puc fer OCR a un PDF de forma gratuïta?

Sí. L'OCR estàndard és el motor gratuït i gestiona escanejos normals sense registrar-se. Els 3 motors avançats d'IA són l'actualització per a pàgines que el motor estàndard no pot llegir, com còpies tènues o fotos fetes amb poca llum.

Per què el meu PDF escanejat necessita OCR per extreure'n el text?

Perquè el fitxer conté imatges de pàgines en lloc de caràcters. Un escàner fotografia el paper, així que cada paraula és un patró de píxels. El reconeixement òptic de caràcters llegeix aquests píxels i escriu caràcters reals, que és el que fa que el text sigui seleccionable, cercable i editable.

Com puc copiar text d'un PDF escanejat?

Puja el PDF més amunt, tria un motor OCR i inicia la conversió. El resultat és un fitxer de text pla que pots obrir en qualsevol editor i des del qual pots copiar. Copiar directament des d'un lector de PDF només funciona quan el fitxer ja té una capa de text.

Quins idiomes pot llegir el reconeixement de text?

Reconeix 124 idiomes d'origen, inclòs el xinès tant en forma simplificada com tradicional amb dissenys verticals, i les variants ciríl·liques de l'àzeri, el serbi i l'uzbek. Selecciona tots els idiomes que apareixen al fitxer, perquè una pàgina barrejada es llegeix millor quan tots hi figuren.

Puc convertir un PDF escanejat a Word?

No des d'aquesta pàgina, que escriu un fitxer de text pla. Manté les paraules i elimina el disseny. Per obtenir un DOC o DOCX amb format, fes servir l'aplicació Convertir a Word, que executa el mateix reconeixement de text i escriu un document de Word.

Per què el text extret ha sortit malament?

La qualitat del reconeixement segueix la qualitat de l'escaneig. Una pàgina torta, una resolució baixa, una ombra sobre el paper o una foto feta a mà redueixen la precisió. Prova IA-OCR avançat per a escanejos imperfectes i IA-OCR avançat+ per a mala il·luminació, i torna a escanejar a 300 dpi quan puguis. Un fitxer d'origen amb contrasenya o malmès no es convertirà.

Els meus documents escanejats són privats?

Sí. Les pujades i les baixades es fan mitjançant una connexió xifrada, el processament té lloc en centres de dades certificats dins de la Unió Europea i tot el flux està automatitzat, de manera que ningú llegeix els teus escanejos. Els teus fitxers mai no s'utilitzen per entrenar models d'IA i en mantens els drets.

Més informació sobre el reconeixement de text

Un llibre obert sobre un escriptori groc, emmarcat per les guies de l'escàner, amb el títol de l'article Save Valuable Text With OCR imprès a la pàgina
Com fer-ho

Desa textos valuosos amb OCR

Digitalitza textos valuosos de documents escanejats i imatges amb OCR (Reconeixement Òptic de Caràcters). Extreu text d'imatges fàcilment, en línia.

Llegir l'article