Aquesta eina converteix PDFs escanejats a text editable perquè puguis copiar, editar i afegir contingut fàcilment.
o arrossega, enganxa o selecciona des del núvol
Convertir un PDF escanejat a text són en realitat dues feines diferents, i el convertidor et permet triar quina s'executa. Un PDF que ja conté caràcters reals només s'ha de llegir. Un PDF que conté imatges de pàgines s'ha de reconèixer primer, perquè encara no hi ha text a dins.
Les pots distingir en un segon. Obre el fitxer en qualsevol lector i intenta seleccionar una línia. Si les paraules es ressalten, el PDF té una capa de text, així que tria Convertir i el text sortirà exactament tal com es va escriure. Si no es ressalta res, o tota la pàgina es ressalta com un sol bloc, és un escaneig i necessita reconeixement òptic de caràcters.
Aquesta sola tria explica la majoria dels resultats decebedors que la gent obté en altres llocs. Un convertidor que fa servir un sol camí per a cada pujada retorna text net per a alguns fitxers i una pàgina en blanc per a d'altres, sense cap explicació. Triar tu mateix el motor elimina les conjectures.
Un escaneig no et permet arrossegar el cursor per una frase perquè no hi ha res per seleccionar. Extreure el text d'un PDF escanejat ho resol: puja el fitxer, executa la conversió i obtindràs un fitxer de text pla des del qual pots copiar, enganxar en un correu electrònic o cercar amb l'ordre de trobar en qualsevol editor.
El resultat és un fitxer .txt, així que s'obre en qualsevol ordinador i en qualsevol telèfon sense programari especial. Manté les paraules i els salts de línia i deixa enrere el disseny, que és l'intercanvi adequat quan el que vols és el contingut i no una còpia de la pàgina.
Es poden pujar diversos escanejos alhora. Cada PDF es converteix per separat i es descarrega com el seu propi fitxer de text, amb el mateix motor i la mateixa selecció d'idioma aplicats a tots.
L'extensió de fitxer .txt s'utilitza per a fitxers de text sense format. Aquests fitxers contenen línies de text i es poden obrir amb molts editors de text en diferents plataformes i dispositius. El text no conté cap format.
Per això és el lloc més segur on desar text recuperat d'un escaneig. Res en el fitxer pot quedar obsolet, no cal cap llicència per obrir-lo i les paraules continuen llegibles molt després que el programa que va produir l'original hagi estat substituït.
Extensió de fitxer: .txt, tipus MIME: text/plain
TXT a la ViquipèdiaAquí hi ha 5 maneres de llegir un PDF escanejat, i el panell de configuració et permet canviar entre elles. Tria la que s'ajusta al fitxer que tens davant.
| Motor OCR | Tria'l quan |
|---|---|
| Converteix | El PDF ja té text seleccionable. No s'executa cap reconeixement, així que les paraules surten exactament tal com es van escriure. |
| OCR estàndard | L'escaneig és net, recte i nítid. Aquest és el camí més ràpid d'un PDF escanejat a text. |
| OCR amb IA avançada | L'escaneig és tènue, de baixa resolució o lleugerament tort, i el motor estàndard perd caràcters. |
| OCR+ amb IA avançada | La pàgina té ombres, il·luminació irregular o un llom corbat, cosa habitual quan es fotografia un llibre. |
| OCR de foto | El text s'ha fotografiat en lloc d'escanejar-se, per exemple un rètol, una etiqueta o una pantalla. |
El convertidor reconeix 124 idiomes d'origen, inclosos el xinès simplificat i tradicional amb dissenys verticals i les formes ciríl·liques de l'àzeri, el serbi i l'uzbek. Selecciona tots els idiomes que apareixen al teu fitxer.
Les paraules d'un escaneig estan bloquejades dins d'una imatge. Aquestes són les situacions en què extreure-les estalvia més feina.
Les factures, contractes, rebuts i cartes solen arribar com a escanejos. Amb el text extret pots cercar-hi un import, una data o un nom en lloc de llegir cada pàgina.
Els escanejos de biblioteca, articles de revista i pàgines de llibres passen a ser citables. Extreu el text un cop i enganxa els passatges que necessites a les teves notes en lloc de tornar-los a escriure.
Els fitxers més antics sovint es conserven com escanejos llargs de diverses pàgines. Puja'n diversos alhora i el convertidor processa tot el lot en una sola execució.
Els papers que escaneges i els documents que converteixes poden ser personals. Així és exactament com es tracten els teus.
Cada pujada i descàrrega es fa a través d'una connexió xifrada, de manera que els teus fitxers no es poden llegir mentre es transmeten.
El reconeixement de text és totalment automatitzat. Ningú llegeix els teus escanejos o documents, i no es comparteix res amb tercers.
El processament té lloc en centres de dades certificats dins de la Unió Europea.
Puja el teu PDF escanejat.
Tria el motor OCR que s'ajusta al teu fitxer. Fes servir Convertir si el text del PDF ja és seleccionable.
Tria l'idioma del teu PDF per obtenir millors resultats (opcional).
Inicia la conversió i espera que la teva descàrrega estigui llesta.
Sí. Convertir un PDF escanejat a text és gratuït i no cal cap compte. Puja el fitxer, tria un motor i descarrega el resultat. Els fitxers de fins a 100 MB estan coberts pel límit gratuït, i un pla només és necessari per a fitxers més grans i lots més llargs.
Sí. L'OCR estàndard és el motor gratuït i gestiona escanejos normals sense registrar-se. Els 3 motors avançats d'IA són l'actualització per a pàgines que el motor estàndard no pot llegir, com còpies tènues o fotos fetes amb poca llum.
Perquè el fitxer conté imatges de pàgines en lloc de caràcters. Un escàner fotografia el paper, així que cada paraula és un patró de píxels. El reconeixement òptic de caràcters llegeix aquests píxels i escriu caràcters reals, que és el que fa que el text sigui seleccionable, cercable i editable.
Puja el PDF més amunt, tria un motor OCR i inicia la conversió. El resultat és un fitxer de text pla que pots obrir en qualsevol editor i des del qual pots copiar. Copiar directament des d'un lector de PDF només funciona quan el fitxer ja té una capa de text.
Reconeix 124 idiomes d'origen, inclòs el xinès tant en forma simplificada com tradicional amb dissenys verticals, i les variants ciríl·liques de l'àzeri, el serbi i l'uzbek. Selecciona tots els idiomes que apareixen al fitxer, perquè una pàgina barrejada es llegeix millor quan tots hi figuren.
No des d'aquesta pàgina, que escriu un fitxer de text pla. Manté les paraules i elimina el disseny. Per obtenir un DOC o DOCX amb format, fes servir l'aplicació Convertir a Word, que executa el mateix reconeixement de text i escriu un document de Word.
La qualitat del reconeixement segueix la qualitat de l'escaneig. Una pàgina torta, una resolució baixa, una ombra sobre el paper o una foto feta a mà redueixen la precisió. Prova IA-OCR avançat per a escanejos imperfectes i IA-OCR avançat+ per a mala il·luminació, i torna a escanejar a 300 dpi quan puguis. Un fitxer d'origen amb contrasenya o malmès no es convertirà.
Sí. Les pujades i les baixades es fan mitjançant una connexió xifrada, el processament té lloc en centres de dades certificats dins de la Unió Europea i tot el flux està automatitzat, de manera que ningú llegeix els teus escanejos. Els teus fitxers mai no s'utilitzen per entrenar models d'IA i en mantens els drets.
Digitalitza textos valuosos de documents escanejats i imatges amb OCR (Reconeixement Òptic de Caràcters). Extreu text d'imatges fàcilment, en línia.
Llegir l'articleTotes aquestes eines s'executen al navegador. Sense instal·lació, sense compte i amb el mateix reconeixement de text al darrere.