Extreu text de documents escanejats o fotografiats.
o arrossega, enganxa o selecciona des del núvol
Convertir un document escanejat a text vol dir una cosa: extreure les paraules d'una pàgina que només és una imatge. Un escàner o la càmera del mòbil guarden el paper com una imatge plana, de manera que les lletres que hi surten són píxels i no pas caràcters. No es pot seleccionar, cercar ni corregir res d'aquest fitxer fins que la pàgina s'hagi llegit i transcrit com a text.
Què és l'OCR? El reconeixement òptic de caràcters s'utilitza per identificar lletres, números o caràcters especials en un document escanejat o una imatge. Amb un convertidor OCR, pots extreure el text d'aquests fitxers per poder-lo canviar, editar, imprimir o desar.
El resultat és un fitxer de text net. Conté les paraules i els salts de línia del document, però no el disseny de la pàgina. Per a la majoria de feines això és justament el que es vol: el text d'una carta, les xifres d'un formulari o el paràgraf al qual has de respondre.
La conversió de document escanejat a text admet més d'un fitxer alhora. Afegeix totes les pàgines d'un informe, o una carpeta de cartes escanejades, i cada fitxer es converteix per separat i es retorna com el seu propi fitxer de text. Sense compte pots enviar 10 escanejats en una sola càrrega.
Un sol paràmetre determina com funciona el reconeixement: l'idioma del document. L'anglès ja ve seleccionat, així que una pàgina en anglès no necessita cap canvi. Per a qualsevol altre idioma, tria el que correspongui de la llista de 124 abans de començar.
Les fotografies de documents es consideren escanejats aquí. Obre aquesta pàgina en un mòbil, puja la foto des de la galeria i s'hi aplicarà el mateix reconeixement. Si el mòbil ha desat la pàgina com a PDF en lloc d'imatge, és millor fer servir l'aplicació pensada per a escanejats PDF.
Converteix PDF escanejat a textL'extensió de fitxer .txt s'utilitza per a fitxers de text sense format. Aquests fitxers contenen línies de text i es poden obrir amb molts editors de text en diferents plataformes i dispositius. El text no conté cap format.
Per a un document que ha començat en paper, el text net és el format més portable amb què pot acabar. El fitxer és molt petit, s'obre en qualsevol ordinador o mòbil sense llicència i les paraules es poden enganxar en un correu, un formulari o una eina de traducció sense arrossegar amb elles l'aspecte de la pàgina original.
Extensió de fitxer: .txt, tipus MIME: text/plain
TXT a la ViquipèdiaEl reconeixement de text només pot llegir allò que mostra l'escaneig. Així és com solen sortir els documents que la gent puja més sovint.
| El document | Com s'ha capturat | Què en surt |
|---|---|---|
| Una pàgina impresa a 300 dpi | Un escàner d'oficina o una impressora multifunció | Molt net. És el tipus de document més fàcil de llegir. |
| Un informe de diverses pàgines | Un escaneig per pàgina, pujats junts | Cada pàgina es retorna com el seu propi fitxer de text, en l'ordre en què les has afegit. |
| Una foto d'un document | La càmera d'un mòbil sobre el paper | Bé, sempre que la pàgina sigui plana, ompli el marc i no tingui ombres. |
| Un formulari o una taula | Qualsevol escàner o càmera | Les paraules surten, les columnes no. El text net no té estructura de taula. |
| Una pàgina tènue, torta o manuscrita | Una còpia antiga, un alimentador tort o un bolígraf | Poc fiable. Aquesta aplicació no redreça pàgines, i el reconeixement no està pensat per a l'escriptura manual. |
Si un document escanejat es llegeix malament, gairebé sempre és un problema de captura. Tornar a escanejar la mateixa pàgina, plana i a 300 dpi, millora més resultats que qualsevol paràmetre d'aquesta pàgina.
Aquestes són les feines més habituals que es fan amb aquest convertidor.
Algú t'ha enviat un escaneig i necessites el text, no pas la imatge. Converteix el document escanejat a text i tindràs els paràgrafs llestos per enganxar-los en una resposta, un formulari o un informe.
El reconeixement cobreix 124 idiomes de document, de manera que un escaneig en indonesi, àrab, hindi o japonès es retorna com a text que pots enganxar directament en un traductor o un quadre de cerca.
Escaneja la pila, puja les imatges juntes i cada document es retorna com el seu propi fitxer de text. No cal instal·lar res ni registrar cap compte per fer-ho.
Cada càrrega i cada descàrrega es fa mitjançant una connexió xifrada, de manera que el document no es pot llegir ni de camí al convertidor ni de camí de tornada. L'enllaç al fitxer de text acabat es genera aleatòriament i no es pot endevinar.
El reconeixement de text aquí és completament automatitzat. Ningú llegeix, obre ni copia els documents que envies, no es monitoritza res i els teus fitxers no s'utilitzen mai per entrenar models d'IA.
La conversió s'executa en servidors ubicats exclusivament a Europa, operats sota un acord de tractament de dades. Només es tracten la teva adreça IP i la data i hora juntament amb el fitxer, i només per prevenir un ús indegut del servei.
Tens el copyright i la propietat tant del document escanejat com del fitxer de text que se'n genera. Convertir un fitxer aquí no cedeix res a ningú.
Puja el teu document escanejat.
Selecciona l'idioma del document escanejat al menú desplegable (opcional).
Fes clic a "Inicia" i, després d'una curta espera, baixa el teu fitxer de text convertit.
Sí. Convertir un document escanejat a text és gratuït a tots els plans, no cal cap compte i no costa crèdits. Puja l'escaneig, prem Inicia i baixa el fitxer de text. Un pla de pagament només augmenta la mida dels fitxers i els límits de processament per lots.
Puja el document escanejat aquí dalt, tria l'idioma en què està escrit i prem Inicia. El convertidor llegeix la pàgina i retorna un fitxer de text pla que pots obrir, cercar i editar amb qualsevol editor. No cal instal·lar res.
Sí. Afegeix 10 escaneigs en una sola pujada sense compte, i cada document es converteix per separat i es baixa com el seu propi fitxer de text. L'idioma que triïs s'aplica a tots.
Un PDF escanejat es tracta millor amb l'aplicació PDF escanejat a text. Està pensada per a pàgines PDF i et permet triar el motor de reconeixement, cosa que marca la diferència en un document llarg. La resta funciona igual.
124 idiomes de documents, de l'anglès, indonesi i espanyol a l'àrab, hindi, japonès i coreà. Tria el que coincideixi amb les paraules de la pàgina. L'anglès està preseleccionat, així que per a un document en anglès no cal canviar res.
No, i precisament això és el que fa un fitxer de text. Es conserven les paraules i els salts de línia; les columnes, taules, encapçalaments i números de pàgina no, perquè el text pla no té pàgines. Fes servir l'aplicació convertir a Word quan necessitis recuperar el disseny.
Comprova dues coses. Primer, que l'idioma seleccionat coincideix amb el del document. Segon, l'escaneig en si: una pàgina tènue, torta o de baixa resolució perd caràcters, i aquesta aplicació no redreça ni neteja la pàgina per tu. Tornar a escanejar a 300 dpi sol solucionar-ho en gran part.
Sí. Viatgen per una connexió xifrada i es processen automàticament en servidors de la Unió Europea. Ningú no els llegeix ni en fa còpies, mai no s'utilitzen per entrenar models d'IA i l'enllaç de baixada és aleatori, de manera que no es pot endevinar.
Digitalitza textos valuosos de documents escanejats i imatges amb OCR (Reconeixement Òptic de Caràcters). Extreu text d'imatges fàcilment, en línia.
Llegir l'articleTotes aquestes eines s'executen al navegador, amb el mateix reconeixement de text al darrere i sense res per instal·lar.