Convierte documentos escaneados en PDFs con búsqueda. Busca en el contenido de tus escaneos, documentos y PDFs usando palabras clave, números, nombres y más.
o arrastra, pega o elige desde la nube
Lo que la app hace con tu archivo, antes de que subas nada.
Digitalizar tus documentos y gestionar una oficina digital no solo es bueno para el medio ambiente, también ahorra mucho tiempo que normalmente dedicas a buscar en carpeta tras carpeta. Sin embargo, muchas digitalizaciones solo contienen imágenes de los documentos escaneados. Estos no se pueden buscar, salvo por el nombre del archivo.
Al hacer que una digitalización sea buscable, se añade una capa de texto adicional a la imagen escaneada, creando un llamado PDF híbrido. Esta capa de texto te permite buscar palabras clave, importes y otros números, nombres o temas dentro del PDF.
Un PDF con OCR se ve por tanto exactamente igual que el escaneo del que salió. Las páginas, los sellos y la letra manuscrita siguen en su sitio. La diferencia está debajo, donde una capa de caracteres reales espera a que la lean tu lector, tu computadora y tu gestor de documentos.
Extensión de archivo: .pdf, tipo MIME: application/pdf
PDF en WikipediaEsta app toma un PDF y devuelve un PDF. Nada del aspecto del documento cambia. Las páginas conservan su tamaño, los escaneos conservan sus marcas y detrás de ellos se escribe una capa oculta de texto reconocido.
Eso es lo que la separa de las apps que sacan el texto de un archivo. Aquellas te entregan las palabras en un archivo de texto sin formato y dejan atrás el diseño. Esta deja el diseño en paz, así que conservas un documento que puedes reenviar, imprimir o firmar, y además se busca en él como en un archivo de texto.
El archivo que subes tiene que ser un PDF. Si lo que tienes es una foto o un archivo de imagen, las apps de JPG a PDF y de PNG a PDF construyen el PDF por ti y aplican el mismo reconocimiento de texto mientras lo hacen.
El reconocimiento de texto lee una página contrastándola con un modelo del idioma que espera, así que indicar ese idioma es lo más útil que puedes hacer por el resultado. El ajuste está junto al cargador de archivos y es la única elección que la app te pide.
Admite más de un idioma a la vez. Un contrato con una portada en inglés y un anexo en alemán se lee mejor con los dos seleccionados, y lo mismo pasa con un escaneo que mezcla el alfabeto latino con el árabe, el cirílico o el chino.
La lista tiene 124 idiomas de origen, entre ellos el árabe, el hindi, el tailandés, el vietnamita, el chino en sus formas simplificada y tradicional, y las formas cirílicas del azerbaiyano, el serbio y el uzbeko. Si no cambias nada, queda seleccionado el inglés.
El reconocimiento de texto no lee todas las páginas igual de bien. Esto es lo que puedes esperar del archivo que tienes.
| El PDF que tienes | ¿Se le puede aplicar OCR? | Qué hacer |
|---|---|---|
| Un escaneo plano de páginas impresas | Sí | Súbelo y elige el idioma del documento. Este es el archivo para el que está hecha la app. |
| Una página fotografiada con el teléfono | Normalmente | Las sombras, los ángulos y un lomo curvado cuestan precisión. Fotografía en plano y con luz uniforme siempre que puedas. |
| Una copia tenue, un fax o letra manuscrita | En parte | La letra de imprenta y la manuscrita no son el mismo problema. Cuenta con que habrá huecos y lee el resultado antes de fiarte de él. |
| Un PDF cuyo texto ya puedes seleccionar | Nada que añadir | En él ya se puede buscar. Usa PDF a texto si lo que quieres son las palabras en un archivo aparte. |
| Un PDF protegido con contraseña o dañado | No | La app no puede abrirlo. Quita la protección o repara el archivo primero y vuelve a subirlo. |
| Un JPG, un PNG u otro archivo de imagen | Aquí no | JPG a PDF y PNG a PDF crean el PDF y aplican el mismo reconocimiento. |
La calidad del reconocimiento sigue a la calidad del escaneo. Una página torcida, una resolución baja o una sombra sobre el papel cuestan precisión, así que conviene leer el resultado antes de archivar el documento.
Un escaneo y un PDF con OCR se ven igual en pantalla. Estas son las tres cosas que solo uno de los dos puede hacer.
El comando de búsqueda de cualquier lector de PDF salta directo a la palabra que escribiste. En un contrato de arrendamiento de 90 páginas, esa es la diferencia entre una búsqueda y una tarde entera.
La búsqueda del escritorio y la mayoría de las unidades en la nube leen la capa de texto que hay dentro de un PDF. Un PDF con OCR aparece en los resultados por lo que está escrito en él, y no solo por su nombre de archivo.
Arrastrar el cursor por un escaneo no hace nada, porque no hay nada que seleccionar. Un PDF con OCR te deja tomar un párrafo y pegarlo en un correo o en una nota.
Los papeles que escaneas y los documentos que conviertes pueden ser personales. Así se tratan exactamente los tuyos.
Cada subida y cada descarga van por una conexión cifrada, así que tus archivos no se pueden leer mientras viajan.
El reconocimiento de texto está totalmente automatizado. Nadie lee tus escaneos ni tus documentos, y no se comparte nada con terceros.
Solo se procesa lo que una conversión necesita. Tus archivos nunca se usan para entrenar modelos de IA.
Sube el PDF al que quieras aplicar OCR. Funcionan tanto las páginas escaneadas como las fotografiadas.
Elige el idioma del documento en la lista (opcional).
Haz clic en "Start". Tras unos instantes, tu documento estará listo.
Un PDF con OCR es un escaneo con una capa de texto real detrás. Las páginas siguen viéndose exactamente como el papel del que salieron, pero las palabras de debajo se pueden buscar, seleccionar y copiar. También se le llama PDF híbrido, porque contiene la imagen y el texto en un mismo archivo.
Sube el PDF de arriba, elige el idioma del documento y pulsa Iniciar. El reconocimiento de texto lee las páginas, escribe lo que encuentra en una capa oculta y te devuelve el PDF. Se pueden meter varios PDF a la vez y cada uno vuelve por separado.
Sí. Aplicar OCR a un PDF es gratis, no necesita registro y no cuesta créditos. Un plan solo importa para documentos muy grandes y lotes largos.
No. Si puedes arrastrar el cursor por una línea y las palabras se resaltan, el PDF ya lleva una capa de texto y ya se puede buscar en él. Volver a pasarlo no añade nada. Si lo que quieres son las palabras en un archivo aparte, usa la app de PDF a texto.
Lee 124 idiomas de origen, entre ellos el árabe, el hindi, el tailandés, el vietnamita, el chino en sus formas simplificada y tradicional, y las formas cirílicas del azerbaiyano, el serbio y el uzbeko. Selecciona todos los idiomas que aparezcan en el documento, porque una página mezclada se lee mejor cuando están todos en la lista.
La calidad del reconocimiento sigue a la calidad del escaneo. Una página torcida, una resolución baja, una sombra sobre el papel o una foto tomada a pulso cuestan precisión, y la letra manuscrita es todavía más difícil que la de imprenta. Escanea en plano a 300 ppp siempre que puedas y elige el idioma del documento antes de empezar.
Con esta app no. Añade una capa de texto en lugar de quitarla. Dejar un PDF sin capa de texto significa aplanar cada página hasta convertirla otra vez en una imagen, que es el trabajo contrario, y aquí no hay nada que lo haga.
Las subidas y las descargas van por una conexión cifrada, el procesamiento ocurre en centros de datos certificados dentro de la Unión Europea y toda la cadena está automatizada, así que nadie lee tus documentos. Tus archivos nunca se usan para entrenar modelos de IA y conservas los derechos sobre ellos.
Digitaliza textos valiosos de documentos escaneados e imágenes con OCR (Reconocimiento Óptico de Caracteres). Extrae texto de imágenes fácilmente, en línea.
Read articleTodas estas funcionan en el navegador. Sin instalación, sin cuenta y con el mismo reconocimiento de texto detrás.