Extrae texto de documentos escaneados o fotografiados.
o arrastra, pega o elige desde la nube
Documento escaneado a texto significa una cosa: sacar las palabras de una página que es solo una imagen. Un escáner o la cámara de un teléfono registra el papel como una imagen plana, así que las letras son píxeles y no caracteres. Nada de ese archivo se puede seleccionar, buscar o corregir hasta que la página se haya leído y convertido en texto.
¿Qué es OCR? El reconocimiento óptico de caracteres se utiliza para identificar letras, números o caracteres especiales en un documento escaneado o una imagen. Con un convertidor OCR, puedes extraer el texto de estos archivos para cambiarlo, editarlo, imprimirlo o guardarlo.
Lo que obtienes es un archivo de texto sin formato. Contiene las palabras y los saltos de línea del documento, no el diseño de la página. Para la mayoría de los trabajos ese es precisamente el objetivo: necesitabas el texto de la carta, las cifras del formulario o el párrafo al que tienes que responder.
La conversión de documento escaneado a texto se ejecuta en más de un archivo a la vez. Añade todas las páginas de un informe o una carpeta de cartas escaneadas, y cada archivo se convierte por separado y se devuelve como su propio archivo de texto. Sin una cuenta puedes enviar 10 escaneos en una sola subida.
Un solo ajuste determina qué tan bien funciona el reconocimiento, y es el idioma del documento. El inglés ya está seleccionado, así que una página en inglés no necesita ningún cambio. Para cualquier otro idioma, elige el que corresponda en la lista de 124 antes de empezar.
Aquí las fotografías de documentos cuentan como escaneos. Abre esta página en un teléfono, sube la foto desde la galería y se ejecutará el mismo reconocimiento. Si el teléfono guardó la página como PDF en lugar de imagen, es mejor usar la app pensada para escaneos en PDF.
Convertir PDF escaneado a textoLa extensión de archivo .txt se usa para archivos de texto sin formato. Estos archivos contienen líneas de texto y se pueden abrir en muchos editores de texto en diferentes plataformas y dispositivos. El texto no contiene ningún formato.
Para un documento que empezó en papel, el texto sin formato es la forma más fácil de reutilizarlo. El archivo es muy pequeño, se abre en cualquier ordenador o teléfono sin licencia, y las palabras se pueden pegar en un correo, un formulario o una herramienta de traducción sin arrastrar el aspecto de la página original.
Extensión de archivo: .txt, tipo MIME: text/plain
TXT en WikipediaEl reconocimiento de texto solo puede leer lo que le muestra el escaneo. Así es cómo suelen salir los documentos que la gente sube con más frecuencia.
| El documento | Cómo se capturó | Qué se obtiene |
|---|---|---|
| Una página impresa a 300 dpi | Un escáner de oficina o una impresora multifunción | Muy limpio. Es el tipo de documento más fácil de leer. |
| Un informe de varias páginas | Un escaneo por página, subidas juntas | Cada página devuelve su propio archivo de texto, en el orden en que las añadiste. |
| Una foto de un documento | La cámara de un teléfono sobre el papel | Buena, siempre que la página esté plana, llene el encuadre y no tenga sombras. |
| Un formulario o una tabla | Cualquier escáner o cámara | Las palabras se extraen, las columnas no. El texto sin formato no tiene estructura de tabla. |
| Una página tenue, torcida o manuscrita | Una copia antigua, un alimentador torcido o un bolígrafo | Poco fiable. Esta app no endereza la página y el reconocimiento no está pensado para escritura a mano. |
Un documento escaneado que se lee mal casi siempre tiene un problema de captura. Volver a escanear la misma página, plana y a 300 dpi, mejora más resultados que cualquier ajuste de esta página.
Estos son los trabajos que la gente trae a este conversor con más frecuencia.
Alguien ha enviado un escaneo y necesitas el texto, no una imagen. Convierte el documento escaneado a texto y los párrafos estarán listos para pegarlos en una respuesta, un formulario o un informe.
El reconocimiento cubre 124 idiomas de documentos, así que un escaneo en indonesio, árabe, hindi o japonés vuelve como texto que puedes pegar directamente en un traductor o en un cuadro de búsqueda.
Escanea el montón, sube las imágenes juntas y cada documento volverá como su propio archivo de texto. No se instala nada y no necesitas una cuenta para hacerlo.
Cada subida y cada descarga se realizan a través de una conexión cifrada, para que el documento no pueda leerse ni de camino al conversor ni de vuelta. El enlace a tu archivo de texto final se genera de forma aleatoria y no se puede adivinar.
El reconocimiento de texto aquí está completamente automatizado. Nadie lee, abre ni copia los documentos que envías, nada se supervisa y tus archivos nunca se usan para entrenar modelos de IA.
La conversión se ejecuta en servidores ubicados exclusivamente en Europa, operados bajo un contrato de procesamiento de datos. Solo se tratan tu dirección IP y la fecha y hora junto con el archivo, y únicamente para evitar usos indebidos del servicio.
Conservas los derechos de autor y la propiedad del documento escaneado y del archivo de texto que se genera. Convertir un archivo aquí no cede nada a nadie.
Sube tu documento escaneado.
Selecciona el idioma del documento escaneado en el menú desplegable (opcional).
Haz clic en "Start" y, tras una breve espera, descarga tu archivo de texto convertido.
Sí. Convertir un documento escaneado a texto es gratis en todos los planes, no requiere cuenta y no consume créditos. Sube el escaneo, haz clic en Start y descarga el archivo de texto. Un plan de pago solo aumenta el tamaño máximo de archivo y los límites por lote.
Sube el documento escaneado arriba, elige el idioma en el que está escrito y luego haz clic en Start. El conversor lee la página y devuelve un archivo de texto plano que puedes abrir, buscar y editar en cualquier editor. No tienes que instalar nada.
Sí. Añade 10 escaneos en una sola subida sin cuenta, y cada documento se convierte por separado y se descarga como su propio archivo de texto. El idioma que elijas se aplica a todos.
Un PDF escaneado se gestiona mejor con la aplicación de PDF escaneado a texto. Está diseñada en torno a páginas PDF y te permite elegir el motor de reconocimiento, lo que marca la diferencia en un documento largo. Todo lo demás funciona igual.
124 idiomas de documentos, desde inglés, indonesio y español hasta árabe, hindi, japonés y coreano. Elige el que coincida con las palabras de la página. Inglés está preseleccionado, así que un documento en inglés no requiere cambios.
No, y para eso sirve un archivo de texto. Se conservan las palabras y los saltos de línea; las columnas, tablas, encabezados y números de página no, porque el texto plano no tiene páginas. Usa la aplicación de convertir a Word cuando necesites recuperar el diseño.
Comprueba dos cosas. Primero, que el idioma seleccionado coincide con el del documento. Segundo, el propio escaneo: una página tenue, inclinada o con baja resolución pierde caracteres, y esta aplicación no endereza ni limpia la página por ti. Volver a escanear a 300 dpi soluciona la mayoría de los problemas.
Sí. Viajan mediante una conexión cifrada y se procesan automáticamente en servidores de la Unión Europea. Nadie los lee ni los copia, nunca se usan para entrenar modelos de IA y el enlace de descarga es aleatorio, por lo que no se puede adivinar.
Digitaliza textos valiosos de documentos escaneados e imágenes con OCR (Reconocimiento Óptico de Caracteres). Extrae texto de imágenes fácilmente, en línea.
Leer artículoTodas estas herramientas se ejecutan en el navegador, con el mismo reconocimiento de texto detrás y sin necesidad de instalar nada.