Extraia texto de documentos digitalizados ou fotografados.
ou solte, cole ou escolha da nuvem
Converter um documento digitalizado em texto significa uma coisa: tirar as palavras de uma página que é apenas uma imagem. Um scanner ou a câmera de um celular registra o papel como uma imagem plana, então as letras nela são pixels e não caracteres. Nada nesse arquivo pode ser selecionado, pesquisado ou corrigido até que a página seja lida e escrita como texto.
O que é OCR? O reconhecimento ótico de caracteres é usado para identificar letras, números ou caracteres especiais em um documento digitalizado ou imagem. Com um conversor de OCR, você pode extrair o texto desses arquivos para alterá-lo, editá-lo, imprimi-lo ou salvá-lo.
O que volta é um arquivo de texto simples. Ele guarda as palavras e as quebras de linha do documento, não o desenho da página. Para a maioria das tarefas é exatamente esse o ponto: você queria o texto da carta, os números do formulário ou o parágrafo que precisa responder.
A conversão de documento digitalizado em texto roda em mais de um arquivo por vez. Adicione todas as páginas de um relatório, ou uma pasta com cartas digitalizadas, e cada arquivo é convertido por conta própria e volta como seu próprio arquivo de texto. Sem conta, dá para enviar 10 digitalizações em um único envio.
Uma configuração decide o quanto o reconhecimento funciona bem, e ela é o idioma do documento. O inglês já vem selecionado, então uma página em inglês não precisa de nenhuma mudança. Para qualquer outro caso, escolha o idioma correspondente na lista de 124 antes de começar.
Fotografias de papel contam como digitalizações aqui. Abra esta página no celular, envie a imagem da galeria e o mesmo reconhecimento roda sobre ela. Se o celular salvou a página como PDF em vez de imagem, o app feito para digitalizações em PDF é o caminho melhor.
Converter PDF digitalizado para textoA extensão .txt é usada para arquivos de texto simples. Esses arquivos contêm linhas de texto e podem ser abertos em vários editores de texto em diferentes plataformas e dispositivos. O texto não contém nenhuma formatação.
Para um documento que começou em papel, o texto simples é o destino mais portátil possível. O arquivo é minúsculo, abre em qualquer computador ou celular sem licença, e as palavras entram em um e-mail, em um formulário ou em um tradutor sem arrastar junto a aparência da página original.
Extensão de arquivo: .txt, tipo MIME: text/plain
TXT na WikipediaO reconhecimento de texto só consegue ler o que a digitalização mostra a ele. Veja como saem os documentos que as pessoas mais enviam.
| O documento | Como foi capturado | O que sai |
|---|---|---|
| Uma página impressa a 300 dpi | Um scanner de escritório ou uma impressora multifuncional | Muito limpo. É o tipo de documento mais fácil de ler. |
| Um relatório de várias páginas | Uma digitalização por página, enviadas juntas | Cada página devolve seu próprio arquivo de texto, na ordem em que você as adicionou. |
| A foto de um documento | A câmera de um celular segurada sobre o papel | Bom, desde que a página esteja plana, preencha o enquadramento e não tenha sombra. |
| Um formulário ou uma tabela | Qualquer scanner ou câmera | As palavras saem, as colunas não. O texto simples não tem estrutura de tabela. |
| Uma página fraca, inclinada ou manuscrita | Uma cópia antiga, um papel colocado torto ou uma caneta | Pouco confiável. Este app não endireita a página, e a letra à mão não é aquilo para que o reconhecimento foi feito. |
Um documento digitalizado que é lido mal quase sempre tem um problema de captura. Digitalizar a mesma página de novo, plana e a 300 dpi, resolve mais resultados do que qualquer configuração desta página.
Estas são as tarefas que as pessoas mais trazem para este conversor.
Alguém enviou uma digitalização e você precisa do texto, não de uma imagem dele. Converta o documento digitalizado em texto e os parágrafos ficam prontos para colar em uma resposta, em um formulário ou em um relatório.
O reconhecimento cobre 124 idiomas de documento, então uma digitalização em indonésio, árabe, hindi ou japonês volta como texto que você cola direto em um tradutor ou em um campo de busca.
Digitalize a pilha, envie as imagens juntas e cada documento volta como seu próprio arquivo de texto. Nada é instalado e não é preciso conta para fazer isso.
Todo envio e todo download passam por uma conexão criptografada, então o documento não pode ser lido no caminho até o conversor nem na volta. O link do seu arquivo de texto pronto é gerado de forma aleatória e não dá para adivinhá-lo.
O reconhecimento de texto aqui é completamente automático. Ninguém lê, abre ou copia os documentos que você envia, nada é monitorado e seus arquivos nunca são usados para treinar modelos de IA.
A conversão roda em servidores localizados exclusivamente na Europa, operados sob um contrato de tratamento de dados. Só o seu endereço IP e a data e a hora são tratados junto com o arquivo, e apenas para evitar o uso indevido do serviço.
Os direitos autorais e a propriedade do documento digitalizado e do arquivo de texto que sai dele continuam sendo seus. Converter um arquivo aqui não entrega nada a ninguém.
Envie seu documento digitalizado.
Selecione o idioma do documento digitalizado no menu suspenso (opcional).
Clique em "Iniciar" e, após alguns instantes, faça o download do arquivo de texto convertido.
Sim. Converter um documento digitalizado em texto é grátis em todos os planos, não exige conta e não consome créditos. Envie a digitalização, clique em Iniciar e baixe o arquivo de texto. Um plano pago só aumenta o tamanho de arquivo e os limites de lote.
Envie o documento digitalizado acima, escolha o idioma em que ele está escrito e clique em Iniciar. O conversor lê a página e devolve um arquivo de texto simples que você abre, pesquisa e edita em qualquer editor. Não há nada para instalar.
Sim. Adicione 10 digitalizações em um único envio sem conta, e cada documento é convertido por conta própria e volta como seu próprio arquivo de texto. O idioma que você escolher vale para todos eles.
Uma digitalização em PDF é melhor tratada pelo app de PDF digitalizado para texto. Ele é construído em torno das páginas do PDF e deixa você escolher o motor de reconhecimento, o que faz diferença em um documento longo. Todo o resto funciona do mesmo jeito.
São 124 idiomas de documento, do inglês, do indonésio e do espanhol ao árabe, ao hindi, ao japonês e ao coreano. Escolha o que corresponde às palavras da página. O inglês vem pré-selecionado, então um documento em inglês não precisa de mudança.
Não, e é justamente para isso que serve um arquivo de texto. As palavras e as quebras de linha passam; colunas, tabelas, cabeçalhos e números de página não, porque o texto simples não tem página. Use o app de conversão para Word quando precisar do layout de volta.
Confira duas coisas. Primeiro, se o idioma selecionado corresponde ao documento. Segundo, a própria digitalização: uma página fraca, inclinada ou de baixa resolução perde caracteres, e este app não endireita nem limpa a página para você. Digitalizar de novo a 300 dpi resolve a maior parte.
Sim. Eles viajam por uma conexão criptografada e são processados automaticamente em servidores na União Europeia. Ninguém os lê nem os copia, eles nunca são usados para treinar modelos de IA e o link de download é aleatório, então não dá para adivinhá-lo.
Digitalize textos valiosos de documentos escaneados e imagens com OCR (Reconhecimento Óptico de Caracteres). Extraia texto de imagens facilmente, online.
Read articleTodos eles rodam no navegador, com o mesmo reconhecimento de texto por trás e sem nada para instalar.