Converta PDF em texto no seu navegador e baixe um arquivo TXT simples. O reconhecimento de texto está disponível quando você precisa e desativado quando não precisar.
ou solte, cole ou escolha da nuvem
Converter um PDF em texto pode significar dois trabalhos diferentes, e este conversor permite que você escolha o que precisa. A maioria dos PDFs já contém caracteres reais, então o texto só precisa ser lido. Um PDF digitalizado contém imagens das páginas e, nesse caso, os caracteres precisam ser reconhecidos antes que qualquer coisa possa ser extraída.
O reconhecimento de texto vem desativado por padrão, e isso é intencional. Um PDF com uma camada de texto real é convertido mais rápido e com mais precisão sem OCR, porque as palavras são copiadas em vez de calculadas a partir de uma imagem. Ativar o reconhecimento quando o arquivo não precisa dele só pode reduzir a precisão.
Você consegue saber em um segundo que tipo de arquivo tem. Abra o PDF em qualquer leitor e arraste o cursor sobre uma linha. Se as palavras forem realçadas, deixe o OCR desligado. Se nada for realçado, ative o OCR e escolha o idioma do seu documento entre os 124 idiomas de origem compatíveis com o reconhecimento.
Extrair o texto de um PDF transforma uma página que você só pode olhar em palavras que você pode usar. O conversor grava tudo o que encontra em um arquivo de texto simples, para que você possa copiar uma citação, colar um parágrafo em um e-mail ou pesquisar todo o documento com o comando localizar em qualquer editor.
Isso cobre os trabalhos que as pessoas normalmente têm em mente: tirar referências de um artigo, extrair números de um relatório ou mover o conteúdo de um documento longo para uma ferramenta de escrita. Nada é redigitado e nada é transcrito à mão.
Vários PDFs podem ser enviados de uma vez. Cada arquivo é convertido separadamente e volta como seu próprio arquivo de texto, com a mesma configuração de OCR e o mesmo idioma aplicados a todos. Não é necessário criar conta nem informar endereço de e-mail.
A extensão .txt é usada para arquivos de texto simples. Esses arquivos contêm linhas de texto e podem ser abertos em vários editores de texto em diferentes plataformas e dispositivos. O texto não contém nenhuma formatação.
Esse é o motivo de converter de PDF para TXT em vez de para um formato de documento. O arquivo abre em qualquer computador e em qualquer celular, não precisa de licença para ser lido e continua legível muito depois de o programa que produziu o original ter sido substituído.
Extensão de arquivo: .txt, tipo MIME: text/plain
TXT na WikipediaUm arquivo de texto simples guarda palavras, não páginas. Veja o que sobrevive à conversão e o que não sobrevive.
| Do PDF | No arquivo TXT |
|---|---|
| Palavras e quebras de linha | Mantidos |
| Ordem de leitura | Mantida, de cima para baixo |
| Negrito, itálico e fontes | Descartados |
| Imagens, logotipos e gráficos | Descartados |
| Tabelas | Mantidas como texto, sem a grade |
| Páginas em várias colunas | Unidas em uma coluna |
| Cabeçalhos, rodapés e números de página | Gravados junto com o texto |
Um arquivo de texto simples carrega as palavras, não o layout. Quando a formatação importa tanto quanto o texto, o app de PDF para Word é a opção mais adequada.
As palavras em um PDF ficam presas ao layout da página. Estes são os casos em que extraí-las em texto simples economiza mais trabalho.
Artigos, relatórios e livros são compartilhados em PDF. Extraia o texto uma vez e cole os trechos de que precisa nas suas anotações em vez de digitá-los novamente.
Um arquivo de texto abre em qualquer editor, para que você possa ir direto a um nome, uma data ou um valor em vez de ler página após página.
Tradutores, ferramentas de escrita, leitores de tela e planilhas aceitam texto simples. TXT é o formato que praticamente todas elas aceitam sem precisar de um conversor.
Os PDFs que as pessoas convertem costumam ser contratos, faturas ou correspondência privada. Veja exatamente como os seus são tratados.
Todo upload e download ocorre por uma conexão criptografada, para que seus arquivos não possam ser lidos em trânsito.
O processamento acontece em data centers certificados dentro da União Europeia.
O reconhecimento de texto é totalmente automatizado. Ninguém lê suas digitalizações ou documentos, e nada é compartilhado com terceiros.
Envie seu PDF.
Ative o OCR se o PDF for uma digitalização. Deixe-o desligado quando o texto no arquivo já for selecionável.
Selecione o idioma do seu documento no menu (opcional).
Clique em "Iniciar" e aguarde a conclusão da conversão.
Sim. Converter um PDF em texto é gratuito, não exige conta e nenhum endereço de e-mail é solicitado. Envie o arquivo, inicie a conversão e baixe o texto. Um plano só faz diferença para arquivos muito grandes e lotes mais longos.
Envie o PDF acima, deixe o OCR desligado se o texto no arquivo já for selecionável e inicie a conversão. O resultado é um arquivo de texto simples que você pode baixar e abrir em qualquer editor. Nada precisa ser instalado.
Se as palavras forem realçadas quando você arrasta o cursor sobre elas, você pode copiá-las diretamente do seu leitor de PDF. Se não forem, a página é uma imagem e não há o que selecionar. Converter o PDF em texto resolve isso, porque o resultado é um arquivo de texto do qual você pode copiar livremente.
É exatamente isso que este conversor gera. TXT é o formato de texto simples, então o arquivo que você baixa tem a extensão .txt e o tipo de mídia text/plain. Ele abre no Bloco de Notas, TextEdit, qualquer editor de código e qualquer celular, sem software extra.
Porque a maioria dos PDFs não precisa dele. Um PDF com camada de texto real é convertido mais rápido e com mais precisão quando as palavras são copiadas em vez de reconhecidas a partir de uma imagem. Ative o OCR somente quando as páginas forem digitalizações ou fotos, e o seletor de idioma aparecerá junto com ele.
Sim, com o OCR ativado. O reconhecimento lê os caracteres nas imagens das páginas e os grava no arquivo de texto. Se a maior parte do que você converte são digitalizações, o app de PDF digitalizado para texto é o caminho mais direto para o mesmo resultado.
Ele reconhece 124 idiomas de origem. Além dos idiomas europeus, a lista inclui hindi, bengali, tâmil, urdu, árabe, tailandês, japonês, coreano e chinês, nas formas simplificada e tradicional. Escolha o idioma em que seu documento está escrito para obter o melhor resultado.
Sim. Adicione quantos PDFs precisar e eles serão convertidos em uma única execução, cada um retornado como seu próprio arquivo de texto, com as mesmas configurações de OCR e o mesmo idioma aplicados.
Digitalize textos valiosos de documentos escaneados e imagens com OCR (Reconhecimento Óptico de Caracteres). Extraia texto de imagens facilmente, online.
Ler artigoCada uma dessas ferramentas roda no navegador. Sem instalação, sem conta e com o mesmo reconhecimento de texto por trás.