PDF para texto

Extraia a camada de texto de um PDF para um arquivo .txt. PDFs digitalizados (só imagem) não geram texto.

Esta ferramenta não envia seus arquivos. Feche a aba e nada fica para trás.

Arraste e solte os arquivos aqui, ou

Escolher arquivos

Compatíveis: PDF · ou cole com Ctrl+V

Só o texto, sem a formatação

Tem tarefa em que o layout só atrapalha: colar o trecho de uma lei num e-mail, contar as palavras de um relatório, procurar um termo em vinte arquivos ou jogar o conteúdo numa planilha. O PDF tem o que você precisa, mas copiar página por página é lento e traz quebras de linha estranhas.

A extração devolve um arquivo .txt em UTF-8, então acentos e cedilha são preservados. A ordem de leitura depende de como o PDF foi gerado: em documento de duas colunas ou com notas na margem, as linhas podem sair embaralhadas e convém revisar. Tabelas, negrito e quebras de página não sobrevivem, porque texto puro não comporta formatação.

Em PDF digitalizado o resultado vem vazio: ali não há caracteres, há a imagem de caracteres. Esse caso é da ferramenta de OCR, que reconhece as letras e aí sim entrega texto. Tudo roda no navegador, sem upload e sem cópia guardada.

Como usar

  1. 1

    Selecione um PDF.

  2. 2

    Opcionalmente defina um intervalo de páginas.

  3. 3

    Clique em Iniciar e baixe o resultado.

Perguntas frequentes

O resultado está vazio.
PDFs digitalizados não têm camada de texto. Use a ferramenta de conversão com IA para eles.
As quebras de linha ficaram estranhas.
PDFs não guardam a estrutura de linhas; ela é inferida pelas posições. Layouts em várias colunas podem se misturar.

Ferramentas relacionadas