PDF para texto
Extraia a camada de texto de um PDF para um arquivo .txt. PDFs digitalizados (só imagem) não geram texto.
Esta ferramenta não envia seus arquivos. Feche a aba e nada fica para trás.
Arraste e solte os arquivos aqui, ou
Escolher arquivosCompatíveis: PDF · ou cole com Ctrl+V
Só o texto, sem a formatação
Tem tarefa em que o layout só atrapalha: colar o trecho de uma lei num e-mail, contar as palavras de um relatório, procurar um termo em vinte arquivos ou jogar o conteúdo numa planilha. O PDF tem o que você precisa, mas copiar página por página é lento e traz quebras de linha estranhas.
A extração devolve um arquivo .txt em UTF-8, então acentos e cedilha são preservados. A ordem de leitura depende de como o PDF foi gerado: em documento de duas colunas ou com notas na margem, as linhas podem sair embaralhadas e convém revisar. Tabelas, negrito e quebras de página não sobrevivem, porque texto puro não comporta formatação.
Em PDF digitalizado o resultado vem vazio: ali não há caracteres, há a imagem de caracteres. Esse caso é da ferramenta de OCR, que reconhece as letras e aí sim entrega texto. Tudo roda no navegador, sem upload e sem cópia guardada.
Como usar
- 1
Selecione um PDF.
- 2
Opcionalmente defina um intervalo de páginas.
- 3
Clique em Iniciar e baixe o resultado.
Perguntas frequentes
- O resultado está vazio.
- PDFs digitalizados não têm camada de texto. Use a ferramenta de conversão com IA para eles.
- As quebras de linha ficaram estranhas.
- PDFs não guardam a estrutura de linhas; ela é inferida pelas posições. Layouts em várias colunas podem se misturar.