Extrair texto de um PDF

Seu arquivo fica no seu dispositivo — nada é enviado.

Como funciona

O PDF para texto puxa a camada de texto do documento e devolve tudo como texto simples, pronto para colar num editor, num tradutor ou num script. O resultado é texto puro: as quebras de linha são reconstruídas a partir de onde as palavras estão na página, mas colunas, tabelas, fontes e formatação não são preservadas. Se não sair nada, é porque o PDF não tem camada de texto nenhuma — ele é uma digitalização ou um conjunto de imagens de páginas, e transformar isso em palavras exige o reconhecimento de texto (OCR). A extração acontece inteiramente no seu navegador, então nem o PDF nem o texto são enviados para um servidor.

  1. Arraste um PDF para a página.
  2. Clique em “Extrair texto” — as páginas são lidas uma a uma e o contador mostra o andamento.
  3. Leia a prévia. Documentos longos são cortados na tela, mas o arquivo baixado sempre tem o texto completo.
  4. Copie o texto direto para a área de transferência ou baixe um arquivo .txt comum, em UTF-8, em que cada página é separada por uma linha em branco.