Extrair texto de PDF (PDF → TXT)

Envie um PDF e a ferramenta extrai o texto do documento, página por página. Você pode copiar o resultado na hora ou salvá-lo como arquivo TXT.

📄 Arraste um arquivo PDF para cá ou clique para selecionar O texto é extraído assim que você seleciona o arquivo

Como usar: Extrair texto de PDF

  1. Selecione o arquivo PDF do qual você quer extrair o texto. A extração, página por página, começa assim que o arquivo é escolhido.
  2. Se você não precisa de separadores entre as páginas, como "----- 1ª página -----", desmarque a opção. A mudança aparece no resultado na hora.
  3. Na caixa de resultado, selecione e copie só o trecho de que precisa ou clique em Copiar tudo.
  4. Clique em Salvar como TXT para baixar um arquivo de texto UTF-8, que abre no Bloco de Notas ou em qualquer editor de texto.

Por que o PDF não deixa copiar o texto direito

Quando você seleciona e copia o texto num leitor de PDF, é comum as quebras de linha saírem bagunçadas, frases das duas colunas de um documento diagramado em colunas se misturarem ou aparecerem espaços estranhos entre as letras. Isso acontece porque o PDF só registra "qual caractere desenhar e em que posição", sem guardar a estrutura de frases e parágrafos.

Esta ferramenta lê as coordenadas de cada trecho de texto gravado no PDF, junta numa só linha os trechos que estão na mesma altura e, onde o espaçamento entre linhas é maior, entende que começou um novo parágrafo e insere uma linha em branco. Assim você obtém um texto mais fácil de ler do que ao copiar direto do leitor de PDF.

Quando não dá para extrair texto de um PDF digitalizado

Um PDF criado com scanner ou com a câmera do celular é, na prática, uma foto de cada página. Mesmo que você enxergue letras, o arquivo não contém informação de texto, por isso o resultado da extração fica vazio. Nesses casos é preciso um programa de OCR (reconhecimento óptico de caracteres), que identifica as letras dentro da imagem. Esta ferramenta não faz OCR.

Para saber se o documento é digitalizado, tente selecionar o texto no leitor de PDF. Se, em vez de selecionar palavras, ele seleciona a página inteira como um bloco, o PDF é feito de imagens.

Dicas para aproveitar o texto extraído

  • Ao citar relatórios, artigos científicos, TCCs ou documentos oficiais, você pode colar as frases direto, sem precisar digitar tudo de novo.
  • Se o resultado tiver quebras de linha no meio das frases, use a ferramenta Remover quebras de linha para juntar tudo num parágrafo só.
  • Precisa conferir o tamanho do texto? Cole o resultado no Contador de caracteres para ver o número de caracteres e de bytes.
  • Tabelas são extraídas como linhas de texto, sem divisão de células. Se a estrutura da tabela for importante, o ideal é conseguir o arquivo original (Excel, Word etc.).

Privacidade: o arquivo fica no seu dispositivo

Toda a leitura do PDF e a extração do texto acontecem dentro do seu navegador. O arquivo não é enviado para nenhum servidor, o que torna a ferramenta adequada até para contratos, recibos ou documentos pessoais. Você não precisa criar conta nem instalar nada.

Perguntas frequentes

O resultado da extração saiu vazio. O que aconteceu?
PDFs digitalizados ou criados a partir de fotos não têm informação de texto, então não há o que extrair. Nesse caso, use um programa com função de OCR.
Os acentos e caracteres especiais saíram errados. Por quê?
Alguns PDFs guardam as fontes de um jeito especial, e os códigos dos caracteres ficam diferentes das letras originais. Com documentos assim, é difícil obter o texto correto com qualquer ferramenta de extração.
Funciona com PDF protegido por senha?
PDFs com senha de abertura não podem ser lidos. Crie uma cópia sem a senha e use essa cópia.
O conteúdo extraído fica salvo em algum servidor?
Não. A análise do PDF e a extração do texto são feitas inteiramente no seu navegador, e nem o arquivo nem o resultado são enviados para lugar nenhum.
Preciso pagar ou criar conta?
Não. A ferramenta é gratuita e funciona sem cadastro, direto no navegador.

Última atualização: 2026-10-06