PDF para Texto

Extraia o texto de um PDF online: copie ou baixe como arquivo .txt, página por página, mantendo linhas e parágrafos. Grátis e privado, nada é enviado.

O arquivo é lido pelo seu navegador e não é enviado a lugar nenhum. Sem upload, sem armazenamento.

O que ela faz


Esta ferramenta lê o texto de um PDF e o devolve como texto simples, que você pode copiar, editar ou salvar como arquivo .txt. Linhas e parágrafos são reconstruídos a partir da posição das palavras na página, e as páginas podem ser marcadas para você saber onde cada uma começa. Funciona com qualquer PDF que contenha texto de verdade, como documentos exportados de um editor de texto; páginas digitalizadas são imagens e não têm texto para extrair.

Como usar


  1. Escolha o PDF.
  2. Clique em Extrair texto. Documentos longos levam alguns segundos.
  3. Copie o texto ou baixe-o como arquivo .txt.

Perguntas frequentes


Por que nenhum texto é encontrado no meu PDF?
Porque as páginas são imagens, como em um documento digitalizado ou uma foto salva como PDF. Nesse caso o PDF não tem texto dentro, só pixels, e para lê-lo é preciso reconhecimento de caracteres (OCR).

O layout é mantido?
O texto mantém linhas e parágrafos, mas não fontes, colunas ou imagens. Em documentos com duas colunas, o texto de cada linha pode misturar as duas colunas; tabelas viram linhas de texto com espaços entre as células.

Meu documento fica seguro?
Sim. O PDF é lido pelo seu navegador e nunca é enviado a um servidor, então a ferramenta pode ser usada com documentos privados.

Funciona com qualquer idioma?
Sim, desde que o PDF contenha texto de verdade e suas fontes mapeiem os caracteres corretamente. Alguns PDFs antigos ou malfeitos mostram o texto correto na tela, mas geram caracteres embaralhados ao extrair o texto; isso é um problema do arquivo, e só o OCR consegue recuperá-lo.

Wikipedia — PDF
Wikipedia — Optical character recognition