PDF para Texto

Extraia o texto de um PDF online: copie-o ou descarregue-o em .txt, página a página, com linhas e parágrafos mantidos. Grátis e privado, nada é enviado.

O ficheiro é lido pelo seu navegador e não é enviado para lado nenhum. Sem envio, sem armazenamento.

O que faz


Esta ferramenta lê o texto de um PDF e devolve-o como texto simples, que pode copiar, editar ou guardar como ficheiro .txt. Linhas e parágrafos são reconstruídos a partir da posição das palavras na página, e as páginas podem ser marcadas para saber onde cada uma começa. Funciona com qualquer PDF que contenha texto verdadeiro, como documentos exportados de um processador de texto; páginas digitalizadas são imagens e não têm texto para extrair.

Como utilizar


  1. Escolha o PDF.
  2. Carregue em Extrair texto. Documentos longos demoram alguns segundos.
  3. Copie o texto ou descarregue-o como ficheiro .txt.

Perguntas frequentes


Porque é que não é encontrado texto no meu PDF?
Porque as páginas são imagens, como num documento digitalizado ou numa fotografia guardada como PDF. Nesse caso o PDF não tem texto lá dentro, só píxeis, e para o ler é preciso reconhecimento de carateres (OCR).

A paginação é mantida?
O texto mantém as linhas e os parágrafos, mas não os tipos de letra, as colunas nem as imagens. Em documentos com duas colunas, o texto de cada linha pode misturar ambas; as tabelas passam a linhas de texto com espaços entre as células.

O meu documento está seguro?
Sim. O PDF é lido pelo seu navegador e nunca é enviado para um servidor, por isso a ferramenta pode ser usada com documentos privados.

Funciona com qualquer língua?
Sim, desde que o PDF contenha texto verdadeiro e os tipos de letra mapeiem corretamente os carateres. Alguns PDFs antigos ou mal feitos mostram o texto correto no ecrã, mas dão carateres trocados quando o texto é extraído; é um problema do ficheiro, e só o OCR o consegue recuperar.

Wikipedia — PDF
Wikipedia — Optical character recognition