PDF para Texto
Extraia o texto de um PDF online: copie-o ou descarregue-o em .txt, página a página, com linhas e parágrafos mantidos. Grátis e privado, nada é enviado.
O que faz
Esta ferramenta lê o texto de um PDF e devolve-o como texto simples, que pode copiar, editar ou guardar como ficheiro .txt. Linhas e parágrafos são reconstruídos a partir da posição das palavras na página, e as páginas podem ser marcadas para saber onde cada uma começa. Funciona com qualquer PDF que contenha texto verdadeiro, como documentos exportados de um processador de texto; páginas digitalizadas são imagens e não têm texto para extrair.
Como utilizar
- Escolha o PDF.
- Carregue em Extrair texto. Documentos longos demoram alguns segundos.
- Copie o texto ou descarregue-o como ficheiro .txt.
Perguntas frequentes
Porque é que não é encontrado texto no meu PDF?
Porque as páginas são imagens, como num documento digitalizado ou numa fotografia guardada como PDF. Nesse caso o PDF não tem texto lá dentro, só píxeis, e para o ler é preciso reconhecimento de carateres (OCR).
A paginação é mantida?
O texto mantém as linhas e os parágrafos, mas não os tipos de letra, as colunas nem as imagens. Em documentos com duas colunas, o texto de cada linha pode misturar ambas; as tabelas passam a linhas de texto com espaços entre as células.
O meu documento está seguro?
Sim. O PDF é lido pelo seu navegador e nunca é enviado para um servidor, por isso a ferramenta pode ser usada com documentos privados.
Funciona com qualquer língua?
Sim, desde que o PDF contenha texto verdadeiro e os tipos de letra mapeiem corretamente os carateres. Alguns PDFs antigos ou mal feitos mostram o texto correto no ecrã, mas dão carateres trocados quando o texto é extraído; é um problema do ficheiro, e só o OCR o consegue recuperar.