PDF a texto

Extrae el texto de un PDF en línea: cópialo o descárgalo como archivo .txt, página por página, conservando líneas y párrafos. Gratis y privado, no se sube nada.

El archivo lo lee tu navegador y no se envía a ninguna parte. Sin subida, sin almacenamiento.

Qué hace


Esta herramienta lee el texto de un PDF y te lo devuelve como texto plano que puedes copiar, editar o guardar como archivo .txt. Las líneas y los párrafos se reconstruyen a partir de la posición de las palabras en la página, y las páginas se pueden marcar para que sepas dónde empieza cada una. Funciona con cualquier PDF que contenga texto real, como documentos exportados desde un procesador de textos; las páginas escaneadas son imágenes y no tienen texto que extraer.

Cómo usarla


  1. Elige el PDF.
  2. Pulsa Extraer texto. Los documentos largos tardan unos segundos.
  3. Copia el texto o descárgalo como archivo .txt.

Preguntas frecuentes


¿Por qué no se encuentra texto en mi PDF?
Porque las páginas son imágenes, como en un documento escaneado o una foto guardada como PDF. En ese caso el PDF no tiene texto dentro, solo píxeles, y para leerlo hace falta reconocimiento de caracteres (OCR).

¿Se conserva el diseño?
El texto conserva sus líneas y párrafos, pero no las fuentes, las columnas ni las imágenes. En documentos a dos columnas, el texto de cada línea puede mezclar ambas columnas; las tablas se convierten en líneas de texto con espacios entre las celdas.

¿Mi documento está seguro?
Sí. El PDF lo lee tu navegador y nunca se envía a un servidor, así que puedes usar la herramienta con documentos privados.

¿Funciona con cualquier idioma?
Sí, siempre que el PDF contenga texto real y sus fuentes asignen bien los caracteres. Algunos PDF antiguos o mal hechos muestran el texto correcto en pantalla pero dan caracteres ilegibles al extraerlo; es un problema del archivo, y solo el OCR puede recuperarlo.

Wikipedia — PDF
Wikipedia — Optical character recognition