PDF a texto
Extrae el texto de un PDF en línea: cópialo o descárgalo como archivo .txt, página por página, conservando líneas y párrafos. Gratis y privado, no se sube nada.
Qué hace
Esta herramienta lee el texto de un PDF y te lo devuelve como texto plano que puedes copiar, editar o guardar como archivo .txt. Las líneas y los párrafos se reconstruyen a partir de la posición de las palabras en la página, y las páginas se pueden marcar para que sepas dónde empieza cada una. Funciona con cualquier PDF que contenga texto real, como documentos exportados desde un procesador de textos; las páginas escaneadas son imágenes y no tienen texto que extraer.
Cómo usarla
- Elige el PDF.
- Pulsa Extraer texto. Los documentos largos tardan unos segundos.
- Copia el texto o descárgalo como archivo .txt.
Preguntas frecuentes
¿Por qué no se encuentra texto en mi PDF?
Porque las páginas son imágenes, como en un documento escaneado o una foto guardada como PDF. En ese caso el PDF no tiene texto dentro, solo píxeles, y para leerlo hace falta reconocimiento de caracteres (OCR).
¿Se conserva el diseño?
El texto conserva sus líneas y párrafos, pero no las fuentes, las columnas ni las imágenes. En documentos a dos columnas, el texto de cada línea puede mezclar ambas columnas; las tablas se convierten en líneas de texto con espacios entre las celdas.
¿Mi documento está seguro?
Sí. El PDF lo lee tu navegador y nunca se envía a un servidor, así que puedes usar la herramienta con documentos privados.
¿Funciona con cualquier idioma?
Sí, siempre que el PDF contenga texto real y sus fuentes asignen bien los caracteres. Algunos PDF antiguos o mal hechos muestran el texto correcto en pantalla pero dan caracteres ilegibles al extraerlo; es un problema del archivo, y solo el OCR puede recuperarlo.