Da PDF a testo

Estrai il testo da un PDF online: copialo o scaricalo come file .txt, pagina per pagina, mantenendo righe e paragrafi. Gratis e privato, nessun caricamento.

Il file viene letto dal tuo browser e non viene inviato da nessuna parte. Nessun caricamento, nessuna archiviazione.

Che cosa fa


Questo strumento legge il testo di un PDF e te lo restituisce come testo semplice, che puoi copiare, modificare o salvare come file .txt. Righe e paragrafi vengono ricostruiti in base alla posizione delle parole sulla pagina, e le pagine possono essere segnate per sapere dove inizia ciascuna. Funziona con qualsiasi PDF che contenga testo vero, come i documenti esportati da un elaboratore di testi; le pagine scansionate sono immagini e non hanno testo da estrarre.

Come si usa


  1. Scegli il PDF.
  2. Premi Estrai testo. I documenti lunghi richiedono qualche secondo.
  3. Copia il testo o scaricalo come file .txt.

Domande frequenti


Perché nel mio PDF non viene trovato testo?
Perché le pagine sono immagini, come in un documento scansionato o in una foto salvata come PDF. In tal caso il PDF non contiene testo, solo pixel, e per leggerlo serve il riconoscimento dei caratteri (OCR).

Il layout viene mantenuto?
Il testo mantiene righe e paragrafi, ma non caratteri tipografici, colonne o immagini. Nei documenti a due colonne, il testo di ogni riga può mescolare entrambe le colonne; le tabelle diventano righe di testo con spazi tra le celle.

Il mio documento è al sicuro?
Sì. Il PDF viene letto dal tuo browser e non viene mai inviato a un server, quindi puoi usare lo strumento con documenti privati.

Funziona con qualsiasi lingua?
Sì, purché il PDF contenga testo vero e i suoi font associno correttamente i caratteri. Alcuni PDF vecchi o fatti male mostrano il testo corretto sullo schermo ma danno caratteri incomprensibili quando il testo viene estratto; è un problema del file, e solo l'OCR può recuperarlo.

Wikipedia — PDF
Wikipedia — Optical character recognition