Da immagine a testo (OCR)

OCR online gratis: estrai il testo da immagini, screenshot, foto e PDF scansionati in 24 lingue. Funziona nel browser e non viene caricato nulla.

Puoi anche trascinare qui i file o incollare uno screenshot con Ctrl+V (⌘+V su Mac). Il testo viene riconosciuto dal tuo browser. I file non vengono inviati da nessuna parte: nessun caricamento, nessuna archiviazione.
Ogni lingua viene scaricata una sola volta (da 1 a 3 MB) e poi resta salvata nel browser. Aggiungi l'inglese come seconda lingua quando il testo contiene parole in alfabeto latino.

Che cosa fa


Questo strumento usa l'OCR (riconoscimento ottico dei caratteri) per trasformare il testo di un'immagine in testo che puoi copiare, modificare e cercare. Funziona con screenshot, foto di documenti, pagine scansionate e PDF composti solo da immagini. Il riconoscimento è svolto da Tesseract, un motore OCR open source che gira nel tuo browser, quindi i file non lasciano mai il tuo dispositivo. Il testo piccolo viene ingrandito automaticamente prima della lettura, il che riduce sensibilmente gli errori.

Come si usa


  1. Scegli una o più immagini o un PDF, trascinali qui o incolla uno screenshot.
  2. Controlla la lingua del testo. La lettura parte da sola; se cambi lingua, premi di nuovo Estrai testo.
  3. Rivedi il risultato, correggi ciò che è stato letto male, poi copialo o scaricalo come file .txt.

Domande frequenti


Le mie immagini vengono caricate?
No. Il motore di riconoscimento e i dati della lingua vengono scaricati nel browser, e le immagini e i PDF vengono elaborati lì. Nulla viene inviato a un server, quindi è sicuro usarlo con documenti privati.

Quanto è preciso?
Su un testo stampato nitido, le lingue in alfabeto latino superano di solito il 99% di caratteri corretti, mentre le altre scritture si attestano in genere tra il 93% e il 99%. La precisione cala con foto sfocate, poco contrasto, pagine curve, caratteri decorativi e scrittura a mano. Per il miglior risultato, usa un'immagine nitida, ben illuminata e dritta, e scegli la lingua giusta.

Quali lingue sono supportate?
24 lingue: inglese, portoghese, spagnolo, francese, tedesco, italiano, svedese, afrikaans, turco, indonesiano, malese, filippino, vietnamita, russo, arabo, urdu, hindi, tamil, thailandese, khmer, giapponese, coreano e cinese semplificato e tradizionale. Puoi combinare due lingue quando un testo le mescola.

Riesce a leggere la scrittura a mano?
Solo male. Il motore è addestrato su testo stampato: uno stampatello maiuscolo ordinato a volte funziona, ma il corsivo di solito esce sbagliato.

Funziona con i PDF scansionati?
Sì. Ogni pagina viene renderizzata ad alta risoluzione e letta a turno, e puoi segnare dove inizia ogni pagina. Se il PDF contiene già testo selezionabile, lo strumento Da PDF a testo è più veloce ed esatto.

Wikipedia — Optical character recognition
Wikipedia — Tesseract (software)