Da immagine a testo (OCR)
OCR online gratis: estrai il testo da immagini, screenshot, foto e PDF scansionati in 24 lingue. Funziona nel browser e non viene caricato nulla.
Che cosa fa
Questo strumento usa l'OCR (riconoscimento ottico dei caratteri) per trasformare il testo di un'immagine in testo che puoi copiare, modificare e cercare. Funziona con screenshot, foto di documenti, pagine scansionate e PDF composti solo da immagini. Il riconoscimento è svolto da Tesseract, un motore OCR open source che gira nel tuo browser, quindi i file non lasciano mai il tuo dispositivo. Il testo piccolo viene ingrandito automaticamente prima della lettura, il che riduce sensibilmente gli errori.
Come si usa
- Scegli una o più immagini o un PDF, trascinali qui o incolla uno screenshot.
- Controlla la lingua del testo. La lettura parte da sola; se cambi lingua, premi di nuovo Estrai testo.
- Rivedi il risultato, correggi ciò che è stato letto male, poi copialo o scaricalo come file .txt.
Domande frequenti
Le mie immagini vengono caricate?
No. Il motore di riconoscimento e i dati della lingua vengono scaricati nel browser, e le immagini e i PDF vengono elaborati lì. Nulla viene inviato a un server, quindi è sicuro usarlo con documenti privati.
Quanto è preciso?
Su un testo stampato nitido, le lingue in alfabeto latino superano di solito il 99% di caratteri corretti, mentre le altre scritture si attestano in genere tra il 93% e il 99%. La precisione cala con foto sfocate, poco contrasto, pagine curve, caratteri decorativi e scrittura a mano. Per il miglior risultato, usa un'immagine nitida, ben illuminata e dritta, e scegli la lingua giusta.
Quali lingue sono supportate?
24 lingue: inglese, portoghese, spagnolo, francese, tedesco, italiano, svedese, afrikaans, turco, indonesiano, malese, filippino, vietnamita, russo, arabo, urdu, hindi, tamil, thailandese, khmer, giapponese, coreano e cinese semplificato e tradizionale. Puoi combinare due lingue quando un testo le mescola.
Riesce a leggere la scrittura a mano?
Solo male. Il motore è addestrato su testo stampato: uno stampatello maiuscolo ordinato a volte funziona, ma il corsivo di solito esce sbagliato.
Funziona con i PDF scansionati?
Sì. Ogni pagina viene renderizzata ad alta risoluzione e letta a turno, e puoi segnare dove inizia ogni pagina. Se il PDF contiene già testo selezionabile, lo strumento Da PDF a testo è più veloce ed esatto.
Wikipedia — Optical character recognition
Wikipedia — Tesseract (software)