<link rel="stylesheet" href="/assets/fonts/jetbrains-mono/jetbrains-mono.css" />
All posts

OCR: come estrarre testo da scansioni e foto (e perché a volte sbaglia)

Ricevi un PDF, lo apri, provi a cercare una parola: zero risultati. Provi a selezionare una riga con il mouse: non si seleziona. Il documento c'è, si legge benissimo con gli occhi, ma per il computer è una fotografia. È la situazione in cui serve l'OCR — il riconoscimento ottico dei caratteri — e il momento in cui la maggior parte delle persone scopre che il risultato dipende molto più dall'immagine di partenza che dal software.

Cosa fa davvero l'OCR (e perché non "legge")

Un motore OCR non capisce il testo: lo ricostruisce. Il processo passa da fasi meccaniche — individuare le zone di testo, raddrizzare l'immagine, isolare le singole righe, poi le parole, poi i caratteri — e solo alla fine confronta ogni forma con i modelli di lettere che conosce, scegliendo la più probabile.

Questo spiega gli errori tipici, che a prima vista sembrano assurdi: rn letto come m, 0 confuso con O, 1 con l. Non sono errori di comprensione, sono errori di somiglianza visiva. Un umano li corregge automaticamente grazie al contesto; il motore OCR, che ragiona sulla forma prima che sul senso, no.

La qualità dell'immagine conta più del software

È la parte controintuitiva: cambiare motore OCR migliora poco, migliorare la scansione migliora moltissimo. I fattori che pesano davvero, in ordine di impatto:

FattoreProblemaRimedio
RisoluzioneSotto i 200 DPI i caratteri piccoli si impastanoScansionare a 300 DPI, lo standard di fatto
ContrastoCarta ingiallita o foto in penombra: lettere e sfondo si confondonoBianco e nero o aumento del contrasto prima dell'elaborazione
InclinazioneRighe storte: il motore sbaglia a segmentarleRaddrizzare l'immagine, anche di pochi gradi
Ombre e curvaturaFoto di un libro aperto: il testo si deforma verso la piegaFotografare con luce diffusa, pagina appiattita

Una foto scattata al volo con il telefono, storta e con l'ombra della mano sopra, produce risultati mediocri con qualsiasi motore. Vale la pena rifare l'acquisizione: lo scanner da fotocamera applica raddrizzamento, ritaglio e filtri di contrasto prima ancora che il file arrivi al riconoscimento, ed è quasi sempre la differenza tra un testo usabile e uno da riscrivere a mano.

Il punteggio di affidabilità: il dato più utile e più ignorato

Ogni pagina elaborata riceve un valore di confidenza, cioè quanto il motore ritiene attendibile la propria lettura. È l'informazione più preziosa dell'intero processo e quasi nessuno la guarda.

La regola pratica: sopra il 90% il testo è generalmente affidabile e va solo riletto; tra il 70% e il 90% ci sono errori sparsi da correggere; sotto il 70% conviene rifare l'acquisizione invece di perdere tempo a correggere. Un punteggio basso su una sola pagina di venti indica quasi sempre un problema fisico di quella pagina — una piega, un'ombra, una macchia — non un limite del sistema.

Come estrarre il testo, passo per passo

  1. Apri l'OCR online gratuito — nessuna registrazione.
  2. Carica i file: immagini PNG, JPG, WEBP, BMP, TIFF oppure PDF, anche scansionati. Fino a 15 MB per file e 30 file per volta.
  3. Seleziona la lingua giusta prima di avviare. È il passaggio che incide di più sulla precisione: sono disponibili italiano, inglese, spagnolo, francese, tedesco, portoghese e albanese.
  4. Avvia il riconoscimento e controlla il punteggio di affidabilità pagina per pagina.
  5. Copia il testo, oppure mandalo al workspace per passarlo a un altro strumento — tipicamente un riassunto o una traduzione — senza ricaricare nulla.

Dove l'OCR sbaglia in modo sistematico

  • La lingua sbagliata rovina tutto. Un testo italiano elaborato come inglese perde accenti e apostrofi in modo sistematico, perché il motore cerca forme che in italiano non esistono.
  • Le tabelle diventano testo lineare. Le celle vengono lette una dopo l'altra: i valori ci sono, la relazione riga-colonna no.
  • Le colonne multiple si mescolano. Su giornali e riviste il testo può essere ricostruito attraversando le colonne anziché seguendole.
  • Il corsivo e i font decorativi hanno tassi di errore molto più alti di un carattere tipografico regolare.
  • La scrittura a mano è un'altra tecnologia. L'OCR classico riconosce caratteri stampati; il manoscritto richiede modelli diversi e resta poco affidabile.

Domande frequenti

Quali formati posso caricare?

Immagini in PNG, JPG, WEBP, BMP e TIFF, oltre ai PDF, compresi quelli scansionati che non contengono testo selezionabile. Il limite è di 15 MB per file, fino a 30 file per elaborazione.

Quali lingue riconosce?

Sette: italiano, inglese, spagnolo, francese, tedesco, portoghese e albanese. La lingua va scelta prima dell'elaborazione, perché guida il motore nel riconoscere caratteri accentati e combinazioni tipiche di quella lingua.

Come faccio a sapere se un PDF ha bisogno di OCR?

Prova a selezionare una parola con il mouse o a cercare un termine con Ctrl+F. Se la selezione non funziona e la ricerca non trova nulla anche su parole visibilmente presenti, il PDF contiene immagini e serve l'OCR.

Posso usare l'OCR su una foto scattata con il telefono?

Sì, ed è uno degli usi più comuni. Il risultato migliora sensibilmente se la pagina è inquadrata dritta, ben illuminata e senza ombre: passare prima dallo scanner, che raddrizza e aumenta il contrasto, dà quasi sempre un testo più pulito.


In sintesi

L'OCR trasforma un'immagine di testo in testo vero, ed è il prerequisito di quasi tutto il resto: cercare dentro un documento, tradurlo, riassumerlo, convertirlo. La precisione dipende soprattutto da tre cose, in quest'ordine: qualità dell'acquisizione, lingua selezionata correttamente, e controllo del punteggio di affidabilità prima di fidarsi del risultato. L'OCR gratuito online accetta immagini e PDF fino a 15 MB in sette lingue; se il documento è ancora su carta conviene partire dallo scanner, e da lì il testo può proseguire verso gli altri strumenti PDF e AI.

💬 Note dei lettori

0 note

Scrivi una nota

Condividi la tua opinione, un suggerimento o un complimento

Ultime note

Nessuna nota ancora. Sii il primo a commentare!