Come fare l'OCR di un PDF scansionato per ottenere testo modificabile
Pubblicato il 1 settembre 2026 · 4 min di lettura
Un documento scansionato — un modulo fotocopiato, un contratto stampato che hai fotografato, una ricevuta — in realtà è solo un'immagine avvolta in un PDF. Non c'è alcun livello di testo da selezionare o cercare. Il riconoscimento ottico dei caratteri (OCR) legge i pixel e ricostruisce il testo effettivo, e questo strumento lo fa con Tesseract, un motore OCR open source maturo, eseguito interamente lato client tramite WebAssembly, con dati addestrati self-hosted per 25 lingue.
Prova OCR PDFPassaggi
- 1
Apri lo strumento OCR PDF
Vai allo strumento OCR per PDF.
- 2
Carica il tuo PDF scansionato
Scegli il PDF (o l'immagine) da cui vuoi estrarre il testo.
- 3
Scegli lingua del documento e opzioni
Seleziona la lingua in cui è scritto il documento, quali pagine elaborare con OCR, e una modalità di segmentazione se il tuo documento ha un layout insolito (come un modulo sparso).
- 4
Esegui l'OCR
Lo strumento renderizza ogni pagina e ne riconosce il testo — richiede alcuni secondi per pagina, poiché l'OCR richiede genuinamente più lavoro della semplice estrazione di testo.
- 5
Copia o scarica il testo
Rivedi il testo estratto, poi copialo o scaricalo come file .txt semplice.
Domande frequenti
L'accuratezza dipende molto dalla qualità della scansione — una scansione pulita, ad alta risoluzione e ben illuminata di testo stampato avrà un OCR molto accurato; una foto sfocata di scrittura a mano no. Questo strumento usa il motore Tesseract basato su LSTM, ottimizzato per testo stampato.
25 lingue, corrispondenti a ogni lingua in cui è disponibile questo sito, ciascuna con il proprio modello addestrato self-hosted scaricato solo quando lo selezioni — nulla viene inviato a un'API OCR di terze parti.
Sì — l'OCR è molto più lento per pagina rispetto alla normale estrazione di testo, quindi le esecuzioni sono limitate a 50 pagine per evitare che il processo giri per molti minuti nella tua scheda del browser. Dividi prima un PDF più grande se devi fare l'OCR di più pagine.
No — se riesci già a selezionare il testo nel tuo visualizzatore PDF, usa invece lo strumento più veloce PDF a Testo. L'OCR serve solo quando il PDF è essenzialmente un'immagine di testo, senza alcun livello di testo sottostante.
Poiché il modello e il motore OCR sono self-hosted ed eseguiti in un Web Worker, questo funziona anche con documenti scansionati sensibili che non vorresti caricare su un'API OCR di terze parti.

