Come fare l'OCR di un PDF scansionato per ottenere testo modificabile

Pubblicato il 1 settembre 2026 · 4 min di lettura

Un documento scansionato — un modulo fotocopiato, un contratto stampato che hai fotografato, una ricevuta — in realtà è solo un'immagine avvolta in un PDF. Non c'è alcun livello di testo da selezionare o cercare. Il riconoscimento ottico dei caratteri (OCR) legge i pixel e ricostruisce il testo effettivo, e questo strumento lo fa con Tesseract, un motore OCR open source maturo, eseguito interamente lato client tramite WebAssembly, con dati addestrati self-hosted per 25 lingue.

Prova OCR PDF

Passaggi

  1. 1

    Apri lo strumento OCR PDF

    Vai allo strumento OCR per PDF.

  2. 2

    Carica il tuo PDF scansionato

    Scegli il PDF (o l'immagine) da cui vuoi estrarre il testo.

  3. 3

    Scegli lingua del documento e opzioni

    Seleziona la lingua in cui è scritto il documento, quali pagine elaborare con OCR, e una modalità di segmentazione se il tuo documento ha un layout insolito (come un modulo sparso).

  4. 4

    Esegui l'OCR

    Lo strumento renderizza ogni pagina e ne riconosce il testo — richiede alcuni secondi per pagina, poiché l'OCR richiede genuinamente più lavoro della semplice estrazione di testo.

  5. 5

    Copia o scarica il testo

    Rivedi il testo estratto, poi copialo o scaricalo come file .txt semplice.

Domande frequenti

Poiché il modello e il motore OCR sono self-hosted ed eseguiti in un Web Worker, questo funziona anche con documenti scansionati sensibili che non vorresti caricare su un'API OCR di terze parti.

← Torna al blog