Cum să faci OCR pe un PDF scanat pentru text editabil

Publicat pe 1 septembrie 2026 · 4 min de citit

Un document scanat — un formular fotocopiat, un contract tipărit pe care l-ai fotografiat, o chitanță — este de fapt doar o imagine ambalată într-un PDF. Nu există un strat de text de selectat sau căutat. Recunoașterea optică a caracterelor (OCR) citește pixelii și reconstruiește textul real, iar acest instrument face asta folosind Tesseract, un motor OCR matur, open-source, care rulează complet pe partea clientului prin WebAssembly, cu date antrenate găzduite propriu pentru 25 de limbi.

Încearcă OCR PDF

Pași

  1. 1

    Deschide instrumentul OCR PDF

    Accesează instrumentul OCR pentru PDF.

  2. 2

    Încarcă PDF-ul tău scanat

    Selectează PDF-ul (sau imaginea) din care vrei să extragi text.

  3. 3

    Alege limba documentului și opțiunile

    Alege limba în care este scris documentul, paginile de procesat cu OCR și modul de segmentare dacă documentul tău are un aspect neobișnuit (de exemplu, un formular dispersat).

  4. 4

    Rulează OCR-ul

    Instrumentul randează fiecare pagină și recunoaște textul de pe ea — durează câteva secunde pe pagină, deoarece OCR necesită într-adevăr mai multă muncă decât simpla extragere de text.

  5. 5

    Copiază sau descarcă textul

    Revizuiește textul extras, apoi copiază-l sau descarcă-l ca fișier .txt simplu.

Întrebări frecvente

Deoarece modelul și motorul OCR sunt găzduite propriu și rulează într-un Web Worker, acest lucru funcționează chiar și pe documente scanate sensibile pe care nu ai vrea să le încarci către un API OCR extern.

← Înapoi la blog