Cum să faci OCR pe un PDF scanat pentru text editabil
Publicat pe 1 septembrie 2026 · 4 min de citit
Un document scanat — un formular fotocopiat, un contract tipărit pe care l-ai fotografiat, o chitanță — este de fapt doar o imagine ambalată într-un PDF. Nu există un strat de text de selectat sau căutat. Recunoașterea optică a caracterelor (OCR) citește pixelii și reconstruiește textul real, iar acest instrument face asta folosind Tesseract, un motor OCR matur, open-source, care rulează complet pe partea clientului prin WebAssembly, cu date antrenate găzduite propriu pentru 25 de limbi.
Încearcă OCR PDFPași
- 1
Deschide instrumentul OCR PDF
Accesează instrumentul OCR pentru PDF.
- 2
Încarcă PDF-ul tău scanat
Selectează PDF-ul (sau imaginea) din care vrei să extragi text.
- 3
Alege limba documentului și opțiunile
Alege limba în care este scris documentul, paginile de procesat cu OCR și modul de segmentare dacă documentul tău are un aspect neobișnuit (de exemplu, un formular dispersat).
- 4
Rulează OCR-ul
Instrumentul randează fiecare pagină și recunoaște textul de pe ea — durează câteva secunde pe pagină, deoarece OCR necesită într-adevăr mai multă muncă decât simpla extragere de text.
- 5
Copiază sau descarcă textul
Revizuiește textul extras, apoi copiază-l sau descarcă-l ca fișier .txt simplu.
Întrebări frecvente
Precizia depinde foarte mult de calitatea scanării — o scanare curată, de înaltă rezoluție, bine luminată a textului tipărit va produce un OCR foarte precis; o fotografie neclară a scrisului de mână nu va face asta. Acest instrument folosește motorul Tesseract bazat pe LSTM, ajustat pentru text tipărit.
25 de limbi, corespunzătoare fiecărei limbi disponibile pe acest site, fiecare cu propriul model antrenat găzduit propriu, descărcat doar când este selectat — nimic nu este trimis către un API OCR extern.
Da — OCR este semnificativ mai lent per pagină decât simpla extragere de text, așa că execuțiile sunt limitate la 50 de pagini, ca procesul să nu ruleze minute întregi în fila browserului tău. Împarte mai întâi un PDF mai mare dacă trebuie să faci OCR pe mai multe pagini.
Nu — dacă poți deja selecta text în vizualizatorul tău de PDF, folosește în schimb instrumentul mai rapid PDF în text. OCR este necesar doar când PDF-ul este esențialmente o imagine a textului, fără niciun strat de text dedesubt.
Deoarece modelul și motorul OCR sunt găzduite propriu și rulează într-un Web Worker, acest lucru funcționează chiar și pe documente scanate sensibile pe care nu ai vrea să le încarci către un API OCR extern.

