Hogyan OCR-ezz egy szkennelt PDF-et szerkeszthető szöveghez
Közzétéve: 2026. szeptember 1. · 4 perces olvasás
Egy szkennelt dokumentum — egy fénymásolt űrlap, egy nyomtatott szerződés, amelyet lefotóztál, egy nyugta — valójában csak egy kép, PDF-be csomagolva. Nincs kijelölhető vagy kereshető szövegréteg. Az optikai karakterfelismerés (OCR) beolvassa a pixeleket, és rekonstruálja a tényleges szöveget, és ez az eszköz ezt a Tesseract segítségével teszi, egy érett, nyílt forráskódú OCR motorral, amely teljesen kliens oldalon fut WebAssembly-n keresztül, önhosztolt betanított adatokkal 25 nyelvhez.
OCR PDF kipróbálásaLépések
- 1
Nyisd meg a PDF OCR eszközt
Lépj a PDF OCR eszközre.
- 2
Töltsd fel a szkennelt PDF-edet
Válaszd ki a PDF-et (vagy képet), amelyből szöveget szeretnél kinyerni.
- 3
Válaszd ki a dokumentum nyelvét és a beállításokat
Válaszd ki, milyen nyelven íródott a dokumentum, mely oldalakat kell OCR-rel feldolgozni, és a szegmentálási módot, ha a dokumentumod szokatlan elrendezésű (pl. egy szétszórt űrlap).
- 4
Futtasd az OCR-t
Az eszköz megjeleníti minden oldalt, és felismeri rajta a szöveget — ez oldalanként néhány másodpercig tart, mivel az OCR valóban több munkát igényel, mint az egyszerű szövegkinyerés.
- 5
Másold vagy töltsd le a szöveget
Nézd át a kinyert szöveget, majd másold ki, vagy töltsd le egyszerű .txt fájlként.
Gyakran ismételt kérdések
A pontosság nagymértékben függ a szkennelés minőségétől — egy tiszta, nagy felbontású, jól megvilágított nyomtatott szöveg szkennelése nagyon pontos OCR-t eredményez; egy elmosódott fotó kézírásról nem. Ez az eszköz a Tesseract LSTM-alapú motorját használja, nyomtatott szöveghez hangolva.
25 nyelv, az oldalon elérhető minden nyelvnek megfelelően, mindegyik saját önhosztolt betanított modellel, amelyet csak kiválasztáskor tölt le — semmi nem kerül elküldésre egy külső OCR API-hoz.
Igen — az OCR jelentősen lassabb oldalanként, mint az egyszerű szövegkinyerés, így a futtatások 50 oldalra korlátozottak, hogy a folyamat ne fusson percekig a böngésző lapodon. Oszd fel előbb a nagyobb PDF-et, ha több oldalt kell OCR-eznie.
Nem — ha már ki tudsz jelölni szöveget a PDF nézegetődben, használd inkább a gyorsabb PDF–szöveg eszközt. Az OCR csak akkor szükséges, ha a PDF lényegében egy kép a szövegről, alatta semmilyen szövegréteg nélkül.
Mivel az OCR modell és motor önhosztolt, és egy Web Workerben fut, ez még érzékeny szkennelt dokumentumokon is működik, amelyeket nem szeretnél egy külső OCR API-ra feltölteni.

