Hoe voer je OCR uit op een gescande PDF om bewerkbare tekst te krijgen
Gepubliceerd op 1 september 2026 · 4 min leestijd
Een gescand document — een gefotokopieerd formulier, een afgedrukt contract dat je hebt gefotografeerd, een bonnetje — is eigenlijk gewoon een afbeelding verpakt in een PDF. Er is geen tekstlaag om te selecteren of doorzoeken. Optische tekenherkenning (OCR) leest de pixels en reconstrueert de daadwerkelijke tekst, en deze tool doet dat met Tesseract, een volwassen opensource-OCR-engine, volledig clientside uitgevoerd via WebAssembly, met zelf gehoste getrainde gegevens voor 25 talen.
Probeer OCR PDFStappen
- 1
Open de tool OCR PDF
Ga naar de OCR-tool voor PDF.
- 2
Upload je gescande PDF
Kies de PDF (of afbeelding) waar je tekst uit wilt halen.
- 3
Kies de documenttaal en opties
Selecteer de taal waarin het document is geschreven, welke pagina's met OCR moeten worden verwerkt, en een segmentatiemodus als je document een ongebruikelijke lay-out heeft (zoals een spaarzaam formulier).
- 4
Voer OCR uit
De tool rendert elke pagina en herkent de tekst erop — dit duurt enkele seconden per pagina, omdat OCR echt meer werk vergt dan gewone tekstextractie.
- 5
Kopieer of download de tekst
Controleer de geëxtraheerde tekst, en kopieer die of download hem als een plat .txt-bestand.
Veelgestelde vragen
De nauwkeurigheid hangt sterk af van de scankwaliteit — een schone, hoge-resolutie, goed belichte scan van gedrukte tekst geeft zeer nauwkeurige OCR; een wazige foto van handschrift niet. Deze tool gebruikt de op LSTM gebaseerde Tesseract-engine, afgestemd op gedrukte tekst.
25 talen, overeenkomend met elke taal waarin deze site beschikbaar is, elk met een eigen zelf gehost getraind model dat alleen wordt gedownload wanneer je het selecteert — er wordt niets naar een OCR-API van derden gestuurd.
Ja — OCR is per pagina veel langzamer dan gewone tekstextractie, dus runs zijn beperkt tot 50 pagina's om te voorkomen dat het proces vele minuten in je browsertabblad draait. Splits eerst een grotere PDF als je meer pagina's moet OCR'en.
Nee — als je al tekst kunt selecteren in je PDF-viewer, gebruik dan de snellere tool PDF naar tekst. OCR is alleen nodig wanneer de PDF in wezen een afbeelding van tekst is, zonder onderliggende tekstlaag.
Omdat het OCR-model en de engine zelf gehost worden en in een Web Worker draaien, werkt dit zelfs bij gevoelige gescande documenten die je niet naar een OCR-API van derden zou willen uploaden.

