Taranmış Bir PDF Düzenlenebilir Metne Nasıl OCR'lanır

1 Eylül 2026 tarihinde yayınlandı · 4 dakikalık okuma

Taranmış bir belge — fotokopisi çekilmiş bir form, fotoğrafını çektiğiniz basılı bir sözleşme, bir makbuz — aslında yalnızca bir PDF içine sarılmış bir görseldir. Seçilecek veya aranacak bir metin katmanı yoktur. Optik karakter tanıma (OCR) pikselleri okur ve gerçek metni yeniden oluşturur ve bu araç bunu, WebAssembly aracılığıyla tamamen istemci tarafında çalışan, 25 dil için kendi kendine barındırılan eğitilmiş verilere sahip, olgun bir açık kaynaklı OCR motoru olan Tesseract ile yapar.

OCR PDF deneyin

Adımlar

  1. 1

    OCR PDF aracını açın

    PDF için OCR aracına gidin.

  2. 2

    Taranmış PDF'nizi yükleyin

    Metnini çıkarmak istediğiniz PDF'yi (veya görseli) seçin.

  3. 3

    Belge dilini ve seçenekleri seçin

    Belgenin yazıldığı dili, OCR'ın hangi sayfalarda çalıştırılacağını ve belgenizin alışılmadık bir düzeni varsa (seyrek bir form gibi) bir bölümleme modunu seçin.

  4. 4

    OCR'ı çalıştırın

    Araç her sayfayı işler ve üzerindeki metni tanır — OCR gerçekten düz metin çıkarmaktan daha fazla iş gerektirdiğinden bu, sayfa başına birkaç saniye sürer.

  5. 5

    Metni kopyalayın veya indirin

    Çıkarılan metni gözden geçirin, ardından kopyalayın veya düz bir .txt dosyası olarak indirin.

Sıkça sorulan sorular

OCR modeli ve motoru kendi kendine barındırıldığından ve bir Web Worker'da çalıştığından, bu, üçüncü taraf bir OCR API'sine yüklemek istemeyeceğiniz hassas taranmış belgelerde bile çalışır.

← Bloga dön