Taranmış Bir PDF Düzenlenebilir Metne Nasıl OCR'lanır
1 Eylül 2026 tarihinde yayınlandı · 4 dakikalık okuma
Taranmış bir belge — fotokopisi çekilmiş bir form, fotoğrafını çektiğiniz basılı bir sözleşme, bir makbuz — aslında yalnızca bir PDF içine sarılmış bir görseldir. Seçilecek veya aranacak bir metin katmanı yoktur. Optik karakter tanıma (OCR) pikselleri okur ve gerçek metni yeniden oluşturur ve bu araç bunu, WebAssembly aracılığıyla tamamen istemci tarafında çalışan, 25 dil için kendi kendine barındırılan eğitilmiş verilere sahip, olgun bir açık kaynaklı OCR motoru olan Tesseract ile yapar.
OCR PDF deneyinAdımlar
- 1
OCR PDF aracını açın
PDF için OCR aracına gidin.
- 2
Taranmış PDF'nizi yükleyin
Metnini çıkarmak istediğiniz PDF'yi (veya görseli) seçin.
- 3
Belge dilini ve seçenekleri seçin
Belgenin yazıldığı dili, OCR'ın hangi sayfalarda çalıştırılacağını ve belgenizin alışılmadık bir düzeni varsa (seyrek bir form gibi) bir bölümleme modunu seçin.
- 4
OCR'ı çalıştırın
Araç her sayfayı işler ve üzerindeki metni tanır — OCR gerçekten düz metin çıkarmaktan daha fazla iş gerektirdiğinden bu, sayfa başına birkaç saniye sürer.
- 5
Metni kopyalayın veya indirin
Çıkarılan metni gözden geçirin, ardından kopyalayın veya düz bir .txt dosyası olarak indirin.
Sıkça sorulan sorular
Doğruluk büyük ölçüde tarama kalitesine bağlıdır — basılı metnin temiz, yüksek çözünürlüklü, iyi aydınlatılmış bir taraması çok doğru bir OCR sağlar; bulanık bir el yazısı fotoğrafı ise sağlamaz. Bu araç, basılı metin için ayarlanmış, LSTM tabanlı Tesseract motorunu kullanır.
Bu sitenin mevcut olduğu her dile karşılık gelen 25 dil, her biri yalnızca siz seçtiğinizde indirilen kendi kendine barındırılan eğitilmiş bir modele sahip — üçüncü taraf bir OCR API'sine hiçbir şey gönderilmez.
Evet — OCR, sayfa başına normal metin çıkarmaktan çok daha yavaştır, bu nedenle işlemin tarayıcı sekmenizde uzun dakikalar boyunca çalışmasını önlemek için çalıştırmalar 50 sayfayla sınırlıdır. Daha fazla sayfayı OCR'lamanız gerekiyorsa önce daha büyük bir PDF'yi bölün.
Hayır — PDF görüntüleyicinizde zaten metin seçebiliyorsanız, bunun yerine daha hızlı PDF'den Metne aracını kullanın. OCR yalnızca PDF'nin esasen altında hiçbir metin katmanı olmayan bir metin görseli olduğu durumlarda gereklidir.
OCR modeli ve motoru kendi kendine barındırıldığından ve bir Web Worker'da çalıştığından, bu, üçüncü taraf bir OCR API'sine yüklemek istemeyeceğiniz hassas taranmış belgelerde bile çalışır.

