كيفية استخدام التعرف الضوئي على الحروف (OCR) لتحويل PDF ممسوح ضوئيًا إلى نص قابل للتحرير

نُشر في 1 سبتمبر 2026 · 4 دقيقة قراءة

المستند الممسوح ضوئيًا — نموذج مصوَّر، عقد مطبوع صوّرته، إيصال — هو في الحقيقة مجرد صورة ملفوفة داخل PDF. لا توجد طبقة نصية للتحديد أو البحث. يقرأ التعرف الضوئي على الحروف (OCR) وحدات البكسل ويعيد بناء النص الفعلي، وتقوم هذه الأداة بذلك باستخدام Tesseract، محرك OCR ناضج مفتوح المصدر، يعمل بالكامل من جهة العميل عبر WebAssembly، مع بيانات مدرَّبة مستضافة ذاتيًا لـ 25 لغة.

جرّب OCR PDF

الخطوات

  1. 1

    افتح أداة OCR لملفات PDF

    انتقل إلى أداة OCR لملفات PDF.

  2. 2

    ارفع ملف PDF الممسوح ضوئيًا

    اختر ملف PDF (أو الصورة) الذي تريد استخراج النص منه.

  3. 3

    اختر لغة المستند والخيارات

    حدد اللغة التي كُتب بها المستند، والصفحات المراد معالجتها بـ OCR، ووضع تجزئة إذا كان تخطيط مستندك غير معتاد (مثل نموذج متناثر).

  4. 4

    شغّل OCR

    تعرض الأداة كل صفحة وتتعرف على النص فيها — يستغرق ذلك بضع ثوانٍ لكل صفحة، لأن OCR يتطلب فعليًا عملًا أكثر من مجرد استخراج النص.

  5. 5

    انسخ أو نزّل النص

    راجع النص المستخرج، ثم انسخه أو نزّله كملف .txt عادي.

الأسئلة الشائعة

بما أن نموذج ومحرك OCR مستضافان ذاتيًا ويعملان في Web Worker، فإن هذا يعمل حتى مع المستندات الممسوحة ضوئيًا الحساسة التي لا ترغب في رفعها إلى واجهة برمجة تطبيقات OCR تابعة لجهة خارجية.

← العودة إلى المدونة