OCR لملفات PDF: اجعل PDF الممسوح قابلًا للبحث

استورد ملف PDF ممسوحًا ضوئيًا: تُقرأ كل صفحة بتقنية التعرف الضوئي على الحروف، ويُضاف النص المُكتشف بشكل غير مرئي تحت الصورة. بعدها يمكنك البحث عن كلمة وتحديد النص ونسخه، دون أن يتغير شكل المستند.

  • مجاني
  • 15 لغة
  • الصورة الأصلية كما هي
  • معالجة على جهازك

أفلِت ملف PDF الممسوح هنا

ملف PDF لصفحات ممسوحة ضوئيًا (ماسح، تطبيق كاميرا…)

اختيار

خصوصية 100% — تتم معالجة كل شيء مباشرة داخل متصفحك: ملفاتك وصوتك وصورتك لا تُرسل أبدًا إلى خوادم Chatzam.

كيف تطبّق OCR على ملف PDF؟

  1. استورد ملف PDF الممسوح

    تحدد الأداة فورًا الصفحات التي ليست سوى صور، والصفحات التي تحتوي على نص أصلًا.

  2. اختر اللغات

    العربية مقترحة افتراضيًا؛ أضف الإنجليزية أو الفرنسية أو لغة أخرى إذا كان المستند يمزج بين عدة لغات.

  3. نزّل ملف PDF القابل للبحث

    تابع التقدم صفحةً صفحة، ثم احصل على ملف PDF، وعند الحاجة على النص الخام بصيغة ‎.txt.

ملف ممسوح يعمل كأنه PDF حقيقي

نص غير مرئي بدقة الكلمة

توضع كل كلمة مُتعرَّف عليها فوق صورتها تمامًا: فيقع البحث والتحديد في المكان الصحيح.

دون أي فقدان في الجودة

لا يُعاد ضغط صور الصفحات ولا يتغير حجمها؛ ولا تُعدَّل الصفحات التي تحتوي على نص أصلًا.

تقويم الصفحات المائلة

تُكتشف الصفحة الممسوحة بشكل أفقي أو مقلوب وتُعاد إلى وضعها الصحيح قبل القراءة.

عدة لغات في آن واحد

حتى 5 لغات من بين 15، منها العربية والإنجليزية والفرنسية والإسبانية والألمانية والتركية.

ما هو OCR لملف PDF؟

ملف PDF الناتج عن ماسح ضوئي أو تطبيق مسح لا يحتوي إلا على صور للصفحات: أنت ترى كلمات، لكن البرنامج لا يرى إلا بكسلات. فلا يمكنك عندها البحث عن اسم باستخدام Ctrl+F، ولا نسخ فقرة، ولا جعل برنامج قراءة صوتية يقرأ المستند. تقنية OCR، أي التعرف الضوئي على الحروف، تحلل الصورة وتستخرج الحروف الموجودة فيها. ثم تضع هذه الأداة ذلك النص داخل ملف PDF على هيئة طبقة غير مرئية محاذية لكل كلمة. يحتفظ المستند بمظهره تمامًا، لكنه يصبح قابلًا للبحث والتحديد والفهرسة، مثل ملف PDF أُنشئ مباشرة من برنامج معالجة نصوص.

كيف تحصل على أفضل نتيجة؟

تعتمد جودة التعرف أولًا على جودة المسح. فالمسح بدقة 300 نقطة في البوصة، بإضاءة جيدة، بالأبيض والأسود أو بتدرج الرمادي، يعطي نتائج ممتازة مع النصوص المطبوعة. تُقرأ الصفحات بدقة 300 نقطة في البوصة تقريبًا، مما يترك هامشًا حتى مع مسح أخف. حدّد جميع اللغات الموجودة: لنشرة ثنائية اللغة بالعربية والإنجليزية، أضف اللغتين، وإلا فستُتعرَّف الكلمات الأجنبية بشكل أقل دقة. يبقى الخط اليدوي والأختام والنص على خلفية مزدحمة جدًا أمرًا صعبًا. وبعد OCR، أجرِ اختبارًا: ابحث عن كلمة نادرة في المستند للتأكد من العثور عليها.

تبقى مستنداتك على جهازك

كثيرًا ما تحتوي ملفات PDF الممسوحة على أوراق حساسة: بطاقات هوية، وقسائم رواتب، وعقود، ووصفات طبية. هنا يُفتح الملف ويُقرأ مباشرة داخل متصفحك، ولا يُرسل أبدًا إلى أي خادم. لا يُنزَّل سوى نماذج اللغات، ببضعة ميغابايتات لكل لغة، عند الاستخدام الأول، ثم يحتفظ بها المتصفح في ذاكرته المؤقتة. تستغرق المعالجة من بضع ثوانٍ إلى نحو عشرين ثانية لكل صفحة حسب قوة الجهاز، ويمكنك إلغاؤها في أي وقت. وبعد أن يصبح ملف PDF قابلًا للبحث، يمكنك ضغطه أو تحويله إلى Word أو استخراج نصه باستخدام أدوات PDF الأخرى.

الأسئلة الشائعة

كيف أجعل ملف PDF الممسوح قابلًا للتعديل؟

تضيف تقنية OCR النص المُتعرَّف عليه إلى ملف PDF: فيمكنك عندها البحث فيه وتحديده ونسخه. ولإعادة العمل على المحتوى، حوّل ملف PDF القابل للبحث بعد ذلك باستخدام «تحويل PDF إلى Word» أو صدّر النص بصيغة ‎.txt.

هل يُرفع ملف PDF إلى خادم؟

لا. يُقرأ ملف PDF ويُعالَج بالكامل داخل متصفحك. لا تُنزَّل إلا نماذج اللغات في المرة الأولى، ثم تُحفظ في الذاكرة المؤقتة.

هل يصبح ملف PDF الناتج أثقل أو أقل جودة؟

تُحفظ الصور الأصلية كما هي، دون إعادة ضغط. ولا يزداد حجم الملف إلا بحجم النص المضاف، وهو عادةً بضع عشرات من الكيلوبايتات.

ماذا يحدث للصفحات التي تحتوي على نص أصلًا؟

تُكتشف وتُترك كما هي. ولا تمر بالتعرف الضوئي على الحروف إلا الصفحات التي ليست سوى صور.

هل تتعرف الأداة على الخط اليدوي؟

صُممت للنصوص المطبوعة أو المكتوبة بالآلة الكاتبة. قد يُتعرَّف جزئيًا على خط يدوي مرتب جدًا، لكن النتيجة غير موثوقة.

أدوات مجانية أخرى

عرض جميع الأدوات المجانية →