يحتوي ملف PDF الممسوح ضوئياً على صور لصفحات، وليس نصاً فعلياً — لا يمكنك البحث فيه أو تحديد النص أو نسخه. يقرأ OCR (التعرف الضوئي على الحروف) الصورة ويضيف طبقة نص خفية خلفها، محوّلاً المسح الضوئي إلى مستند قابل للبحث الكامل والتحديد والتحرير.
كيف تعرف إذا كان ملف PDF الخاص بك بحاجة لـOCR
جرّب هذا الاختبار البسيط: افتح ملف PDF واضغط Ctrl+F (أو Cmd+F) وابحث عن كلمة تعرف أنها موجودة في المستند. إذا لم تظهر أي نتائج، أو إذا لم تتمكن من تحديد النص بالسحب، فملفك يحتاج OCR.
كيفية تشغيل OCR باستخدام PDFlexa
Reduce your PDF file size instantly. No software needed.
- اذهب إلى OCR PDF
- ارفع ملف PDF الممسوح ضوئياً
- اختر لغة المستند (يحسّن هذا دقة التعرف)
- اضغط تشغيل OCR
- حمّل ملف PDF الناتج — يبدو مطابقاً بصرياً، لكنه الآن قابل للبحث والتحديد
يعالج OCR كل صفحة، يتعرف على الأحرف، ويُضمّن طبقة نص خفية بالضبط تحت النص المرئي. تبقى الصورة المرئية دون تغيير؛ فقط تُضاف القدرة على البحث والتحديد.
لماذا تحتاج OCR
- البحث داخل مستندات كبيرة — اعثر على أي كلمة أو عبارة فوراً بدلاً من التصفح يدوياً
- نسخ ولصق النص — استخرج اقتباسات أو فقرات دون إعادة الكتابة
- إتاحة الوصول — تعتمد قارئات الشاشة للمكفوفين على النص الفعلي، وليس الصور
- التحويل إلى تنسيقات قابلة للتحرير — تحتاج تحويلات PDF إلى Word/Excel نصاً حقيقياً لتعمل بدقة
- الأرشفة والامتثال — العديد من المتطلبات القانونية والتنظيمية تتطلب مستندات قابلة للبحث
دقة OCR: ما يؤثر على النتائج
Turn any PDF into an editable Word document in seconds.
| العامل | التأثير |
|---|---|
| دقة المسح | 300 نقطة في البوصة أو أعلى تعطي أفضل الدقة؛ أقل من 150 قد ينتج أخطاء |
| جودة الصورة الأصلية | المسوحات الواضحة والمستقيمة تتفوق على المائلة أو الباهتة أو المشوَّشة |
| نوع الخط | الخطوط المطبوعة القياسية تُقرَأ بدقة أعلى بكثير من الخط اليدوي |
| اللغة | اللغات الشائعة (الإنجليزية، الإسبانية، الفرنسية، الألمانية، العربية) تعطي أفضل النتائج؛ اللهجات النادرة أقل دقة |
| التباين | نص أسود واضح على خلفية بيضاء يعمل بشكل أفضل من النص الملون أو الخلفيات المتدرجة |
تشغيل OCR على مستندات متعددة اللغات
إذا كان مستندك يحتوي على أكثر من لغة (مثلاً عقد بالإنجليزية والعربية معاً):
- حدد اللغة الأساسية للمستند في إعدادات OCR
- تدعم بعض محركات OCR الكشف متعدد اللغات تلقائياً
- إذا كانت الدقة ضعيفة على أقسام بلغة ثانوية، فكّر بمعالجة تلك الصفحات بشكل منفصل بإعداد اللغة الصحيح، ثم دمج النتائج باستخدام دمج PDF
OCR للخط اليدوي
دقة OCR للخط اليدوي أقل بكثير من النص المطبوع — تتراوح عادة بين 60-85% حسب وضوح الخط، مقارنة بـ99%+ للنص المطبوع. بالنسبة للمستندات المكتوبة بخط اليد بشكل كبير، توقع الحاجة لمراجعة يدوية وتصحيح للنص المستخرج.
ماذا يحدث بعد تشغيل OCR
بمجرد إضافة طبقة النص، يمكنك:
- البحث والتحديد والنسخ مباشرة من عارض PDF
- تحويل بدقة أعلى إلى Word أو Excel
- استخدام تلخيص PDF بالذكاء الاصطناعي أو الدردشة مع PDF، اللذين يحتاجان نصاً فعلياً للعمل
- ترجمة المحتوى بدقة أعلى بكثير
الأسئلة الشائعة
هل يغيّر OCR مظهر ملف PDF الأصلي؟ لا — يبقى المظهر المرئي مطابقاً تماماً. يضيف OCR طبقة نص غير مرئية خلف الصورة الموجودة؛ لا يوجد تغيير مرئي على الإطلاق.
كم يستغرق تشغيل OCR على مستند من 100 صفحة؟ عادة بضع دقائق، حسب دقة المسح وتعقيد التخطيط. الصفحات ذات النص الكثيف تستغرق وقتاً أطول قليلاً من الصفحات المتناثرة.
هل يمكن لـOCR التعامل مع جداول ورسوم بيانية؟ يتعرف OCR على النص داخل الجداول بدقة جيدة، لكن قد لا يحافظ بشكل مثالي على بنية الأعمدة والصفوف عند التصدير. للحصول على جداول قابلة للتحرير بدقة عالية، استخدم PDF إلى Excel بعد OCR.
هل OCR مجاني؟ تقدم أدوات مثل PDFlexa OCR مجاناً ضمن حد استخدام يومي؛ المعالجة عالية الحجم أو المستمرة قد تتطلب خطة مدفوعة.
ماذا لو كان مسحي الضوئي مائلاً أو ملتوياً؟ تصحح معظم محركات OCR الحديثة الميل الطفيف تلقائياً أثناء المعالجة. بالنسبة للميل الشديد، فكّر بإعادة مسح المستند مستقيماً للحصول على أفضل دقة.
هل يمكنني تشغيل OCR على ملف PDF يحتوي بالفعل على بعض النص القابل للبحث؟ نعم — يتعامل OCR بأمان مع الصفحات المختلطة، حيث تحتوي بعض الصفحات نصاً حقيقياً بالفعل وأخرى صوراً ممسوحة ضوئياً فقط. تُضاف طبقة النص فقط حيث تكون مفقودة.