Ready File Tools
الفئاتالمساعدةEnglish

المسح والنصوص

استخراج النص العربي من PDF ممسوح ضوئيًا

جرّب مستندًا عربيًا ممسوحًا، وقارن النص المستخرج وصححه قبل التنزيل.

Ready File Toolsآخر تحديث: 15 سبتمبر 2026

وجدتها مفيدة؟ شاركها.

شارك هذه الصفحة مع من يحتاجها. لا تتضمن المشاركة ملفاتك.

اختر التعرف الضوئي للصفحة الممسوحة

قد يُظهر PDF الممسوح كتابة عربية واضحة، مع أنه يحتوي على صورة للصفحة فقط. جرّب تحديد كلمة في عارض PDF. إذا لم تجد نصًا قابلًا للتحديد، فاستخدم قراءة مستند ممسوح في محرر PDF. تستخرج أداة PDF إلى نص طبقة النص الموجودة؛ ولا تتعرف على الكلمات داخل الصور.

يستخدم الدليل مسحًا عربيًا تجريبيًا واضحًا من صفحة واحدة. يحتوي على جمل عادية ورقم طلب ومبلغ، دون معلومات شخصية. لا توجد فيه طبقة نص، لذا يناسب تجربة التعرف الضوئي.

تعرّف على النص صفحةً صفحة

  1. افتح ملف PDF. استخدم محرر PDF واختر الملف الممسوح. يدعم المحرر ملفات حتى 25 ميجابايت و50 صفحة. حدد الصفحة التي تريد قراءتها.
  2. افتح قراءة مستند ممسوح. في لوحة النص، اضبط «لغة المستند» على «العربية» لهذا المثال. اختر «English + العربية» إذا كانت الصفحة نفسها تتضمن اللغتين. تغيير لغة الواجهة وحده لا يحدد لغة التعرف الضوئي.
  3. اضغط التعرف على هذه الصفحة. انتظر اكتمال المعالجة. يتعرف هذا الأمر على الصفحة الحالية، وليس جميع صفحات المستند. لمعالجة صفحة أخرى، حددها وشغّل التعرف مجددًا.
  4. افتح النص المستخرج. افتح «مراجعة النص المتعرف عليه وتنزيله». قارن النص بالمسح وصحح الأخطاء في مربع النص. ثم اختر «تنزيل النص (.txt)». احفظ نص كل صفحة قبل الانتقال إلى غيرها.

تؤثر التعديلات في مربع النص المستخرج على تنزيل TXT فقط. لا تغيّر ملف PDF ولا تضيف إليه طبقة نص قابلة للبحث. تعديل الكلمات على صفحة PDF إجراء منفصل في المحرر.

ما الذي أظهره المثال العربي؟

استعاد اختبار التعرف الجمل، لكنه أخطأ في رقم الطلب والمبلغ. قد تبدو هذه الحقول معقولة عند القراءة السريعة مع أنها خاطئة. قارن كل رقم بالأصل، بما في ذلك الأرقام العربية مثل ١ و٢ و٣.

مقارنة نتيجة الاختبار الفعلية بالمسح
النص المتعرف عليه: يحتاج إلى تصحيحالنص الصحيح في المسح
رقم الطلب: ١!!1“60رقم الطلب: ١٢٣٤٥
المبلغ: 70٠ ريالالمبلغ: ٢٥٠ ريال

استخدم النص المرجعي التالي لمراجعة المثال كاملًا:

ملاحظات المشروع هذا مستند تجريبي لقراءة النص العربي. اختر اللغة العربية قبل بدء التعرف على النص. راجع الكلمات والأرقام بعد انتهاء المعالجة. رقم الطلب: ١٢٣٤٥ المبلغ: ٢٥٠ ريال احفظ النص بعد مراجعته.
المسح العربي من سبعة أسطر، ويظهر رقم الطلب ١٢٣٤٥ والمبلغ ٢٥٠ ريال
ارجع إلى PDF الأصلي عند مراجعة العلامات الصغيرة والأرقام.
كيف فُحص مثال التعرف الضوئي؟

أُجري الاختبار في 15 سبتمبر 2026 باستخدام نموذج العربية الخاص بالموقع وملفات محرك Tesseract 7 نفسها، مع التعرف بالعربية فقط ومقياس الرسم المستخدم في المحرر. هذا اختبار محلي للمحرك. قد تختلف فواصل الأسطر وعلامات الترقيم والأخطاء في متصفحك؛ ولا تضمن النتيجة دقة ثابتة.

راجع النتيجة وحسّنها

راجع الأسماء وأرقام الطلبات والمبالغ والتواريخ وعلامات الترقيم وترتيب الأسطر. قارن النقاط فوق الحروف العربية وتحتها، وانتبه إلى المسافات المفقودة أو الزائدة. إذا جمعت الصفحة العربية والإنجليزية، فراجع أيضًا ترتيب الكلمات اللاتينية والأرقام.

إذا استُخرج نص قليل، فجرّب مسحًا أوضح ومستقيمًا بإضاءة متساوية وحواف كاملة. قد تحتاج الجداول الكثيفة والأعمدة والتباين المنخفض والكتابة اليدوية إلى تصحيح يدوي كبير. قبل الصفحة التالية، احفظ TXT المصحح ثم كرر خطوات التعرف.

احتفظ بالمسح إلى جانب النص المصحح. يحتوي ملف TXT على نص عادي؛ ولا يحفظ تخطيط الصفحة الأصلي أو الصور أو تنسيق الجداول.

افتح محرر PDF ←