OCR على الجهاز: نص قابل للبحث من كل صفحة ممسوحة

Last updated: 2026-09-02

OCR (التعرف البصري على الأحرف) يحول الصفحة الممسوحة إلى نص يمكن تحديده ونسخه والبحث فيه. يقوم Paper Scan بتشغيل OCR بالكامل على الجهاز باستخدام حزم ML من Apple و Google, لذا لا يتم إرسال أي محتوى مسح إلى خوادم خارجية للتعرف. يتم فهرسة الصفحات المعترف بها في المكتبة المحلية وتصبح قابلة للبحث في لحظة حفظها.

ما يفتحه OCR

بمجرد التعرف على الصفحة:

لماذا المعالجة على الجهاز مهمة

الدقة مماثلة لخدمات OCR المستندة إلى الخادم؛ الفرق هو مكان تشغيل الحساب.

أفضل الممارسات للتعرف الدقيق

تعتمد دقة OCR بشكل أساسي على جودة المدخلات. ثلاثة عوامل، حسب الأهمية:

  1. الإضاءة. свет غير مباشر متساوٍ من نافذة يعمل بشكل أفضل من بقعة واحدة علوية. الظلال التي تعبر الصفحة هي السبب الأكثر شيوعاً لقراءة الأحرف بشكل خاطئ.
  2. اختيار المرشح. يعطي الأسود والأبيض أنظف نص للنماذج المطبوعة. يوصى باللون السحري عندما تتلاشى الحبر أو تصفر الورقة. يتعامل التلقائي مع معظم الحالات اليومية.
  3. الصفحات المسطحة. تفقد الصفحات المنحنية نحو التجليد الأحرف بالقرب من الحافة الداخلية. اضغط على الصفحة مسطحة باليد الأخرى حيث أمكن.
  4. تلميح اللغة. اضبط لغة OCR بشكل صريح للصفحات أحادية اللغة. تعمل صفحات البرامج النصية المختلطة في مرور واحد دون تلميح.

قيود الدقة

يؤدي OCR أداءً جيداً على النص المطبوع (دقة 95%+) ولكنه أقل موثوقية للخط اليدوي المتصل والخطوط الصغيرة جداً والخطوط الزخرفية المنمطة وانعكاسات المجلات اللامعة والإيصالات القديمة حيث تلاشى الحبر جسدياً. تظل الصورة الأصلية متاحة في جميع الحالات: إذا فشل OCR في صفحة حرجة، يمكن قراءة المسح نفسه.

تتضمن الطبقة المجانية حصة OCR يومية تكفي للإيصالات اليومية وبطاقات الأعمال وفصول الكتب العرضية. تزيل Pro الحد اليومي وتضيف القدرة على OCR مجلد بأكمله في عملية واحدة.

يدعم المحرك الموجود على الجهاز البرامج النصية اللاتينية (الإنجليزية والفرنسية والألمانية والإسبانية والبرتغالية والإيطالية وغيرها)، والصينية (المبسطة والتقليدية)، واليابانية، والكورية، ومعظم البرامج النصية الأوروبية. يتم处理 صفحات البرامج النصية المختلجة في مرور تعرف واحد.