11

مشروع للتعرف الضوئي على المحارف العربية OCR...

  • fitha

أنا وزملاء آخرين في صدد تنفيذ مشروع تخرج هندسة ميكاترونكس, والمشروع هو آلة لقراءة البطاقات الشخصية واستخلاص المعلومات منها بدون قاعدة بيانات أي بدون استخدام الكود أو الرقم الخاص بكل بطاقة.

بما أن البطاقة الشخصية لها قالب محدد وخط واحد (Times New Roman في حالتنا) فهذا يسهل الأمور, ولكن العقبة الحقيقية هي تقطيع الحروف من الكلمات لمعالجة كل حرف على حداً, فكل حرف لديه عرض مختلف عن الآخر وقد يؤدي الاقتطاع الخاطئ إلى استنتاجات خاطئة, ومن غير الممكن تدريب الشبكة العصبية (أو أيّاً كانت طريقة الاستنتاج) على كلمات كاملة.

ما زال المشروع قيد التهيئة ولكن عملية اقتطاع الأحرف هي الأصعب والأكثر عرقلة للأمور حتى الآن...

فهل من اقتراحات لخوارمية قد تساعد في ذلك؟؟؟

سأقوم بنشر المشروع عند اكتماله لتعم الفائدة وخصوصاً أن مجال التعرف الضوئي على المحارف العربية لا ينال ما يستحقه من اهتمام من قبل المطورين العرب.

وشكرا

يرجى الدخول لحسابك أو تسجيل حساب لتستطيع إضافة تعليق
حساب جديد دخول

التعليقات

السلام عليكم. مشروع طموح ماشالله.

مستعد لمساعدتكم حيث أني أعمل في هذا الميدان هنا في فرنسا في مجال التعرف الضوئي. يمكني الجزم أن التعرف على الكتابة العربية من أصعب التحديات.

لي اسئلة:

هل من يقوم بتحليل الصور كمبيوتر أو معالج مثل arduino أو raspberryPI ؟

بالتوفيق

شكرا جزيلا زميل هشام...

معالجة الصورة على الكمبيوتر بينما التحكم بالآلية يتم عن طريق PIC موصولة بالكمبيوتر أيضاً.

نستخدم بيئة Microsoft Visual Studio 2010 بلغة C# وباستخدام مكتبة Aforge.NET من أجل الشبكة العصبية وبعص فلترات معالجة الصورة.

لاقتطاع الأحرف من الصورة سنجرب استخدام إطار متغيّر العرض للاقتصاص من الكلمة على مراحل, يتغيّر عرض الإطار عند عدم التعرف على حرف, ويتغير مكانه عند التعرف على حرف, وهكذا حتى يتم مسح الكلمة كلها. لم يتسنى لنا بعد تجربة هذه الطريقة ولكن من المتوقع حدوث نتائج خاطئة.

بحسب معرفتك في هذا المجال, هل تعرف أي طرق قد تساعدنا باقتصاص الأحرف أو حتى التعرف عليها دون اقتصاص؟

ذكر لي أحدهم أن معالجة الصورة في المجال الترددي مفيدة جداً للتعرّف على الأحرف ولكن لم يخطر لنا أي فائدة محتملة لهذه العملية فهل لديك علم بشيء مماثل؟

وشكراً سلفاً...

الطريقة المعتمدة عندنا تكون قائمة على تغذية الشبكة العصبية بسلسلة من الصور المقتطفة من الكلمة من اليمين إلى اليسار دون الأخذ بالاعتبار اقتصاص الحروف. حسب ما توصلنا إليه أنه لا يمكن إنشاء محرك للتعرف الضوئي عام يمكن إستعماله على جميع الصور بل يجب اعتماد قالب أو قوالب محددة.

عذراً ولكن لم أفهم تماماً ما الذي تقصده.

هل بإمكانك أن تشرح لي ما هي مداخل ومخارج الشبكة العصبية التي تتكلم عنها؟

وشكراً...

هنا تجد جميع المعلومات :