استكشاف كيفية عمل تطبيقات الرؤية الحاسوبية
تعمق معنا في تطبيقات الرؤية الحاسوبية. سنستعرض أيضاً مهام الرؤية الحاسوبية المختلفة مثل الكشف عن الكائنات والتجزئة.

عندما استكشفنا history of computer vision models، رأينا كيف تطورت computer vision والمسار الذي أدى إلى نماذج الرؤية المتقدمة التي نمتلكها اليوم. تدعم النماذج الحديثة مثل Ultralytics YOLOv8 مهام computer vision tasks متعددة ويتم استخدامها في تطبيقات مثيرة متنوعة.
في هذه المقالة، سنلقي نظرة على أساسيات الرؤية الحاسوبية ونماذج الرؤية. سنغطي كيفية عملها وتطبيقاتها المتنوعة عبر مختلف الصناعات. ابتكارات الرؤية الحاسوبية موجودة في كل مكان، وتشكل عالمنا بصمت. دعونا نكشفها واحدة تلو الأخرى!
ما هي الرؤية الحاسوبية؟#
الذكاء الاصطناعي (AI) هو مصطلح شامل يضم العديد من التقنيات التي تهدف إلى تكرار جزء من الذكاء البشري. أحد هذه الحقول الفرعية للذكاء الاصطناعي هو الرؤية الحاسوبية. تركز الرؤية الحاسوبية على منح الآلات عيوناً يمكنها الرؤية والملاحظة وفهم محيطها.
تماماً مثل الرؤية البشرية، تهدف حلول الرؤية الحاسوبية إلى تمييز الأشياء وحساب المسافات واكتشاف الحركات. ومع ذلك، على عكس البشر الذين لديهم تجارب حياتية لمساعدتهم على الرؤية والفهم، تعتمد أجهزة الكمبيوتر على كميات هائلة من البيانات، وكاميرات عالية الدقة، وخوارزميات معقدة.

Fig 1. مقارنة بين الرؤية البشرية والرؤية الحاسوبية.
تستطيع أنظمة الرؤية الحاسوبية معالجة وتحليل البيانات المرئية مثل الصور والفيديوهات بسرعات ودقة مذهلتين. تجعل القدرة على تحليل كميات هائلة من المعلومات المرئية بسرعة وبدقة الرؤية الحاسوبية أداة قوية في صناعات مختلفة، بدءاً من manufacturing وحتى healthcare.
تدعم نماذج الرؤية مهام الرؤية الحاسوبية المختلفة#
تعتبر نماذج الرؤية الحاسوبية جوهر أي تطبيق للرؤية الحاسوبية. وهي في الأساس خوارزميات حاسوبية مدعومة بتقنيات التعلم العميق المصممة لمنح الآلات القدرة على تفسير وفهم المعلومات المرئية. تُمكِّن نماذج الرؤية مهام الرؤية الحاسوبية الحاسمة بدءاً من image classification وحتى object detection. دعونا نلقي نظرة عن قرب على بعض هذه المهام وحالات استخدامها بمزيد من التفصيل.
تصنيف الصور#
تتضمن Image classification تصنيف الصور ووضع تسميات لها في فئات أو تصنيفات محددة مسبقاً. يمكن تدريب نموذج رؤية مثل YOLOv8 على datasets كبيرة من الصور المسماة. وأثناء التدريب، يتعلم النموذج التعرف على الأنماط والسمات المرتبطة بكل فئة. وبمجرد تدريبه، يمكنه التنبؤ بفئة الصور الجديدة غير المראية من خلال تحليل سماتها ومقارنتها بالأنماط المتعلمة.

الشكل 2. مثال على تصنيف الصور. (المصدر: towardsdatascience.com)
هناك أنواع مختلفة من تصنيف الصور. على سبيل المثال، عند التعامل مع medical images، يمكنك استخدام التصنيف الثنائي لتقسيم الصور إلى مجموعتين، مثل سليم أو مريض. النوع الآخر هو التصنيف متعدد الفئات. يمكن أن يساعد في تصنيف الصور إلى مجموعات عديدة، مثل classifying different animals on a farm مثل الخنازير والماعز والأبقار. أو، لنقل إنك تريد تصنيف الحيوانات إلى مجموعات ومجموعات فرعية، مثل تصنيف الحيوانات إلى ثدييات وطيور ثم إلى أنواع أخرى مثل الأسود والنمور والنسور والعصافير؛ فسيكون التصنيف الهرمي هو الخيار الأفضل.
كشف الكائنات#
اكتشاف الأشياء هو عملية تحديد وتحديد مواقع الأشياء في الصور وإطارات الفيديو باستخدام الرؤية الحاسوبية. وهي تتكون من مهمتين: تحديد موقع الشيء، الذي يرسم مربعات إحاطة حول الأشياء، وتصنيف الأشياء، الذي يحدد فئة كل شيء. بناءً على تعليقات مربعات الإحاطة، يمكن لنموذج الرؤية تعلم التعرف على الأنماط والميزات الخاصة بكل فئة من فئات الأشياء والتنبؤ بوجود هذه الأشياء وموقعها في صور جديدة غير مرئية.
الشكل 3. استخدام اكتشاف الأشياء عبر YOLOv8 للكشف عن اللاعبين في ملعب كرة قدم.
اكتشاف الكائنات له العديد من حالات الاستخدام عبر صناعات مختلفة، في أي مكان بدءاً من sports وحتى علم الأحياء البحرية. على سبيل المثال، في retail، تستخدم تقنية Amazon’s Just Walk Out اكتشاف الكائنات لأتمتة الدفع من خلال تحديد العناصر التي يلتقطها العملاء. يتيح الجمع بين الرؤية الحاسوبية وبيانات المستشعرات للعملاء أخذ أغراضهم والمغادرة دون الانتظار في طابور.
إليك نظرة فاحصة على كيفية عمل ذلك:
- تلتقط الكاميرات المثبتة في السقف حركة العملاء داخل المتجر، وتتم معالجة لقطات الفيديو هذه في الوقت الفعلي بواسطة نماذج الرؤية.
- يُستخدم اكتشاف الأشياء لتحديد المنتج الدقيق الذي يلتقطه العميل ويضعه في سلة التسوق الخاصة به لتحديث عربة التسوق الافتراضية الخاصة به وفقاً لذلك.
- تعمل مستشعرات الوزن الموجودة على الرفوف على تحسين الدقة من خلال اكتشاف إزالة العناصر أو استبدالها.
- عندما يغادر العميل المتجر، يمكن استخدام تقنية اكتشاف الكائنات وfacial recognition لتأكيد أن العميل قد غادر، ويمكن استخدام تفاصيل الدفع الخاصة به، مثل بطاقة الائتمان، لتحصيل الرسوم منه تلقائياً.
التجزئة الدلالية وتجزئة المثيلات#
التقسيم الدلالي وinstance segmentation هما مهام رؤية حاسوبية تساعد في تقسيم الصور إلى قطاعات ذات مغزى. يصنف التقسيم الدلالي وحدات البكسل بناءً على معناها الدلالي ويعامل جميع الكائنات ضمن الفئة ككيان واحد بنفس التسمية. وهو مناسب لتسمية الكائنات غير المعدودة مثل "السماء" أو "المحيط" أو المجموعات مثل "الأوراق" أو "العشب".
من ناحية أخرى، يمكن لتجزئة المثيلات التمييز بين مثيلات مختلفة من نفس الفئة من خلال تعيين تسمية فريدة لكل شيء مكتشف. يمكنك استخدام تجزئة المثيلات لتجزئة الأشياء القابلة للعد حيث يكون عدد الأشياء واستقلاليتها أمراً مهماً. وهي تسمح بتحديد وتمييز أكثر دقة.
الشكل 4. مثال على التجزئة الدلالية وتجزئة المثيلات.
يمكننا فهم التباين بين التقسيم الدلالي وتقسيم المثيلات بشكل أكثر وضوحاً بمثال يتعلق بـ self-driving cars. يعتبر التقسيم الدلالي رائعاً للمهام التي تتطلب فهم محتويات المشهد ويمكن استخدامه في المركبات ذاتية القيادة لتصنيف الميزات على الطريق، مثل معابر المشاة وإشارات المرور. وفي الوقت نفسه، يمكن استخدام تقسيم المثيلات في المركبات ذاتية القيادة للتمييز بين المشاة الأفراد والمرکبات والعوائق.
تقدير الوضع#
Pose estimation هي مهمة رؤية حاسوبية تركز على اكتشاف وتتبع النقاط الرئيسية لأوضاع الكائنات في الصور أو الفيديوهات. تُستخدم غالباً لتحديد وضعية الإنسان، مع نقاط رئيسية تشمل مناطق مثل الكتفين والركبتين. يساعد تقدير وضعية الإنسان في فهم التعرف على الأفعال والحركات البالغة الأهمية لمختلف التطبيقات.

Fig 5. مثال على تقدير الوضعية باستخدام YOLOv8.
يمكن استخدام تقدير الوضعية في الرياضة لتحليل كيفية تحرك الرياضيين. يستخدم الدوري الاميركي للمحترفين (NBA) تقدير الوضعية لدراسة حركات ومواقع اللاعبين أثناء المباراة. من خلال تتبع النقاط الرئيسية مثل الكتفين والمرفقين والركبتين والكاحلين، يوفر تقدير الوضعية رؤى مفصلة حول حركات اللاعبين. تساعد هذه الرؤى المدربين في تطوير استراتيجيات أفضل، وتحسين برامج التدريب، وإجراء تعديلات في الوقت الفعلي أثناء المباريات. كما يمكن للبيانات المساعدة في مراقبة إرهاق اللاعبين وخطر الإصابة لتحسين صحة وأداء اللاعبين بشكل عام.
اكتشاف الأشياء بمربعات إحاطة موجهة#
يستخدم Oriented Bounding Boxes Object Detection (OBB) مستطيلات مدورة لتحديد وتحديد موقع الكائنات بدقة في الصورة. على عكس صناديق الإحاطة القياسية التي تصطف مع محاور الصورة، تدور صناديق OBB لتتوافق مع اتجاه الكائن. هذا يجعلها مفيدة بشكل خاص للكائنات التي ليست أفقية أو عمودية تماماً. وهي ممتازة في تحديد وعزل الكائنات المدورة بدقة لمنع التداخلات في البيئات المزدحمة.
الشكل 6. مثال على اكتشاف بمربعات إحاطة موجهة على صورة جوية للقوارب باستخدام YOLOv8.
في المراقبة maritime، يعتبر تحديد وتتبع السفن أمراً أساسياً للأمن وإدارة الموارد. يمكن استخدام اكتشاف OBB لتحديد المواقع بدقة للسفن، حتى عندما تكون مكتظة بكثافة أو موجهة بزوايا مختلفة. يساعد في مراقبة ممرات الشحن، وإدارة حركة المرور البحرية، وتحسين عمليات الموانئ. يمكنه أيضاً المساعدة في الاستجابة للكوارث من خلال تحديد وتقييم الأضرار التي تلحق بالسفن والبنية التحتية بسرعة بعد أحداث مثل الأعاصير أو oil spills.
تتبع الأشياء#
حتى الآن، ناقشنا مهام الرؤية الحاسوبية التي تتعامل مع الصور. Object tracking هي مهمة رؤية حاسوبية يمكنها تتبع كائن عبر إطارات الفيديو. تبدأ بتحديد الكائن في الإطار الأول باستخدام خوارزميات الاكتشاف ثم تتابع باستمرار موقعه أثناء تحركه عبر الفيديو. يتضمن تتبع الكائنات تقنيات مثل اكتشاف الكائنات، واستخراج الميزات، والتنبؤ بالحركة للحفاظ على دقة التتبع.

الشكل 7. استخدام YOLOv8 لتتبع الأسماك.
يمكن استخدام نماذج الرؤية مثل YOLOv8 لـ track fish in marine biology. باستخدام الكاميرات تحت الماء، يمكن للباحثين مراقبة حركات وسلوكيات الأسماك في بيئاتها الطبيعية. تبدأ العملية باكتشاف الأسماك الفردية في الإطارات الأولى ثم تتبع مواقعها طوال الفيديو. يساعد تتبع الأسماك العلماء على فهم أنماط الهجرة، والسلوكيات الاجتماعية، والتفاعلات مع البيئة. كما أنه يدعم ممارسات الصيد المستدام من خلال توفير رؤى حول توزيع الأسماك ووفرتها.
نظرة أخيرة على الرؤية الحاسوبية#
تعمل الرؤية الحاسوبية بنشاط على تغيير كيفية استخدامنا للتكنولوجيا وتفاعلنا مع العالم. من خلال استخدام نماذج التعلم العميق والخوارزميات المعقدة لفهم الصور ومقاطع الفيديو، تساعد الرؤية الحاسوبية الصناعات على تبسيط العديد من العمليات. تجعل مهام الرؤية الحاسوبية مثل اكتشاف الأشياء وتتبع الأشياء من الممكن إنشاء حلول لم يتم تخيلها من قبل. مع استمرار تحسن تقنية الرؤية الحاسوبية، يحمل المستقبل العديد من التطبيقات المبتكرة!
دعونا نتعلم وننمو معاً! استكشف GitHub repository الخاص بنا لرؤية مساهماتنا في الذكاء الاصطناعي. تحقق من كيف نعيد تعريف صناعات مثل self-driving cars وagriculture باستخدام الذكاء الاصطناعي. 🚀






