استكشاف كيفية عمل تطبيقات رؤية الحاسوب
تعمّق معنا في تطبيقات رؤية الحاسوب. وسنستعرض أيضًا مهام متنوعة لرؤية الحاسوب مثل كشف الأجسام والتجزئة.

عندما استكشفنا تاريخ نماذج الرؤية الحاسوبية، رأينا كيف تطورت الرؤية الحاسوبية والمسار الذي أدى إلى نماذج الرؤية المتقدمة التي نستخدمها اليوم. تدعم النماذج الحديثة مثل Ultralytics YOLOv8 العديد من مهام الرؤية الحاسوبية، ويجري استخدامها في تطبيقات متنوعة ومثيرة.
في هذه المقالة، سنلقي نظرة على أساسيات الرؤية الحاسوبية ونماذج الرؤية. وسنستعرض كيفية عملها وتطبيقاتها المتنوعة في مختلف الصناعات. توجد ابتكارات الرؤية الحاسوبية في كل مكان، وهي تشكّل عالمنا بصمت. فلنكشف عنها واحدة تلو الأخرى!
ما الرؤية الحاسوبية؟#
الذكاء الاصطناعي (AI) مصطلح شامل يضم العديد من التقنيات التي تهدف إلى محاكاة جانب من جوانب الذكاء البشري. ومن المجالات الفرعية للذكاء الاصطناعي الرؤية الحاسوبية. وتركز الرؤية الحاسوبية على منح الآلات عيونًا تستطيع رؤية محيطها ومراقبته وفهمه.
مثل الرؤية البشرية، تهدف حلول الرؤية الحاسوبية إلى تمييز الأشياء وحساب المسافات واكتشاف الحركات. إلا أن الحواسيب، بخلاف البشر الذين تساعدهم خبراتهم المتراكمة طوال حياتهم على الرؤية والفهم، تعتمد على كميات هائلة من البيانات وكاميرات عالية الدقة وخوارزميات معقدة.

الشكل 1. مقارنة بين الرؤية البشرية والرؤية الحاسوبية.
يمكن لأنظمة الرؤية الحاسوبية معالجة البيانات المرئية، مثل الصور ومقاطع الفيديو، وتحليلها بسرعات ودقة مذهلتين. وتجعل القدرة على تحليل كميات هائلة من المعلومات المرئية بسرعة ودقة الرؤية الحاسوبية أداة قوية في مختلف الصناعات، بدءًا من التصنيع وصولًا إلى الرعاية الصحية.
تدعم نماذج الرؤية مختلف مهام الرؤية الحاسوبية#
تُعد نماذج الرؤية الحاسوبية جوهر أي تطبيق للرؤية الحاسوبية. وهي في الأساس خوارزميات حسابية مدعومة بتقنيات التعلم العميق، صُممت لمنح الآلات القدرة على تفسير المعلومات المرئية وفهمها. وتمكّن نماذج الرؤية من تنفيذ مهام أساسية في الرؤية الحاسوبية، بدءًا من تصنيف الصور ووصولًا إلى اكتشاف الأجسام. فلنلقِ نظرة أقرب على بعض هذه المهام وحالات استخدامها بمزيد من التفصيل.
تصنيف الصور#
يتضمن تصنيف الصور تصنيف الصور ووضع تسميات لها ضمن فئات أو أصناف محددة مسبقًا. ويمكن تدريب نموذج رؤية مثل YOLOv8 على مجموعات بيانات كبيرة من الصور ذات التسميات. وأثناء التدريب، يتعلم النموذج التعرّف على الأنماط والسمات المرتبطة بكل فئة. وبعد تدريبه، يمكنه التنبؤ بفئة الصور الجديدة غير المرئية من خلال تحليل سماتها ومقارنتها بالأنماط التي تعلمها.

الشكل 2. مثال على تصنيف الصور. (المصدر: towardsdatascience.com)
توجد أنواع مختلفة من تصنيف الصور. فعلى سبيل المثال، عند التعامل مع الصور الطبية، يمكنك استخدام التصنيف الثنائي لتقسيم الصور إلى مجموعتين، مثل الصور السليمة أو المريضة. وهناك نوع آخر هو التصنيف متعدد الفئات، الذي يساعد على تصنيف الصور ضمن مجموعات عديدة، مثل تصنيف حيوانات مختلفة في مزرعة، كالخنازير والماعز والأبقار. أو لنفترض أنك تريد تصنيف الحيوانات إلى مجموعات ومجموعات فرعية، مثل تصنيفها إلى ثدييات وطيور، ثم تصنيفها على نحو أكثر تفصيلًا إلى أنواع مثل الأسود والنمور والنسور والعصافير؛ في هذه الحالة، سيكون التصنيف الهرمي هو الخيار الأفضل.
اكتشاف الأجسام#
اكتشاف الأجسام هو عملية تحديد الأجسام وتحديد مواقعها في الصور وإطارات الفيديو باستخدام الرؤية الحاسوبية. ويتألف من مهمتين: تحديد موضع الجسم، الذي يرسم مربعات إحاطة حول الأجسام، وتصنيف الجسم، الذي يحدد فئة كل جسم. واستنادًا إلى التعليقات التوضيحية لمربعات الإحاطة، يمكن لنموذج الرؤية تعلم التعرّف على الأنماط والسمات الخاصة بكل فئة من الأجسام، والتنبؤ بوجود هذه الأجسام ومواقعها في الصور الجديدة غير المرئية.
الشكل 3. استخدام اكتشاف الأجسام في YOLOv8 لرصد اللاعبين في ملعب كرة القدم.
لاكتشاف الأجسام حالات استخدام عديدة في مختلف الصناعات، بدءًا من الرياضة وصولًا إلى علم الأحياء البحرية. فعلى سبيل المثال، في قطاع التجزئة، تستخدم تقنية Just Walk Out من Amazon اكتشاف الأجسام لأتمتة عملية الدفع من خلال تحديد العناصر التي يلتقطها العملاء. ويتيح الجمع بين الرؤية الحاسوبية وبيانات المستشعرات للعملاء أخذ عناصرهم ومغادرة المتجر دون الانتظار في الطابور.
إليك نظرة أقرب على كيفية عمل ذلك:
- تلتقط الكاميرات المثبتة في السقف صور العملاء أثناء تحركهم في المتجر، وتعالج نماذج الرؤية لقطات الفيديو هذه في الوقت الفعلي.
- يُستخدم اكتشاف الأجسام لرصد المنتج الدقيق الذي يلتقطه العميل ويضعه في سلته، وذلك لتحديث سلته الافتراضية وفقًا لذلك.
- تُحسّن مستشعرات الوزن الموجودة على الرفوف الدقة من خلال اكتشاف إزالة العناصر أو إعادتها.
- عند مغادرة العميل المتجر، يمكن استخدام تقنية اكتشاف الأجسام والتعرّف على الوجه للتأكد من مغادرته، كما يمكن استخدام تفاصيل الدفع الخاصة به، مثل بطاقة الائتمان، لفرض الرسوم عليه تلقائيًا.
التقسيم الدلالي وتقسيم الكيانات#
التقسيم الدلالي وتقسيم الكيانات هما مهمتان في الرؤية الحاسوبية تساعدان على تقسيم الصور إلى أجزاء ذات معنى. ويصنف التقسيم الدلالي وحدات البكسل استنادًا إلى معناها الدلالي، ويتعامل مع جميع الأجسام ضمن فئة معينة باعتبارها كيانًا واحدًا يحمل التسمية نفسها. وهو مناسب لوضع تسميات للأجسام غير القابلة للعد، مثل «السماء» أو «المحيط»، أو للتجمعات، مثل «الأوراق» أو «العشب».
أما تقسيم الكيانات، فيستطيع التمييز بين الكيانات المختلفة من الفئة نفسها من خلال إسناد تسمية فريدة إلى كل جسم مكتشف. ويمكنك استخدام تقسيم الكيانات لتقسيم الأجسام القابلة للعد عندما يكون عدد الأجسام واستقلاليتها مهمين. ويتيح ذلك تحديدًا وتمييزًا أكثر دقة.
الشكل 4. مثال على التقسيم الدلالي وتقسيم الكيانات.
يمكننا فهم الفرق بين التقسيم الدلالي وتقسيم الكيانات بوضوح أكبر من خلال مثال يتعلق بـالسيارات ذاتية القيادة. ويُعد التقسيم الدلالي مناسبًا للمهام التي تتطلب فهم محتويات المشهد، ويمكن استخدامه في المركبات ذاتية القيادة لتصنيف السمات الموجودة على الطريق، مثل معابر المشاة وإشارات المرور. وفي المقابل، يمكن استخدام تقسيم الكيانات في المركبات ذاتية القيادة للتمييز بين المشاة والمركبات والعوائق الفردية.
تقدير الوضعية#
تقدير الوضعية هو مهمة في الرؤية الحاسوبية تركز على اكتشاف النقاط الأساسية لوضعيات جسم ما في الصور أو مقاطع الفيديو وتتبعها. ويُستخدم غالبًا لتقدير وضعية الإنسان، وتشمل النقاط الأساسية مناطق مثل الكتفين والركبتين. ويساعد تقدير وضعية الإنسان على فهم الأفعال والحركات والتعرّف عليها، وهي أمور أساسية لمختلف التطبيقات.

الشكل 5. مثال على تقدير الوضعية باستخدام YOLOv8.
يمكن استخدام تقدير الوضعية في الرياضة لتحليل كيفية تحرك الرياضيين. ويستخدم NBA تقدير الوضعية لدراسة حركات اللاعبين ومواضعهم أثناء المباراة. ومن خلال تتبع النقاط الأساسية، مثل الكتفين والمرفقين والركبتين والكاحلين، يوفر تقدير الوضعية رؤى تفصيلية حول حركات اللاعبين. وتساعد هذه الرؤى المدربين على وضع استراتيجيات أفضل وتحسين برامج التدريب وإجراء تعديلات فورية أثناء المباريات. كما يمكن أن تساعد البيانات على مراقبة إجهاد اللاعبين وخطر تعرضهم للإصابات لتحسين صحتهم وأدائهم عمومًا.
اكتشاف الأجسام باستخدام مربعات الإحاطة الموجّهة#
يستخدم اكتشاف الأجسام باستخدام مربعات الإحاطة الموجّهة (OBB) مستطيلات مدوّرة لتحديد الأجسام وتحديد مواقعها بدقة في الصورة. وعلى خلاف مربعات الإحاطة القياسية المتراصفة مع محاور الصورة، تدور مربعات الإحاطة الموجّهة لتتوافق مع اتجاه الجسم. ويجعلها ذلك مفيدة خصوصًا للأجسام التي لا تكون أفقية أو عمودية تمامًا. وهي بارعة في تحديد الأجسام المدوّرة وعزلها بدقة لمنع التداخلات في البيئات المزدحمة.
الشكل 6. مثال على اكتشاف الأجسام باستخدام مربعات الإحاطة الموجّهة في صورة جوية للقوارب باستخدام YOLOv8.
في المراقبة البحرية، يُعد تحديد السفن وتتبعها أمرًا أساسيًا للأمن وإدارة الموارد. ويمكن استخدام اكتشاف الأجسام باستخدام مربعات الإحاطة الموجّهة لتحديد مواقع السفن بدقة، حتى عندما تكون متراصة بكثافة أو موجّهة بزوايا مختلفة. ويساعد ذلك على مراقبة ممرات الشحن وإدارة حركة الملاحة البحرية وتحسين عمليات الموانئ. كما يمكن أن يساهم في الاستجابة للكوارث من خلال تحديد الأضرار التي لحقت بالسفن والبنية التحتية وتقييمها بسرعة بعد أحداث مثل الأعاصير أو انسكابات النفط.
تتبع الأجسام#
ناقشنا حتى الآن مهام الرؤية الحاسوبية التي تتعامل مع الصور. ويُعد تتبع الأجسام مهمة في الرؤية الحاسوبية يمكنها تتبع جسم ما عبر إطارات الفيديو. وتبدأ العملية بتحديد الجسم في الإطار الأول باستخدام خوارزميات الاكتشاف، ثم تتابع موضعه باستمرار أثناء تحركه عبر الفيديو. ويتضمن تتبع الأجسام تقنيات مثل اكتشاف الأجسام واستخراج السمات والتنبؤ بالحركة للحفاظ على دقة التتبع.

الشكل 7. استخدام YOLOv8 لتتبع الأسماك.
يمكن استخدام نماذج الرؤية مثل YOLOv8 من أجل تتبع الأسماك في علم الأحياء البحرية. وباستخدام الكاميرات تحت الماء، يستطيع الباحثون مراقبة حركات الأسماك وسلوكياتها في بيئاتها الطبيعية. وتبدأ العملية باكتشاف الأسماك الفردية في الإطارات الأولى، ثم تتبع مواقعها عبر الفيديو بأكمله. ويساعد تتبع الأسماك العلماء على فهم أنماط الهجرة والسلوكيات الاجتماعية والتفاعلات مع البيئة. كما يدعم ممارسات الصيد المستدامة من خلال توفير رؤى حول توزيع الأسماك ووفرتها.
نظرة أخيرة على الرؤية الحاسوبية#
تُغيّر الرؤية الحاسوبية بنشاط طريقة استخدامنا للتقنية وتفاعلنا مع العالم. ومن خلال استخدام نماذج التعلم العميق والخوارزميات المعقدة لفهم الصور ومقاطع الفيديو، تساعد الرؤية الحاسوبية الصناعات على تبسيط العديد من العمليات. وتجعل مهام الرؤية الحاسوبية، مثل اكتشاف الأجسام وتتبعها، إنشاء حلول لم يكن من الممكن تصورها من قبل أمرًا ممكنًا. ومع استمرار تحسن تقنية الرؤية الحاسوبية، يحمل المستقبل العديد من التطبيقات الأكثر ابتكارًا!
لنتعلم ونتطور معًا! استكشف مستودعنا على GitHub للاطلاع على إسهاماتنا في الذكاء الاصطناعي. وتعرّف على كيفية إعادة تعريفنا صناعات مثل السيارات ذاتية القيادة والزراعة باستخدام الذكاء الاصطناعي. 🚀









