YOLO Vision 2026:
الأدلة

ما هو OpenPose؟ استكشاف علامة فارقة في تقدير الوضعية

استكشف كيف يمكن استخدام OpenPose لتقدير الوضعية في تطبيقات الرؤية الحاسوبية. تعرف على ميزاته وأهميته في الذكاء الاصطناعي البصري.

ABAbirami Vina5 min read
تقدير وضعية الأشخاص المتعددين باستخدام OpenPose

في الوقت الحاضر، أصبحت الصور والكاميرات موجودة في كل مكان - مدمجة في هواتفنا، ومنازلنا، وحتى الأماكن العامة. نحن لا نعتمد عليها فقط لالتقاط اللحظات، بل لمساعدتنا على فهم العالم من حولنا والتفاعل معه.

وراء الكواليس، يتيح computer vision، وهو مجال فرعي من الذكاء الاصطناعي (AI)، تحقيق ذلك من خلال تمكين الآلات من تفسير البيانات المرئية. فهو يسمح للأنظمة باكتشاف الأشياء، التعرف على الوجوه، وتتبع الحركة، مما يلعب دوراً رئيسياً في العديد من التقنيات التي نستخدمها كل يوم.

بفضل التطورات الأخيرة في الذكاء الاصطناعي، يمكن لنماذج الرؤية الحاسوبية الآن تحليل واستخراج بيانات ورؤى أكثر تعقيداً. أحد الأمثلة على ذلك هو pose estimation، وهي مهمة رؤية حاسوبية تركز على فهم حركة الإنسان.

تعمل هذه التقنية عن طريق تحديد نقاط رئيسية على الجسم، مثل الكتفين، والمرفقين، والركبتين، في الصور أو الفيديو. وهذا يجعل من الممكن تحليل كيفية تحرك الأشخاص، مما يتيح تطبيقات في تتبع اللياقة البدنية، والرسوم المتحركة، والرعاية الصحية، والمزيد.

من بين العديد من الأدوات التي تم تطويرها لتقدير الوضعية، يبرز OpenPose كاختراق رئيسي. تم إنشاؤه بواسطة باحثين في مختبر الحوسبة الإدراكية في جامعة كارنيجي ميلون، وكان أحد أول الأنظمة مفتوحة المصدر القادرة على اكتشاف وضعيات الجسم بالكامل، بما في ذلك اليدين، والقدمين، والنقاط الرئيسية للوجه، لأشخاص متعددين في الوقت الفعلي باستخدام كاميرا فقط (مع ما يصل إلى 135 نقطة رئيسية لكل شخص).

في هذه المقالة، سنستكشف OpenPose، وكيف يعمل، وأهميته كعلامة فارقة في الرؤية الحاسوبية.

Multi-person pose estimation using OpenPose

Fig 1. تقدير وضعية متعدد الأشخاص باستخدام OpenPose.

نظرة على تاريخ تقدير الوضعية#

قبل الاعتماد الواسع النطاق للذكاء الاصطناعي، كان تتبع حركة الإنسان في مقاطع الفيديو يتطلب استخدام معدات خاصة. في صناعات مثل film and animation، كان الممثلون غالباً ما يرتدون بدلات ذات علامات عاكسة لتمكين الكاميرات من التقاط حركاتهم في بيئة استوديو محكومة.

بينما كانت تقنيات التقاط الحركة المعتمدة على العلامات هذه دقيقة، إلا أنها كانت أيضًا باهظة الثمن ومحدودة بإعدادات معينة. مع تقدم الرؤية الحاسوبية، بحث الباحثون عن طرق لتتبع حركة الجسم دون استخدام علامات. استخدموا الحواف، والخطوط العريضة، والقوالب للعثور على أشكال البشر في الصور.

عملت هذه الأنظمة المبكرة في حالات بسيطة ومباشرة ولكنها عانت في سيناريوهات العالم الحقيقي. غالبًا ما قدمت نتائج ضعيفة عندما تحرك الأشخاص بطرق غير متوقعة أو عندما ظهر أكثر من شخص في الإطار.

في أواخر عام 2010، أحدث deep learning تحولاً كبيراً في تقدير الوضعية. إذ أصبح من الممكن تدريب نماذج الذكاء الاصطناعي المرئي على مجموعات بيانات كبيرة من وضعيات البشر. وبدلاً من الاعتماد على الحواف والقوالب، تعلمت النماذج التعرف على مفاصل الجسم وبنيته من خلال دراسة آلاف الصور المصنفة. وقد جعل هذا تقدير الوضعية أكثر دقة، مرونة، وتأثيراً في نطاق أوسع من البيئات.

Timeline of human pose estimation models from 2017 to 2023

Fig 2. تطور نماذج تقدير الوضعية البشرية من عام 2017 إلى عام 2023.

OpenPose: حيث انطلق تقدير الوضعية الحديث#

تم إصدار OpenPose لأول مرة في عام 2017 وهو قادر على تقدير وضعيات أشخاص متعددين في وقت واحد في صورة واحدة. على عكس الأنظمة الأقدم، لا يتطلب OpenPose بدلات أو علامات خاصة. إنه يعمل مع الكاميرات القياسية ويمكنه معالجة الصور والفيديو في الوقت الفعلي. جعلت هذه الميزات تقدير الوضعية أكثر سهولة للمطورين والباحثين.

ساعد الأساس الذي وضعته OpenPose للرؤية الحاسوبية الآخرين في بناء بنيات أحدث لمجموعة متنوعة من التطبيقات الأخرى. اليوم، تقدم نماذج الذكاء الاصطناعي المرئي مثل Ultralytics YOLOv8 و Ultralytics YOLO11 التي تدعم مهام تقدير الوضعية نتائج أسرع وزمناً انتقالياً أقل.

Using Ultralytics YOLO11 for pose estimation

Fig 3. استخدام YOLO11 لتقدير الوضعية.

ومع ذلك، يعد OpenPose مكانًا رائعًا للبدء إذا كنت مهتمًا بكيفية تطور تقدير الوضعية. لقد قدم أفكارًا رئيسية لا تزال العديد من الأنظمة الأحدث تعتمد عليها اليوم.

قدرات OpenPose الرئيسية#

الآن بعد أن أصبح لدينا فهم أفضل لسبب أهمية OpenPose، دعونا نلقي نظرة فاحصة على ما يمكنه فعله بالفعل.

في صميم قدرات OpenPose يكمن ما يُعرف بـ keypoint detection. النقاط الرئيسية هي معالم محددة على جسم الإنسان، مثل طرف الأنف، مركز الكتفين، المرفقين، المعصمين، الوركين، الركبتين، والكاحلين. يمكن لـ OpenPose اكتشاف ما يصل إلى 135 نقطة من هذه النقاط لكل شخص، بما في ذلك المناطق التفصيلية مثل الأصابع والملامح الوجهية.

عند ربط هذه النقاط، فإنها تشكل تمثيلًا مبسطًا لجسم الإنسان - يمكنك التفكير فيه كهيكل عظمي رقمي. يظهر هذا المخطط الهيكلي ليس فقط مكان وجود الشخص، بل كيفية وضعيته: سواء كان جالسًا، أو واقفًا، أو يلوح بيده، أو يبتسم، أو يمشي. يمكن لأجهزة الكمبيوتر تفسير حركة الإنسان بصريًا باستخدام هذه الهياكل العظمية، تمامًا كما نفهم نحن غريزيًا لغة جسد شخص ما.

يعد تتبع الهيكل العظمي مفيدًا بشكل خاص لأنه يزيل ضوضاء الخلفية والتشتيت، مما يسمح للنظام بالتركيز فقط على وضعية الإنسان وحركته. بدلاً من تحليل كل بكسل، يركز OpenPose على النقاط ذات المعنى التي تحكي قصة كيفية تحرك الشخص أو تفاعله.

من خلال استخراج هذه المعلومات المنظمة من الصور أو الفيديو اليومي، يجعل OpenPose من الممكن بناء تطبيقات تستجيب للإيماءات، أو تراقب النشاط البدني، أو تقيم الإشارات العاطفية، أو حتى تحريك الشخصيات الرقمية.

كيف يعمل OpenPose؟#

فيما يلي نظرة عامة على كيفية اكتشاف OpenPose للنقاط الرئيسية على جسم الإنسان وربطها من المدخلات المرئية:

  • يبدأ بصورة: تأخذ OpenPose صورة واحدة من صورة ثابتة، أو فيديو، أو بث camera حي.
  • يحدد أجزاء الجسم المهمة: يبحث النظام عن نقاط رئيسية على الجسم، مثل الأنف، والمرفقين، والمعصمين، والركبتين، والكاحلين. يتم وضع علامة عليها أينما كان النظام واثقًا من وجود جزء من الجسم.
  • يكتشف الأجزاء التي تنتمي لبعضها: بعد ذلك، يتحقق OpenPose من كيفية ربط النقاط الرئيسية. يستخدم حسابات رياضية ليقرر أي المفاصل تنتمي لنفس الشخص - على سبيل المثال، مطابقة المعصم بالمرفق والكتف الأيمن.
  • يرسم هيكلًا عظميًا لكل شخص: بعد تجميع النقاط الرئيسية، يقوم OpenPose بربطها في "شكل عصا" يظهر وضعية كل شخص. يعمل هذا حتى عندما يظهر عدة أشخاص في نفس الإطار.
  • يعيد بيانات الوضعية: أخيرًا، يوفر المواقع الدقيقة لجميع النقاط الرئيسية المكتشفة. يمكن استخدامها لتتبع الحركة، أو التعرف على الإيماءات، أو بناء أدوات تفاعلية - كل ذلك في الوقت الفعلي.

Human keypoint detection and tracking using OpenPose

Fig 4. اكتشاف وتتبع النقاط الرئيسية للبشر باستخدام OpenPose.

تطبيقات تقدير الوضعية عبر الصناعات باستخدام OpenPose#

كانت OpenPose واحدة من أوائل الأدوات المتقدمة التي جعلت تقدير الوضعية عملياً لمجموعة متنوعة من حالات الاستخدام في العالم الحقيقي. وعلى الرغم من أنها لا تُستخدم عادة في computer vision solutions في الوقت الفعلي اليوم، إلا أنها لعبت دوراً مهماً في تشكيل الأعمال المبكرة عبر مجالات مثل الرياضة، الترفيه، التعليم، والسلامة.

دعونا نلقي نظرة فاحصة على كيفية مساهمته في تمهيد الطريق في هذه المجالات.

تقدير الوضعية باستخدام OpenPose للياقة البدنية والرياضة#

عندما تشاهد لعبة البيسبول، من السهل فهم ما يحدث - يمكنك التعرف فورًا على الرمية، أو الأرجوحة، أو القاعدة المسروقة. كبشر، نقرأ حركات الجسم بشكل حدسي ونفهمها دون الكثير من الجهد. ولكن بالنسبة للآلات، فإن التعرف على هذه الإجراءات أكثر تعقيدًا بكثير. فهي تحتاج إلى معلومات دقيقة حول كيفية تحرك كل جزء من الجسم عبر الفضاء.

كان OpenPose خطوة كبيرة للأمام في هذا المجال من الرؤية الحاسوبية. لقد كان أداة عملية لتحليل الأداء الرياضي في مجموعة متنوعة من الإعدادات.

استخدمت العديد من المشاريع البحثية OpenPose لتحليل الحركات مثل الأرجحة والقفز، بل وحتى تصنيف baseball actions معينة استناداً إلى كيفية تحرك اللاعبين. ونظراً لعملها في بيئات مفتوحة باستخدام فيديو قياسي، فقد سمحت للباحثين باختبار كيفية عمل مثل هذه الأنظمة في سيناريوهات التدريب أو التوجيه في العالم الحقيقي.

ساعدت هذه الدراسات المبكرة في وضع الأساس لأدوات تتبع الأداء المُستخدمة الآن في sports technology المتقدمة.

Baseball action classification pipeline using OpenPose

Fig 5. نظرة على مسار تصنيف إجراءات البيسبول باستخدام OpenPose.

استخدام OpenPose في أنظمة الأمن والسلامة#

وبالمثل، استخدم الباحثون أيضاً OpenPose لاستكشاف كيف يمكن لتتبع الوضعية القائم على الفيديو أن يدعم مراقبة السلامة. فقد تم اختبارها في detecting behaviors مثل السقوط، الإيماءات غير المتوقعة، أو أنماط الحركة في الأماكن العامة.

ونظراً لعملها مع الكاميرات القياسية، جعلت OpenPose التجريب المبكر أكثر سهولة في بيئات مثل المستشفيات ومراكز النقل. ساعدت هذه الدراسات في دفع تطوير newer models المُستخدمة الآن في المراقبة، اكتشاف السقوط، وأنظمة الاستجابة للطوارئ.

Fall detection enabled by OpenPose

Fig 6. اكتشاف السقوط المُمكن بواسطة OpenPose.

إيجابيات وسلبيات OpenPose#

إليك لمحة عن بعض المزايا التي يقدمها OpenPose:

  • مفيد للبحث والنماذج الأولية: لقد تم استخدامه على نطاق واسع في البحث الأكاديمي، خاصة في مجالات مثل التفاعل بين الإنسان والحاسوب، والميكانيكا الحيوية، والتحليل السلوكي.
  • دعم متعدد المنصات: يمكنها العمل على Windows، Linux، و macOS، مع دعم لكل من وحدة المعالجة المركزية (CPUs) و graphics processing units (GPUs).
  • إمكانية المعالجة دون اتصال: يمكن تشغيله في بيئات بدون وصول إلى الإنترنت، مما يجعله مثاليًا للإعدادات الحساسة للخصوصية مثل الرعاية الصحية أو التعليم.

على الرغم من أن OpenPose كان خطوة كبيرة للأمام، إلا أن لديه أيضًا قيودًا فنية من المهم وضعها في الاعتبار. إليك بعض التحديات الرئيسية المرتبطة بـ OpenPose:

  • متطلبات معالجة عالية: يتطلب تشغيل OpenPose في الوقت الفعلي وحدة معالجة رسومات قوية وموارد حوسبة كبيرة.
  • حساس للبيئة: قد ينخفض الأداء في الإضاءة المنخفضة، أو الأماكن المزدحمة، أو عندما لا تكون زوايا الكاميرا مثالية.
  • ثقيل مقارنة بالنماذج الأحدث: مقارنة بنماذج تقدير الوضعية الأحدث، يعتبر OpenPose كبيرًا وبطيئًا نسبيًا. وهو غير مناسب تمامًا للنشر على الأجهزة محدودة الموارد مثل الهواتف الذكية، أو الأجهزة اللوحية، أو الأنظمة المدمجة.

أبرز النقاط#

لعب OpenPose دورًا مهمًا في جعل تقدير الوضعية أكثر سهولة. لقد أظهر أن تتبع حركات الجسم يمكن القيام به بكاميرا بسيطة، دون الاعتماد على بدلات أو معدات متخصصة.

لقد وضع الأساس للعديد من التطبيقات العملية عبر الرعاية الصحية، والتعليم، والترفيه، والبحث. بينما توفر النماذج الأحدث الآن سرعات أسرع وأداء أخف، يظل OpenPose نقطة مرجعية رئيسية لفهم كيفية تطور تقدير الوضعية.

انضم إلى community الخاص بنا وقم بزيارة GitHub repository لمعرفة المزيد حول الذكاء الاصطناعي. إذا كنت تتطلع إلى بناء حلول الرؤية الحاسوبية الخاصة بك، استكشف licensing options الخاصة بنا. تحقق أيضاً من كيف يؤثر computer vision in healthcare و AI in logistics!

Explore solutions

Real-time AI that works with your team

الذكاء الاصطناعي في الروبوتات

شغّل آلات أكثر ذكاءً باستخدام نماذج Ultralytics YOLO. يدفع الذكاء الاصطناعي للرؤية في الروبوتات الملاحة الذاتية، والإدراك، وتتبع الكائنات، والتحكم في الوقت الفعلي.
اعرف المزيد
Real-time AI that works with your team

الذكاء الاصطناعي في الخدمات اللوجستية

بسّط العمليات اللوجستية باستخدام نماذج Ultralytics YOLO. تُمكّن الرؤية بالذكاء الاصطناعي فحص الطرود، والفرز، وتتبع المركبات، ومراقبة السلامة في المستودعات في الوقت الفعلي.
اعرف المزيد
Real-time AI that works with your team

الذكاء الاصطناعي في التجزئة

أعد تصور تجارة التجزئة مع نماذج Ultralytics YOLO. تعزز الرؤية بالذكاء الاصطناعي تتبع المخزون، ومراقبة الأرفف، وإدارة الطوابير، ورؤى أكثر ذكاءً للعملاء.
اعرف المزيد
Real-time AI that works with your team

الذكاء الاصطناعي في الرعاية الصحية

قم ببناء حلول الرعاية الصحية مع نماذج Ultralytics YOLO. يعمل الذكاء الاصطناعي البصري في الرعاية الصحية على تعزيز سرعة التصوير الطبي، والتشخيص الأكثر ذكاءً، ومراقبة المرضى.
اعرف المزيد
Real-time AI that works with your team

الذكاء الاصطناعي في التصنيع

حسّن عمليات التصنيع باستخدام نماذج Ultralytics YOLO. تقود الرؤية بالذكاء الاصطناعي مراقبة الجودة، واكتشاف العيوب، والامتثال لمعدات الوقاية الشخصية (PPE)، وأتمتة خطوط التجميع.
اعرف المزيد
Real-time AI that works with your operation

الذكاء الاصطناعي في مجال السيارات

طبق رؤية الحاسوب في مجال السيارات مع نماذج Ultralytics YOLO. يعمل الذكاء الاصطناعي البصري على تعزيز السلامة على الطرق، ومساعدة السائق، وأتمتة المركبات من أجل طرق أكثر ذكاءً.
اعرف المزيد
Real-time AI tailored to your operation

الذكاء الاصطناعي في الزراعة

ادمج الذكاء الاصطناعي البصري في الزراعة الذكية باستخدام نماذج Ultralytics YOLO. عزز مراقبة المحاصيل، وتتبع الماشية، والزراعة الدقيقة للحصول على إنتاجية أعلى وأكثر ذكاءً.
اعرف المزيد
Real-time AI that works with your team

الذكاء الاصطناعي في الروبوتات

شغّل آلات أكثر ذكاءً باستخدام نماذج Ultralytics YOLO. يدفع الذكاء الاصطناعي للرؤية في الروبوتات الملاحة الذاتية، والإدراك، وتتبع الكائنات، والتحكم في الوقت الفعلي.
اعرف المزيد
Real-time AI that works with your team

الذكاء الاصطناعي في الخدمات اللوجستية

بسّط العمليات اللوجستية باستخدام نماذج Ultralytics YOLO. تُمكّن الرؤية بالذكاء الاصطناعي فحص الطرود، والفرز، وتتبع المركبات، ومراقبة السلامة في المستودعات في الوقت الفعلي.
اعرف المزيد
Real-time AI that works with your team

الذكاء الاصطناعي في التجزئة

أعد تصور تجارة التجزئة مع نماذج Ultralytics YOLO. تعزز الرؤية بالذكاء الاصطناعي تتبع المخزون، ومراقبة الأرفف، وإدارة الطوابير، ورؤى أكثر ذكاءً للعملاء.
اعرف المزيد
Real-time AI that works with your team

الذكاء الاصطناعي في الرعاية الصحية

قم ببناء حلول الرعاية الصحية مع نماذج Ultralytics YOLO. يعمل الذكاء الاصطناعي البصري في الرعاية الصحية على تعزيز سرعة التصوير الطبي، والتشخيص الأكثر ذكاءً، ومراقبة المرضى.
اعرف المزيد
Real-time AI that works with your team

الذكاء الاصطناعي في التصنيع

حسّن عمليات التصنيع باستخدام نماذج Ultralytics YOLO. تقود الرؤية بالذكاء الاصطناعي مراقبة الجودة، واكتشاف العيوب، والامتثال لمعدات الوقاية الشخصية (PPE)، وأتمتة خطوط التجميع.
اعرف المزيد
Real-time AI that works with your operation

الذكاء الاصطناعي في مجال السيارات

طبق رؤية الحاسوب في مجال السيارات مع نماذج Ultralytics YOLO. يعمل الذكاء الاصطناعي البصري على تعزيز السلامة على الطرق، ومساعدة السائق، وأتمتة المركبات من أجل طرق أكثر ذكاءً.
اعرف المزيد
Real-time AI tailored to your operation

الذكاء الاصطناعي في الزراعة

ادمج الذكاء الاصطناعي البصري في الزراعة الذكية باستخدام نماذج Ultralytics YOLO. عزز مراقبة المحاصيل، وتتبع الماشية، والزراعة الدقيقة للحصول على إنتاجية أعلى وأكثر ذكاءً.
اعرف المزيد
Real-time AI that works with your team

الذكاء الاصطناعي في الروبوتات

شغّل آلات أكثر ذكاءً باستخدام نماذج Ultralytics YOLO. يدفع الذكاء الاصطناعي للرؤية في الروبوتات الملاحة الذاتية، والإدراك، وتتبع الكائنات، والتحكم في الوقت الفعلي.
اعرف المزيد
Real-time AI that works with your team

الذكاء الاصطناعي في الخدمات اللوجستية

بسّط العمليات اللوجستية باستخدام نماذج Ultralytics YOLO. تُمكّن الرؤية بالذكاء الاصطناعي فحص الطرود، والفرز، وتتبع المركبات، ومراقبة السلامة في المستودعات في الوقت الفعلي.
اعرف المزيد
Real-time AI that works with your team

الذكاء الاصطناعي في التجزئة

أعد تصور تجارة التجزئة مع نماذج Ultralytics YOLO. تعزز الرؤية بالذكاء الاصطناعي تتبع المخزون، ومراقبة الأرفف، وإدارة الطوابير، ورؤى أكثر ذكاءً للعملاء.
اعرف المزيد
Real-time AI that works with your team

الذكاء الاصطناعي في الرعاية الصحية

قم ببناء حلول الرعاية الصحية مع نماذج Ultralytics YOLO. يعمل الذكاء الاصطناعي البصري في الرعاية الصحية على تعزيز سرعة التصوير الطبي، والتشخيص الأكثر ذكاءً، ومراقبة المرضى.
اعرف المزيد
Real-time AI that works with your team

الذكاء الاصطناعي في التصنيع

حسّن عمليات التصنيع باستخدام نماذج Ultralytics YOLO. تقود الرؤية بالذكاء الاصطناعي مراقبة الجودة، واكتشاف العيوب، والامتثال لمعدات الوقاية الشخصية (PPE)، وأتمتة خطوط التجميع.
اعرف المزيد
Real-time AI that works with your operation

الذكاء الاصطناعي في مجال السيارات

طبق رؤية الحاسوب في مجال السيارات مع نماذج Ultralytics YOLO. يعمل الذكاء الاصطناعي البصري على تعزيز السلامة على الطرق، ومساعدة السائق، وأتمتة المركبات من أجل طرق أكثر ذكاءً.
اعرف المزيد
Real-time AI tailored to your operation

الذكاء الاصطناعي في الزراعة

ادمج الذكاء الاصطناعي البصري في الزراعة الذكية باستخدام نماذج Ultralytics YOLO. عزز مراقبة المحاصيل، وتتبع الماشية، والزراعة الدقيقة للحصول على إنتاجية أعلى وأكثر ذكاءً.
اعرف المزيد

لنبنِ مستقبل الذكاء الاصطناعي معاً!

ابدأ رحلتك مع مستقبل تعلم الآلة