ما OpenPose؟ استكشاف محطة بارزة في تقدير الوضعيات
استكشف كيفية استخدام OpenPose لتقدير الوضعيات في تطبيقات الرؤية الحاسوبية. وتعرّف على ميزاته وأهميته في ذكاء الرؤية.

في الوقت الحاضر، تنتشر الصور والكاميرات في كل مكان؛ فهي مدمجة في هواتفنا ومنازلنا وحتى الأماكن العامة. ولا نعتمد عليها لالتقاط اللحظات فحسب، بل لمساعدتنا على فهم العالم من حولنا والتفاعل معه.
في الخفاء، يتيح رؤية الحاسوب، وهي مجال فرعي من الذكاء الاصطناعي (AI)، ذلك من خلال تمكين الآلات من تفسير البيانات المرئية. كما تتيح للأنظمة اكتشاف الكائنات والتعرف على الوجوه وتتبع الحركة، وتؤدي دورًا أساسيًا في كثير من التقنيات التي نستخدمها يوميًا.
بفضل التطورات الحديثة في الذكاء الاصطناعي (AI)، أصبحت نماذج رؤية الحاسوب قادرة على تحليل بيانات ورؤى أكثر تعقيدًا واستخراجها. ومن أمثلة ذلك تقدير الوضعيات، وهي مهمة في رؤية الحاسوب تركز على فهم حركة الإنسان.
يعمل ذلك من خلال تحديد النقاط الرئيسية في الجسم، مثل الكتفين والمرفقين والركبتين، في الصور أو مقاطع الفيديو. ويتيح هذا تحليل كيفية تحرك الأشخاص، مما يمكّن من استخدامه في تتبع اللياقة البدنية والرسوم المتحركة والرعاية الصحية وغيرها.
من بين الأدوات العديدة المطورة لتقدير الوضعيات، يبرز OpenPose بوصفه إنجازًا كبيرًا. وقد أنشأه باحثون في مختبر الحوسبة الإدراكية بجامعة كارنيغي ميلون، وكان من أوائل الأنظمة مفتوحة المصدر القادرة على اكتشاف وضعيات الجسم بالكامل، بما في ذلك اليدان والقدمان والنقاط الرئيسية للوجه، لعدة أشخاص في الوقت الفعلي باستخدام كاميرا واحدة فقط، مع ما يصل إلى 135 نقطة رئيسية لكل شخص.
في هذه المقالة، سنستكشف OpenPose، وآلية عمله، وأهميته بوصفه محطة فارقة في رؤية الحاسوب.

الشكل 1. تقدير وضعيات عدة أشخاص باستخدام OpenPose.
نظرة على تاريخ تقدير الوضعيات#
قبل اعتماد الذكاء الاصطناعي على نطاق واسع، كان تتبع حركة الإنسان في مقاطع الفيديو يتطلب استخدام معدات متخصصة. ففي صناعات مثل السينما والرسوم المتحركة، كان الممثلون يرتدون غالبًا بدلات مزودة بعلامات عاكسة لكي تتمكن الكاميرات من التقاط حركاتهم في بيئة استوديو مضبوطة.
على الرغم من دقة تقنيات التقاط الحركة المعتمدة على العلامات، فإنها كانت مكلفة ومحدودة بإعدادات معينة. ومع تطور رؤية الحاسوب، بحث الباحثون عن طرق لتتبع حركة الجسم دون استخدام العلامات. فاستخدموا الحواف والخطوط المحيطية والقوالب للعثور على أشكال البشر في الصور.
عملت هذه الأنظمة المبكرة في الحالات البسيطة والمباشرة، لكنها واجهت صعوبات في سيناريوهات العالم الحقيقي. وغالبًا ما قدمت نتائج ضعيفة عندما تحرك الأشخاص بطرق غير متوقعة أو عندما ظهر أكثر من شخص في الإطار.
في أواخر العقد الثاني من القرن الحادي والعشرين، أحدث التعلم العميق تحولًا كبيرًا في تقدير الوضعيات. إذ أمكن تدريب نماذج الذكاء الاصطناعي المرئي على مجموعات بيانات كبيرة لوضعيات البشر. وبدلًا من الاعتماد على الحواف والقوالب، تعلمت النماذج التعرف على مفاصل الجسم وبنيته من خلال دراسة آلاف الصور المصنفة. وجعل ذلك تقدير الوضعيات أكثر دقة ومرونة وتأثيرًا في نطاق أوسع من البيئات.

الشكل 2. تطور نماذج تقدير وضعيات البشر من عام 2017 إلى عام 2023.
OpenPose: انطلاقة تقدير الوضعيات الحديث#
أُصدر OpenPose لأول مرة في عام 2017، وهو قادر على تقدير وضعيات عدة أشخاص في الوقت نفسه ضمن صورة واحدة. وعلى خلاف الأنظمة الأقدم، لا يتطلب OpenPose بدلات أو علامات خاصة. فهو يعمل باستخدام الكاميرات العادية ويمكنه معالجة الصور ومقاطع الفيديو في الوقت الفعلي. وقد جعلت هذه الميزات تقدير الوضعيات أكثر إتاحة للمطورين والباحثين.
ساعد الأساس الذي أرساه OpenPose لرؤية الحاسوب الآخرين على بناء بنيات أحدث لمجموعة متنوعة من التطبيقات الأخرى. واليوم، تقدم نماذج الذكاء الاصطناعي المرئي مثل Ultralytics YOLOv8 وUltralytics YOLO11، التي تدعم مهام تقدير الوضعيات، نتائج أسرع وزمن استجابة أقل.

الشكل 3. استخدام YOLO11 لتقدير الوضعيات.
ومع ذلك، يمثل OpenPose نقطة بداية رائعة إذا كنت مهتمًا بكيفية تطور تقدير الوضعيات. فقد قدم أفكارًا أساسية لا تزال العديد من الأنظمة الأحدث تعتمد عليها حتى اليوم.
القدرات الرئيسية لـ OpenPose#
بعد أن أصبح لدينا فهم أفضل لأهمية OpenPose، دعونا نلقِ نظرة فاحصة على ما يستطيع فعله فعليًا.
في صميم قدرات OpenPose مفهوم يُسمى اكتشاف النقاط الرئيسية. والنقاط الرئيسية هي معالم محددة في جسم الإنسان، مثل طرف الأنف، ومركز الكتفين، والمرفقين، والمعصمين، والوركين، والركبتين، والكاحلين. ويمكن لـ OpenPose اكتشاف ما يصل إلى 135 نقطة من هذه النقاط لكل شخص، بما في ذلك مناطق دقيقة مثل الأصابع وملامح الوجه.
عند توصيل هذه النقاط، فإنها تشكل تمثيلًا مبسطًا لجسم الإنسان؛ ويمكنك اعتباره هيكلًا عظميًا رقميًا. ويوضح هذا المخطط الهيكلي ليس فقط مكان وجود الشخص، بل وضعية جسمه أيضًا: هل يجلس أم يقف أم يلوّح أم يبتسم أم يمشي. ويمكن للحواسيب تفسير حركة الإنسان بصريًا باستخدام هذه الهياكل العظمية، تمامًا كما نفهم لغة جسد شخص ما بصورة فطرية.
يُعد تتبع الهيكل العظمي مفيدًا بصفة خاصة لأنه يزيل ضوضاء الخلفية وعناصر التشتيت، مما يتيح للنظام التركيز على وضعية الإنسان وحركته فحسب. وبدلًا من تحليل كل بكسل، يركز OpenPose على نقاط ذات معنى توضح كيفية تحرك الشخص أو تفاعله.
ومن خلال استخراج هذه المعلومات المنظمة من الصور أو مقاطع الفيديو اليومية، يجعل OpenPose من الممكن بناء تطبيقات تستجيب للإيماءات، وتراقب النشاط البدني، وتقيّم الإشارات العاطفية، أو حتى تحرك الشخصيات الرقمية.
كيف يعمل OpenPose؟#
فيما يلي نظرة عامة على كيفية اكتشاف OpenPose للنقاط الرئيسية في جسم الإنسان وربطها انطلاقًا من المدخلات المرئية:
- يبدأ بصورة: يأخذ OpenPose صورة واحدة من صورة فوتوغرافية أو مقطع فيديو أو بث كاميرا مباشر.
- يحدد أجزاء الجسم المهمة: يبحث النظام عن النقاط الرئيسية في الجسم، مثل الأنف والمرفقين والمعصمين والركبتين والكاحلين. ويحدد موضعها حيثما يكون النظام واثقًا من وجود جزء من أجزاء الجسم.
- يحدد الأجزاء التي تنتمي معًا: بعد ذلك، يفحص OpenPose كيفية اتصال النقاط الرئيسية. ويستخدم حسابات رياضية لتحديد المفاصل التي تنتمي إلى الشخص نفسه؛ مثل مطابقة المعصم بالمرفق والكتف الأيمنين.
- يرسم هيكلًا عظميًا لكل شخص: بعد تجميع النقاط الرئيسية، يربطها OpenPose في شكل "عصا" يوضح وضعية كل شخص. ويعمل ذلك حتى عند ظهور عدة أشخاص في الإطار نفسه.
- يعيد بيانات الوضعية: أخيرًا، يوفر المواضع الدقيقة لجميع النقاط الرئيسية المكتشفة. ويمكن استخدام هذه البيانات لتتبع الحركة أو التعرف على الإيماءات أو بناء أدوات تفاعلية، وكل ذلك في الوقت الفعلي.

الشكل 4. اكتشاف النقاط الرئيسية للإنسان وتتبعها باستخدام OpenPose.
تطبيقات تقدير الوضعيات في مختلف القطاعات باستخدام OpenPose#
كان OpenPose من أوائل الأدوات المتقدمة التي جعلت تقدير الوضعيات عمليًا لمجموعة متنوعة من حالات الاستخدام في العالم الحقيقي. وعلى الرغم من أنه لا يُستخدم عادةً اليوم في حلول رؤية الحاسوب الآنية، فإنه أدى دورًا مهمًا في تشكيل الأعمال المبكرة في مجالات مثل الرياضة والترفيه والتعليم والسلامة.
دعونا نلقِ نظرة فاحصة على كيفية مساهمته في تمهيد الطريق في هذه المجالات.
تقدير الوضعيات باستخدام OpenPose للياقة البدنية والرياضة#
عندما تشاهد لعبة بيسبول، فمن السهل فهم ما يحدث؛ إذ يمكنك التعرف فورًا على الرمية أو الضربة أو سرقة القاعدة. فنحن كبشر نقرأ حركات الجسم بصورة حدسية ونفهمها دون جهد كبير. أما بالنسبة إلى الآلات، فإن التعرف على هذه الأفعال أكثر تعقيدًا بكثير، إذ تحتاج إلى معلومات دقيقة حول كيفية تحرك كل جزء من أجزاء الجسم في الفضاء.
كان OpenPose خطوة كبيرة إلى الأمام في هذا المجال من رؤية الحاسوب. فقد كان أداة عملية لتحليل الأداء الرياضي في مجموعة متنوعة من البيئات.
استخدمت العديد من المشاريع البحثية OpenPose لتحليل حركات مثل الضربات والقفزات، بل وصنفت أفعالًا محددة في لعبة البيسبول استنادًا إلى طريقة تحرك اللاعبين. وبما أنه كان يعمل في بيئات مفتوحة باستخدام فيديو عادي، فقد أتاح للباحثين اختبار كيفية عمل هذه الأنظمة في سيناريوهات التدريب أو التوجيه الواقعية.
ساعدت هذه الدراسات المبكرة في وضع الأساس لأدوات تتبع الأداء المستخدمة حاليًا في التقنيات الرياضية المتقدمة.

الشكل 5. نظرة على خط أنابيب لتصنيف أفعال البيسبول باستخدام OpenPose.
استخدام OpenPose في أنظمة الأمن والسلامة#
وبالمثل، استخدم الباحثون OpenPose أيضًا لاستكشاف كيفية دعم تتبع الوضعيات المعتمد على الفيديو لمراقبة السلامة. وقد اختُبر في اكتشاف السلوكيات مثل السقوط والإيماءات غير المتوقعة أو أنماط الحركة في المناطق العامة.
وبما أنه كان يعمل باستخدام الكاميرات العادية، جعل OpenPose التجارب المبكرة أكثر إتاحة في بيئات مثل المستشفيات ومراكز النقل. وقد ساعدت هذه الدراسات في دفع تطوير نماذج أحدث تُستخدم حاليًا في أنظمة المراقبة واكتشاف السقوط والاستجابة لحالات الطوارئ.

الشكل 6. اكتشاف السقوط باستخدام OpenPose.
إيجابيات OpenPose وسلبياته#
فيما يلي لمحة عن بعض المزايا التي يوفرها OpenPose:
- مفيد للبحث وإنشاء النماذج الأولية: استُخدم على نطاق واسع في الأبحاث الأكاديمية، ولا سيما في مجالات مثل التفاعل بين الإنسان والحاسوب والميكانيكا الحيوية وتحليل السلوك.
- دعم متعدد المنصات: يمكن تشغيله على Windows وLinux وmacOS، مع دعم كل من وحدات المعالجة المركزية (CPUs) ووحدات معالجة الرسومات (GPUs).
- إمكانية المعالجة دون اتصال: يمكن تشغيله في بيئات لا تتوفر فيها إمكانية الوصول إلى الإنترنت، مما يجعله مثاليًا للإعدادات الحساسة للخصوصية، مثل الرعاية الصحية أو التعليم.
على الرغم من أن OpenPose كان خطوة كبيرة إلى الأمام، فإنه يعاني أيضًا من قيود تقنية مهمة ينبغي وضعها في الاعتبار. فيما يلي بعض التحديات الرئيسية المرتبطة بـ OpenPose:
- متطلبات معالجة مرتفعة: يتطلب تشغيل OpenPose في الوقت الفعلي وحدة GPU قوية وموارد حوسبة كبيرة.
- حساس للبيئة: قد ينخفض الأداء في ظروف الإضاءة المنخفضة أو الأماكن المزدحمة أو عندما لا تكون زوايا الكاميرا مثالية.
- ثقيل مقارنةً بالنماذج الأحدث: مقارنةً بنماذج تقدير الوضعيات الأحدث، يُعد OpenPose كبيرًا نسبيًا وأبطأ. ولا يناسب جيدًا النشر على الأجهزة محدودة الموارد، مثل الهواتف الذكية والأجهزة اللوحية والأنظمة المضمنة.
أهم النقاط المستخلصة#
أدى OpenPose دورًا مهمًا في جعل تقدير الوضعيات أكثر إتاحة. فقد أظهر إمكانية تتبع حركات الجسم باستخدام كاميرا بسيطة، دون الاعتماد على البدلات أو المعدات المتخصصة.
وقد أرسى الأساس للعديد من التطبيقات العملية في مجالات الرعاية الصحية والتعليم والترفيه والبحث. وعلى الرغم من أن النماذج الأحدث توفر الآن سرعات أكبر وأداءً أخف، يظل OpenPose مرجعًا أساسيًا لفهم كيفية تطور تقدير الوضعيات.
انضم إلى مجتمعنا وتفضل بزيارة مستودع GitHub الخاص بنا لمعرفة المزيد عن الذكاء الاصطناعي (AI). وإذا كنت تتطلع إلى بناء حلولك الخاصة في مجال رؤية الحاسوب، فاستكشف خيارات الترخيص لدينا. وتعرّف أيضًا على كيفية إحداث رؤية الحاسوب في الرعاية الصحية والذكاء الاصطناعي في الخدمات اللوجستية تأثيرًا ملموسًا!









