استكشاف أنواع مختلفة من البيانات لتطبيقات الذكاء الاصطناعي للرؤية
اكتشف كيف تتيح أنواع البيانات المرئية، مثل التصوير الحراري وLiDAR والصور بالأشعة تحت الحمراء، تطبيقات متنوعة للرؤية الحاسوبية عبر القطاعات.

كانت تقنيات مثل الطائرات المسيّرة محدودة الاستخدام ومتاحة للباحثين والمتخصصين فقط، لكن العتاد المتطور أصبح اليوم في متناول جمهور أوسع. ويغيّر هذا التحول طريقة جمعنا للبيانات المرئية. ومع سهولة الوصول إلى التقنيات، أصبح بإمكاننا الآن التقاط الصور ومقاطع الفيديو من مصادر متنوعة، وليس من الكاميرات التقليدية فحسب.
وبالتوازي، يتطور تحليل الصور، المدعوم بـالرؤية الحاسوبية، وهي فرع من فروع الذكاء الاصطناعي (AI)، بسرعة، مما يتيح للآلات تفسير البيانات المرئية ومعالجتها بفاعلية أكبر. وقد أتاح هذا التقدم إمكانات جديدة للأتمتة واكتشاف الأجسام والتحليل في الوقت الفعلي. ويمكن للآلات الآن التعرّف على الأنماط وتتبع الحركة وفهم المدخلات المرئية المعقدة.
تشمل بعض الأنواع الأساسية من البيانات المرئية صور RGB، التي تُستخدم عادةً للتعرّف على الأجسام، والتصوير الحراري، الذي يساعد على اكتشاف البصمات الحرارية في ظروف الإضاءة المنخفضة، وبيانات العمق، التي تمكّن الآلات من فهم البيئات ثلاثية الأبعاد. ويؤدي كل نوع من أنواع البيانات هذه دورًا حيويًا في تشغيل مختلف تطبيقات الذكاء الاصطناعي للرؤية، بدءًا من المراقبة ووصولًا إلى التصوير الطبي.
في هذه المقالة، سنستكشف الأنواع الأساسية من البيانات المرئية المستخدمة في الذكاء الاصطناعي للرؤية، وكيف يسهم كل منها في تحسين الدقة والكفاءة والأداء عبر مختلف القطاعات. لنبدأ!
أكثر أنواع مجموعات بيانات الصور ومقاطع الفيديو للذكاء الاصطناعي شيوعًا#
عادةً، عندما تستخدم هاتفًا ذكيًا لالتقاط صورة أو مشاهدة لقطات كاميرات المراقبة، فأنت تتعامل مع صور RGB. ويرمز RGB إلى الأحمر والأخضر والأزرق، وهي قنوات الألوان الثلاث التي تمثل المعلومات المرئية في الصور الرقمية.
ترتبط صور RGB ومقاطع الفيديو ارتباطًا وثيقًا بوصفهما نوعين من البيانات المرئية المستخدمة في الرؤية الحاسوبية، وكلاهما يُلتقط باستخدام الكاميرات القياسية. ويتمثل الفرق الأساسي في أن الصور تلتقط لحظة واحدة، بينما تكون مقاطع الفيديو سلسلة من الإطارات التي تُظهر كيفية تغير الأشياء بمرور الوقت.
تُستخدم صور RGB عمومًا في مهام الرؤية الحاسوبية مثل اكتشاف الأجسام وتقسيم المثيلات وتقدير الوضعية، بدعم من نماذج مثل Ultralytics YOLO11. وتعتمد هذه التطبيقات على تحديد الأنماط أو الأشكال أو السمات المحددة في إطار واحد.
أما مقاطع الفيديو فهي ضرورية عندما تكون الحركة أو الزمن عاملًا مؤثرًا، كما في التعرّف على الإيماءات والمراقبة وتتبع الأفعال. وبما أنه يمكن اعتبار مقاطع الفيديو سلسلة من الصور، تعالج نماذج الرؤية الحاسوبية مثل Ultralytics YOLO11 مقاطع الفيديو إطارًا تلو الآخر لفهم الحركة والسلوك بمرور الوقت.
فعلى سبيل المثال، يمكن استخدام Ultralytics YOLO11 لتحليل صور RGB أو مقاطع الفيديو لاكتشاف الأعشاب الضارة وعدّ النباتات في الحقول الزراعية. ويسهم ذلك في تعزيز مراقبة المحاصيل وتتبع التغيرات عبر دورات النمو لتحسين إدارة المزارع.

الشكل 1. يستطيع YOLO11 اكتشاف النباتات وعدّها لمراقبة المحاصيل بذكاء أكبر.
بيانات العمق في الذكاء الاصطناعي للرؤية: LiDAR والإدراك ثلاثي الأبعاد#
تضيف بيانات العمق بُعدًا ثالثًا إلى المعلومات المرئية من خلال توضيح مدى بُعد الأجسام عن الكاميرا أو المستشعر. وعلى خلاف صور RGB التي تلتقط الألوان والأنسجة فقط، توفر بيانات العمق سياقًا مكانيًا. فهي توضح المسافة بين الأجسام والكاميرا، مما يجعل تفسير التخطيط ثلاثي الأبعاد للمشهد ممكنًا.
يُلتقط هذا النوع من البيانات باستخدام تقنيات مثل LiDAR والرؤية المجسمة (باستخدام كاميرتين لمحاكاة إدراك الإنسان للعمق) وكاميرات زمن الرحلة (لقياس الوقت الذي يستغرقه الضوء للوصول إلى جسم والعودة منه).
ومن بين هذه التقنيات، غالبًا ما يكون LiDAR (كشف الضوء وتحديد المدى) الأكثر موثوقية لقياس العمق. إذ يرسل نبضات ليزر سريعة ويقيس المدة التي تستغرقها للارتداد. والنتيجة خريطة ثلاثية الأبعاد عالية الدقة تُعرف باسم سحابة نقطية، وتبرز شكل الأجسام وموضعها ومسافتها في الوقت الفعلي.
الدور المتنامي لتقنية LiDAR في أنظمة الذكاء الاصطناعي للرؤية#
يمكن تقسيم تقنية LiDAR إلى نوعين رئيسيين، صُمم كل منهما لتطبيقات وبيئات محددة. وفيما يلي نظرة أقرب على النوعين:
- LiDAR المحمول جوًا: يُستخدم عادةً لرسم خرائط للمناطق الكبيرة، إذ تُثبّت ماسحات LiDAR المحمولة جوًا على الطائرات المسيّرة أو الطائرات لالتقاط بيانات عالية الدقة من أجل رسم الخرائط الطبوغرافية على نطاق واسع. وهو مثالي لمسح التضاريس والغابات والمناظر الطبيعية.
- LiDAR الأرضي: يُجمع هذا النوع من بيانات LiDAR من مستشعرات مثبّتة على مركبات أو منصات ثابتة لتطبيقات مثل مراقبة البنية التحتية والإنشاءات ورسم الخرائط الداخلية. ويوفر بيانات مفصلة للغاية للمناطق الأصغر والمحلية، مما يجعله مفيدًا لمهام مثل تخطيط المدن ومسح هياكل محددة.
من التطبيقات المؤثرة لبيانات LiDAR المركبات ذاتية القيادة، حيث تؤدي دورًا رئيسيًا في مهام مثل اكتشاف المسارات وتجنب الاصطدام وتحديد الأجسام القريبة. وينشئ LiDAR خرائط ثلاثية الأبعاد مفصلة للبيئة في الوقت الفعلي، مما يمكّن المركبة من رؤية الأجسام وحساب مسافاتها والتنقل بأمان.

الشكل 2. تمكّن تقنية LiDAR المركبات ذاتية القيادة من رسم خريطة للعمق واكتشاف الأجسام.
استخدام البيانات الحرارية وتحت الحمراء في تطبيقات الذكاء الاصطناعي#
تلتقط صور RGB ما نراه ضمن طيف الضوء المرئي، إلا أن تقنيات التصوير الأخرى، مثل التصوير الحراري والتصوير بالأشعة تحت الحمراء، تتجاوز ذلك. يلتقط التصوير بالأشعة تحت الحمراء الضوء تحت الأحمر المنبعث من الأجسام أو المنعكس عنها، مما يجعله مفيدًا في ظروف الإضاءة المنخفضة.
وعلى النقيض، يكتشف التصوير الحراري الحرارة المنبعثة من الأجسام ويُظهر فروق درجات الحرارة، مما يتيح له العمل في الظلام الدامس أو عبر الدخان والضباب والعوائق الأخرى. ويفيد هذا النوع من البيانات بصفة خاصة في مراقبة المشكلات واكتشافها، ولا سيما في القطاعات التي قد تشير فيها تغيرات درجات الحرارة إلى مشكلات محتملة.
ومن الأمثلة المثيرة للاهتمام استخدام التصوير الحراري لمراقبة المكوّنات الكهربائية بحثًا عن علامات ارتفاع درجة الحرارة. فمن خلال اكتشاف فروق درجات الحرارة، تستطيع الكاميرات الحرارية تحديد المشكلات قبل أن تؤدي إلى تعطل المعدات أو نشوب الحرائق أو حدوث أضرار باهظة.

الشكل 3. مثال على استخدام التصوير الحراري لمراقبة المكوّنات الكهربائية.
وبالمثل، يمكن أن تساعد صور الأشعة تحت الحمراء على اكتشاف التسربات في خطوط الأنابيب أو مواد العزل من خلال تحديد فروق درجات الحرارة التي تشير إلى تسرّب الغازات أو السوائل، وهو أمر بالغ الأهمية لمنع المواقف الخطرة وتحسين كفاءة الطاقة.
التصوير متعدد الأطياف وفائق الأطياف في الذكاء الاصطناعي#
بينما يلتقط التصوير بالأشعة تحت الحمراء والتصوير الحراري جوانب محددة من الطيف الكهرومغناطيسي، يجمع التصوير متعدد الأطياف الضوء من نطاقات قليلة مختارة من الأطوال الموجية، يُختار كل منها لغرض محدد، مثل اكتشاف النباتات السليمة أو تحديد مواد السطح.
يذهب التصوير فائق الأطياف خطوة أبعد من ذلك، إذ يلتقط الضوء عبر مئات النطاقات الضيقة جدًا والمتصلة من الأطوال الموجية. ويوفر ذلك بصمة ضوئية مفصلة لكل بكسل في الصورة، مما يتيح فهمًا أعمق بكثير لأي مادة قيد الرصد.

الشكل 4. مقارنة بين التصوير متعدد الأطياف والتصوير فائق الأطياف.
يستخدم كل من التصوير متعدد الأطياف والتصوير فائق الأطياف مستشعرات ومرشحات خاصة لالتقاط الضوء عند أطوال موجية مختلفة. ثم تُنظّم البيانات في بنية ثلاثية الأبعاد تُسمى المكعب الطيفي، وتمثل كل طبقة منها طولًا موجيًا مختلفًا.
يمكن لنماذج الذكاء الاصطناعي تحليل هذه البيانات لاكتشاف سمات لا تستطيع الكاميرات العادية أو العين البشرية رؤيتها. فعلى سبيل المثال، في التنميط الظاهري للنباتات، يمكن استخدام التصوير فائق الأطياف لمراقبة صحة النباتات ونموها من خلال اكتشاف التغيرات الطفيفة في أوراقها أو سيقانها، مثل نقص العناصر الغذائية أو الإجهاد. ويساعد ذلك الباحثين على تقييم صحة النباتات وتحسين الممارسات الزراعية دون الحاجة إلى أساليب تدخلية.
تحليل التصوير الراداري والسوناري باستخدام الذكاء الاصطناعي#
التصوير الراداري والتصوير السوناري تقنيتان تكتشفان الأجسام وترسمان خرائطها من خلال إرسال إشارات وتحليل انعكاساتها، على نحو مشابه لـ LiDAR. وعلى خلاف تصوير RGB الذي يعتمد على موجات الضوء لالتقاط المعلومات المرئية، يستخدم الرادار الموجات الكهرومغناطيسية، وعادةً الموجات الراديوية، بينما يستخدم السونار الموجات الصوتية. ويصدر كلا النظامين نبضات ويقيسان الوقت الذي تستغرقه الإشارة للارتداد عن جسم ما، مما يوفر معلومات عن مسافته وحجمه وسرعته.
يفيد التصوير الراداري بصفة خاصة عندما تكون الرؤية ضعيفة، مثل حالات الضباب أو المطر أو الليل. وبما أنه لا يعتمد على الضوء، يمكنه اكتشاف الطائرات أو المركبات أو التضاريس في الظلام الدامس. وهذا يجعل الرادار خيارًا موثوقًا في الطيران ومراقبة الطقس والملاحة الذاتية.
وبالمقارنة، يُستخدم التصوير السوناري عادةً في البيئات تحت الماء حيث لا يستطيع الضوء الوصول. إذ يستخدم موجات صوتية تنتقل عبر الماء وترتد عن الأجسام المغمورة، مما يتيح اكتشاف الغواصات ورسم خرائط قاع المحيطات وتنفيذ مهام الإنقاذ تحت الماء. وتتيح التطورات في الرؤية الحاسوبية الآن تحسين الاكتشاف تحت الماء بدرجة أكبر من خلال دمج بيانات السونار مع التحليل الذكي لتحسين الاكتشاف واتخاذ القرارات.

الشكل 5. كيفية استخدام نظام SONAR لنبضات الموجات فوق الصوتية لقياس عمق البحر. (المصدر: bbc.co.uk)
البيانات المرئية الاصطناعية والمحاكاة لتدريب نماذج الذكاء الاصطناعي#
حتى الآن، كانت أنواع البيانات المختلفة التي ناقشناها هي البيانات التي يمكن جمعها من العالم الحقيقي. أما البيانات المرئية الاصطناعية وبيانات المحاكاة فهما نوعان من المحتوى الاصطناعي. تُنشأ البيانات الاصطناعية من الصفر باستخدام النمذجة ثلاثية الأبعاد أو الذكاء الاصطناعي التوليدي لإنتاج صور أو مقاطع فيديو تبدو واقعية.

الشكل 6. نظرة على الصور المُنشأة اصطناعيًا.
تشبه بيانات المحاكاة ذلك، لكنها تتضمن إنشاء بيئات افتراضية تحاكي كيفية تصرف العالم المادي، بما في ذلك انعكاس الضوء وتكوّن الظلال وحركة الأجسام. وبينما تكون جميع البيانات المرئية المُحاكاة اصطناعية، فليست كل البيانات الاصطناعية مُحاكاة. ويتمثل الفرق الأساسي في أن بيانات المحاكاة تكرر السلوك الواقعي، لا المظهر فحسب.
تفيد أنواع البيانات هذه في تدريب نماذج الرؤية الحاسوبية، ولا سيما عندما يصعب جمع البيانات من العالم الحقيقي أو عند الحاجة إلى محاكاة حالات محددة ونادرة. ويمكن للمطورين إنشاء مشاهد كاملة واختيار أنواع الأجسام ومواضعها والإضاءة، وإضافة تسميات مثل مربعات الإحاطة تلقائيًا لأغراض التدريب. ويساعد ذلك على إنشاء مجموعات بيانات كبيرة ومتنوعة بسرعة، دون الحاجة إلى صور حقيقية أو وضع تسميات يدويًا، وهي عملية قد تكون مكلفة وتستغرق وقتًا طويلًا.
فعلى سبيل المثال، في مجال الرعاية الصحية، يمكن استخدام البيانات الاصطناعية لتدريب نماذج على تقسيم خلايا سرطان الثدي، حيث يصعب جمع مجموعات بيانات كبيرة من الصور الحقيقية ووضع تسميات لها. وتوفر البيانات الاصطناعية وبيانات المحاكاة المرونة والتحكم، وتسدان الفجوات عندما تكون المرئيات من العالم الحقيقي محدودة.
اختيار نوع البيانات المرئية المناسب لتطبيق الذكاء الاصطناعي الخاص بك#
بعد أن استعرضنا كيفية عمل الأنواع المختلفة من البيانات المرئية وما يمكنها فعله، فلنلقِ نظرة أقرب على أنواع البيانات الأنسب لمهام محددة:
- صور RGB: هي مثالية لمهام الرؤية الحاسوبية العامة مثل تصنيف الصور واكتشاف الأجسام. فهي تلتقط الألوان والأنسجة، لكنها محدودة في الظروف الصعبة مثل الإضاءة المنخفضة أو ضعف الرؤية.
- التصوير بتقنية LiDAR: يوفر هذا النوع من التصوير رسم خرائط ثلاثية الأبعاد عالي الدقة باستخدام نبضات الليزر. وهو مناسب جدًا للتطبيقات التي تتطلب قياسات دقيقة للمسافات، مثل الروبوتات والمركبات ذاتية القيادة وفحص البنية التحتية.
- التصوير الحراري: بما أنه يستطيع اكتشاف فروق درجات الحرارة، فهو مفيد في ظروف ضعف الرؤية، مثل المراقبة الليلية ومكافحة الحرائق أو اكتشاف تسربات الحرارة في الآلات والمباني.
- التصوير متعدد الأطياف وفائق الأطياف: يفيد في المهام التي تتطلب تحليلًا مفصلًا للمواد، مثل المراقبة الزراعية ومراقبة جودة المستحضرات الصيدلانية أو الاستشعار عن بُعد. وتوفر هذه الأساليب رؤى أعمق من خلال التقاط البيانات عبر نطاق واسع من الأطوال الموجية يتجاوز الضوء المرئي.
- التصوير الراداري والسوناري: يُفضّل استخدامهما في البيئات ضعيفة الرؤية. ويستخدم الرادار الموجات الراديوية ويفيد في الطيران والملاحة، بينما يستخدم السونار الموجات الصوتية لإجراء الاكتشاف تحت الماء.
- البيانات المرئية الاصطناعية وبيانات المحاكاة: هي مثالية لـتدريب نماذج الذكاء الاصطناعي عندما تكون البيانات من العالم الحقيقي محدودة أو غير متاحة أو يصعب وضع تسميات لها. وتساعد هذه المرئيات الاصطناعية على بناء مجموعات بيانات متنوعة لسيناريوهات معقدة مثل الأحداث النادرة أو الظروف الحرجة للسلامة.
في بعض الأحيان، قد لا يوفر نوع واحد من البيانات دقة أو سياقًا كافيًا في مواقف العالم الحقيقي. وهنا يصبح دمج المستشعرات متعددة الوسائط عنصرًا أساسيًا. فمن خلال دمج RGB مع أنواع بيانات أخرى مثل البيانات الحرارية أو بيانات العمق أو LiDAR، تستطيع الأنظمة التغلب على القيود الفردية، مما يحسن موثوقيتها وقدرتها على التكيف.
فعلى سبيل المثال، في أتمتة المستودعات، يجعل استخدام RGB للتعرّف على الأجسام والعمق لقياس المسافات والبيانات الحرارية لاكتشاف المعدات التي ترتفع حرارتها العمليات أكثر كفاءة وأمانًا. وفي النهاية، تتحقق أفضل النتائج من خلال اختيار أنواع البيانات أو دمجها استنادًا إلى الاحتياجات المحددة لتطبيقك.
أهم النقاط المستخلصة#
عند بناء نماذج الذكاء الاصطناعي للرؤية، يُعد اختيار النوع المناسب من البيانات المرئية أمرًا بالغ الأهمية. فمهام مثل اكتشاف الأجسام والتقسيم وتتبع الحركة لا تعتمد على الخوارزميات فحسب، بل تعتمد أيضًا على جودة بيانات الإدخال. وتساعد مجموعات البيانات النظيفة والمتنوعة والدقيقة على تقليل الضوضاء وتحسين الأداء.
من خلال دمج أنواع البيانات مثل RGB والعمق والبيانات الحرارية وLiDAR، تحصل أنظمة الذكاء الاصطناعي على رؤية أشمل للبيئة، مما يجعلها أكثر موثوقية في مختلف الظروف. ومع استمرار تحسن التقنية، فمن المرجح أن تمهّد الطريق أمام الذكاء الاصطناعي للرؤية ليصبح أسرع وأكثر قابلية للتكيف وتأثيرًا في مختلف القطاعات.
انضم إلى مجتمعنا واستكشف مستودعنا على GitHub لمعرفة المزيد عن الرؤية الحاسوبية. اكتشف مختلف التطبيقات المرتبطة بـالذكاء الاصطناعي في الرعاية الصحية والرؤية الحاسوبية في قطاع التجزئة في صفحات حلولنا. اطّلع على خيارات الترخيص للبدء باستخدام الذكاء الاصطناعي للرؤية.









