الرؤية الحاسوبية مقابل معالجة الصور: الفروقات الرئيسية
استكشف الفرق بين الرؤية الحاسوبية ومعالجة الصور. تعرّف على كيفية عملهما معًا لتعزيز البيانات المرئية، مثل الصور ومقاطع الفيديو، وتحليلها.

هل أصبحت الكاميرات أكثر ذكاءً، أم أنها تتحسن فحسب في تحسين الصور؟ يتوقف الأمر برمته على كيفية معالجتها للبيانات المرئية وتنقيحها.
في صميم هذا التطور تقنيتان أساسيتان: معالجة الصور والرؤية الحاسوبية. وغالبًا ما يُذكران معًا، لكن لكل منهما أهداف مختلفة. تركز معالجة الصور على تحسين الصور، وضبط السطوع، وزيادة حدة التفاصيل، وتقليل التشويش، من دون فهم ما تحتويه بالضرورة.
أما الرؤية الحاسوبية، فتتجاوز ذلك بتمكين الآلات من التعرّف على الصور ومقاطع الفيديو وتفسيرها كما يفعل البشر. وهذا يجعل مهامًا مثل التعرّف على الوجوه، واكتشاف الأجسام، وتحليل المشاهد في الوقت الفعلي ممكنة.
أصبحت كلتا التقنيتين ضروريتين في مجموعة متنوعة من القطاعات. فمن تحسين صور الهواتف الذكية إلى تشغيل السيارات ذاتية القيادة، يمتد تأثيرهما على نطاق واسع. وبحلول عام 2033، يُتوقع أن تبلغ سوق الرؤية الحاسوبية 111.43 مليار دولار، بينما يُرجح أن تنمو سوق معالجة الصور الرقمية إلى 378.71 مليار دولار بحلول عام 2034.
في هذه المقالة، سنستكشف كيفية عمل معالجة الصور والرؤية الحاسوبية، وتطبيقاتهما في العالم الحقيقي، وأوجه التداخل بينهما. لنبدأ!
نظرة عامة: الرؤية الحاسوبية مقابل معالجة الصور#
تتعامل الرؤية الحاسوبية ومعالجة الصور مع الصور، لكن لهما أهدافًا مختلفة. تساعد الرؤية الحاسوبية الآلات على فهم الصور أو مقاطع الفيديو واتخاذ القرارات بناءً عليها. في المقابل، تركز معالجة الصور على تحسين الصورة أو تغييرها لجعلها أوضح أو أكثر جاذبية بصريًا، من دون تفسير محتواها.
إضافةً إلى ذلك، تستفيد حلول الرؤية الحاسوبية من نماذج مثل Ultralytics YOLO11 لتحليل محتويات الصورة وفهمها. تشمل مهام الرؤية الحاسوبية الشائعة اكتشاف الأجسام، وتصنيف الصور، وتقسيم المثيلات، وتتبع الأجسام. وتُستخدم الرؤية الحاسوبية على نطاق واسع في تطبيقات مثل السيارات ذاتية القيادة، حيث تساعد على التعرّف على المشاة، وإشارات المرور، والمركبات الأخرى في الوقت الفعلي لضمان قيادة آمنة.
من ناحية أخرى، تركز معالجة الصور على تعديل الصور باستخدام دوال رياضية تضبط قيم البكسلات من دون فهم الصورة ككل فعليًا. تعمل تقنيات مثل تقليل التشويش، وزيادة الحدة، وتحسين التباين على تغيير ألوان البكسلات الفردية وشدتها لتحسين جودة الصورة، لكنها لا تتعرّف على الأجسام أو الأشكال أو المعنى داخل الصورة. وتتولى الرؤية الحاسوبية هذا المستوى من الفهم.

الشكل 1. مقارنة بين الرؤية الحاسوبية ومعالجة الصور. الصورة من إعداد المؤلف.
يمكنك التفكير في معالجة الصور على أنها مجموعة الأدوات التي تحسّن الصورة وتجعلها أوضح أو أكثر جاذبية بصريًا. وبعد معالجة الصورة، يمكن للرؤية الحاسوبية أن تؤدي دور الدماغ الذي يحلل الصور لتنفيذ مهام مختلفة.
كيف تعمل معالجة الصور#
تُعد معالجة الصور مفهومًا أساسيًا أرسى الأساس لتطوير الرؤية الحاسوبية. وهي تتضمن استخدام الخوارزميات لتحسين البيانات المرئية، مثل الصور ومقاطع الفيديو، أو تحليلها أو تعديلها. ويمكنها معالجة الصور الرقمية وتحسينها عبر ضبط معلمات مثل السطوع والتباين وتوازن الألوان، أو تصفية التشويش. وتُعد هذه الأساليب الصور لمزيد من التحليل المتقدم بواسطة نماذج الرؤية الحاسوبية.
تعمل معالجة الصور على تفكيك الصور إلى بكسلات فردية، ثم معالجة كل منها للحصول على التأثيرات المطلوبة. فعلى سبيل المثال، لاكتشاف الحواف، تتحقق الخوارزميات من وجود تغيرات مفاجئة في قيم البكسلات. ويسهّل ذلك على أنظمة الذكاء الاصطناعي التعرّف على الأجسام أو الأنماط بدقة. وتُستخدم معالجة الصور عادةً في التطبيقات اليومية التي يكون فيها تحسين الجودة المرئية مهمًا، بدءًا من تحسين صور الهواتف الذكية، مرورًا بتحسين لقطات كاميرات المراقبة، وصولًا إلى مسح المستندات ضوئيًا لجعلها أسهل قراءة.

الشكل 2. مثال على استخدام معالجة الصور لاكتشاف الحواف.
استكشاف تقنيات معالجة الصور#
فيما يلي بعض الأمثلة على تقنيات معالجة الصور الأساسية:
-
مطابقة القوالب: تقارن أجزاءً من الصورة بقالب محدد مسبقًا لتحديد أنماط أو أجسام معينة.
-
التغبيش (التنعيم): يقلل تشويش الصورة وتفاصيلها عبر حساب متوسط قيم البكسلات، ويُستخدم عادةً في المعالجة المسبقة لإجراء مزيد من التحليل.
-
العمليات المورفولوجية: تضبط شكل الأجسام في الصورة باستخدام تقنيات مثل التمدد (جعل الأجسام أكبر)، والتآكل (جعل الأجسام أصغر)، والفتح (إزالة التشويش الصغير)، والإغلاق (ملء الفجوات الصغيرة).
-
التعتبة: تفصل الأجسام عن الخلفية استنادًا إلى شدة البكسلات، مما يسهّل التقسيم واستخراج السمات.
يستخدم المطورون غالبًا أدوات متخصصة مثل OpenCV وPillow وScikit-image وTensorFlow وPyTorch لتطبيق تقنيات معالجة الصور على الصور بسهولة. وتوفر هذه المكتبات دوال جاهزة وخوارزميات محسّنة، مما يلغي الحاجة إلى كتابة تعليمات برمجية معقدة من الصفر.
كما تدعم لغات برمجة متعددة، وتتكامل جيدًا مع الأدوات الأخرى، وتوفر وثائق شاملة، مما يجعل معالجة الصور أسرع وأكثر كفاءة وإتاحةً حتى لمن ليست لديهم خبرة عميقة في هذا المجال.
كيف تعمل الرؤية الحاسوبية#
تأتي بعض أكثر نماذج الرؤية الحاسوبية تقدمًا اليوم من سلسلة YOLO (أنت تنظر مرة واحدة). وعلى مر السنين، أُطلقت إصدارات جديدة حسّن كل منها الدقة والكفاءة. ويقدم أحدث إصدار، وهو Ultralytics YOLO11، دقة وأداءً أفضل.
يمكن تدريب نماذج مثل Ultralytics YOLO11 على بيانات مخصصة للتعرّف على أجسام معينة، كما أنها قادرة على التعامل مع مهام متعددة للرؤية الحاسوبية، بما في ذلك اكتشاف الأجسام، وتقسيم المثيلات، وتتبع الأجسام في الوقت الفعلي.
إليك نظرة سريعة على مهام الرؤية الحاسوبية التي يدعمها Ultralytics YOLO11:
-
اكتشاف الأجسام: يحدد الأجسام داخل الصورة ويحدد مواقعها، مثل اكتشاف المشاة للسيارات ذاتية القيادة.
-
تصنيف الصور: يعيّن تسميات إلى الصور بأكملها، مثل تحديد ما إذا كانت الصورة تحتوي على كلب أم قطة.
-
تقسيم المثيلات: يقسم الصورة إلى أجزاء أو مناطق ذات معنى، مثل عزل الأعضاء الفردية في الفحوصات الطبية.
-
تقدير الوضعية: يتتبع حركة الأجسام وموضعها، مثل اكتشاف الإيماءات أو تعديلات وضعية الجسم. وعند تطبيقه على البشر، يمكنه تحليل حركات الجسم في الوقت الفعلي، مما يجعله مفيدًا لتطبيقات مثل تتبع اللياقة البدنية وإعادة التأهيل.
الشكل 3. مهام الرؤية الحاسوبية التي يدعمها Ultralytics YOLO11.
تطبيقات الرؤية الحاسوبية ومعالجة الصور#
بعد أن ناقشنا كيفية عمل الرؤية الحاسوبية ومعالجة الصور، دعونا نستعرض تطبيقاتهما في العالم الحقيقي وأوجه التداخل بينهما.
مراقبة الماشية باستخدام الرؤية الحاسوبية#
هل تساءلت يومًا كيف تتابع المزارع الكبيرة ماشيتها؟ تستغرق مراقبة مئات الحيوانات يدويًا وقتًا طويلًا، لكن باستخدام نماذج الرؤية الحاسوبية مثل YOLO11، يمكن أتمتة مراقبة الحيوانات.
يمكن لـUltralytics YOLO11 اكتشاف الحيوانات وتتبعها وتحليلها في الوقت الفعلي، مما يساعد المزارعين على إدارة ماشيتهم بكفاءة. ويمكن للرؤى المستخلصة من هذا النوع من التحليل أن تساعد على اكتشاف العلامات المبكرة للمشكلات الصحية، مثل العرج، بما يتيح تدخلًا أسرع ورعاية أفضل للحيوانات عمومًا.

الشكل 4. مثال على مراقبة سلوك الحيوانات باستخدام YOLO11.
عدّ الماشية باستخدام معالجة الصور#
وبالمثل، يمكن استخدام معالجة الصور لمراقبة الماشية عبر عدّ الحيوانات في بيئات خاضعة للرقابة، مثل الحظائر أو الإسطبلات. وفي الصور ذات الخلفيات الموحدة، يمكن استخدام تقنيات معالجة الصور مثل التعتبة واكتشاف الخطوط المحيطة (التي يمكنها تحديد حدود الأجسام) لاكتشاف الحيوانات وعدّها. وتستخدم هذه الأساليب تقنيات مثل إزالة الخلفية، واكتشاف الحواف، والتقسيم لتحديد أشكال الماشية.

الشكل 5. مثال على استخدام معالجة الصور لاكتشاف الحيوانات.
قد تفكر أن هذا يبدو تمامًا مثل الرؤية الحاسوبية. فما الفرق إذن؟
يتمثل الفرق الرئيسي في أن معالجة الصور تحلل قيم البكسلات والأنماط من دون فهم ما تراه فعليًا. فهي تكتشف الحواف والأشكال لعدّ الحيوانات فرديًا، ويمكن لبعض التقنيات حتى أن تساعد على فصل الحيوانات عندما تكون متقاربة في الصور.
لكن، بخلاف الرؤية الحاسوبية، لا تتعرّف معالجة الصور على الحيوانات الفردية ولا تميّز بينها؛ بل تكتفي بالعد استنادًا إلى الشكل والحجم. وهذا يجعلها مفيدة لعدّ الماشية ومراقبتها، لكنها محدودة الإمكانات. فإذا تداخلت الحيوانات، أو غيرت مواضعها، أو اختلفت ظروف الإضاءة، فقد تتأثر الدقة. كما أنها لا تستطيع تتبع الحيوانات بمرور الوقت أو تقديم رؤى حول سلوكها، وهما ميزتان أساسيتان للرؤية الحاسوبية.
يمكن للرؤية الحاسوبية ومعالجة الصور العمل معًا#
ترتبط معالجة الصور والرؤية الحاسوبية ارتباطًا وثيقًا، ويمكن غالبًا دمجهما معًا لتعزيز دقة تحليل البيانات المرئية وكفاءته. ويمكن لمعالجة الصور تنقيح البيانات الأولية عبر تحسين الجودة، وإزالة التشويش، وإبراز السمات الرئيسية، مما يضمن قدرة نماذج الرؤية الحاسوبية على استخراج رؤى ذات معنى.
فعلى سبيل المثال، في التحليل الجنائي، يمكن لمعالجة الصور والرؤية الحاسوبية العمل معًا لتحليل بصمات الأحذية التي عُثر عليها في مسارح الجرائم. ويمكن لتقنيات معالجة الصور، مثل تحسين التباين واكتشاف الحواف، تحسين وضوح البصمات، مما يسهل تقييمها. إذ يضبط تحسين التباين السطوع والحدة لجعل التفاصيل أكثر وضوحًا، بينما يزيد اكتشاف الحواف حدة الخطوط الخارجية لتحقيق تعريف أفضل.
بعد معالجة الصور باستخدام هذه التقنيات، يمكن لنماذج الرؤية الحاسوبية استخدام تقنيات مطابقة الأنماط لمقارنة البصمات بقواعد البيانات الجنائية، مما يجعل تحديد الهوية أكثر دقة. ويسهّل هذا الجمع بين التقنيات على المحققين معالجة الأدلة الجنائية وتفسيرها.

الشكل 6. استخدام معالجة الصور والرؤية الحاسوبية لاكتشاف بصمات الأحذية.
أهم النقاط المستخلصة#
تعمل الرؤية الحاسوبية ومعالجة الصور جنبًا إلى جنب، وتساعدان على تحسين البيانات المرئية وتحليلها وتفسيرها. إذ تحسّن معالجة الصور جودة الصورة وتستخرج السمات الرئيسية، بينما تتجاوز الرؤية الحاسوبية ذلك بتوفير الرؤى.
مع استمرار تطور الذكاء الاصطناعي للرؤية، ستعزز الرؤية الحاسوبية ومعالجة الصور الأتمتة والتحليل في الوقت الفعلي واتخاذ القرارات في مختلف المجالات. ومن تحسين التعرّف على الصور إلى تنقيح اكتشاف الأنماط، ستجعل هذه التقنيات أنظمة الذكاء الاصطناعي للرؤية أكثر دقة وكفاءة وقدرة على فهم البيانات المرئية في التطبيقات العملية.
هل يثير الذكاء الاصطناعي فضولك؟ انضم إلى مجتمعنا واستكشف مستودعنا على GitHub. تعرّف على كيفية إعادة الرؤية الحاسوبية في قطاع الرعاية الصحية والذكاء الاصطناعي في التصنيع تشكيل المستقبل. واكتشف خيارات الترخيص لدينا لبدء مشاريعك في مجال الذكاء الاصطناعي للرؤية!









