Image Classification
استكشف أساسيات تصنيف الصور، بدءًا من CNNs وصولًا إلى استخدامات الذكاء الاصطناعي الواقعية. تعلّم تدريب المصنّفات المتقدمة ونشرها باستخدام Ultralytics YOLO26.
يُعدّ تصنيف الصور مهمة أساسية في الرؤية الحاسوبية (CV)، حيث يحلل نموذج تعلّم آلي الصورة بأكملها ويُسنِد إليها تصنيفًا واحدًا من مجموعة محددة مسبقًا من الفئات. وببساطة، يجيب عن السؤال: "ما الموضوع الرئيسي في هذه الصورة؟" وبصفته مكوّنًا أساسيًا من الذكاء الاصطناعي (AI)، تُمكّن هذه العملية الأنظمة المؤتمتة من تنظيم البيانات المرئية وتصنيفها وتفسيرها على نطاق واسع. ورغم أن الأمر قد يبدو بسيطًا للعين البشرية، فإن تمكين أجهزة الحاسوب من التعرّف على الأنماط يتطلب خوارزميات متطورة في التعلّم الآلي (ML) لردم الفجوة بين وحدات البكسل الخام والمفاهيم ذات المعنى.
الآلية الكامنة وراء التصنيف#
يعتمد تصنيف الصور الحديث بدرجة كبيرة على بنيات التعلّم العميق (DL) المعروفة باسم الشبكات العصبية الالتفافية (CNNs). صُممت هذه الشبكات لمحاكاة الطريقة التي تعالج بها القشرة البصرية البيولوجية المعلومات. ومن خلال عملية تُسمى استخراج السمات، يتعلم النموذج تحديد السمات منخفضة المستوى، مثل الحواف والأنسجة، في الطبقات المبكرة، ثم يدمجها في النهاية للتعرّف على الأشكال والكائنات المعقدة في الطبقات الأعمق.
لبناء مُصنِّف، يستخدم المطورون التعلّم الخاضع للإشراف، ويزوّدون النموذج بكميات هائلة من بيانات التدريب التي تحتوي على أمثلة معنونة. وقد أسهمت مجموعات البيانات العامة الكبيرة مثل ImageNet بدور محوري في تحسين دقة هذه الأنظمة. وأثناء مرحلة الاستدلال، يُخرج النموذج درجة احتمالية لكل فئة، وغالبًا ما يستخدم دالة softmax لتحديد الفئة الأكثر احتمالًا.
التصنيف مقارنةً بمهام الرؤية الأخرى#
من المهم التمييز بين تصنيف الصور وقدرات الرؤية الحاسوبية ذات الصلة، إذ يعتمد اختيار التقنية على المشكلة المحددة:
- التصنيف مقارنةً بـ اكتشاف الكائنات: يُسنِد التصنيف تسمية واحدة إلى الصورة بأكملها. أما اكتشاف الكائنات، فعلى النقيض من ذلك، فيحدد مواقع كائنات متعددة داخل المشهد من خلال رسم مربع إحاطة حول كل كائن.
- التصنيف مقارنةً بـ تجزئة الصور: بينما ينظر التصنيف إلى السياق العام، توفر التجزئة دقة على مستوى البكسل. إذ تصنّف التجزئة الدلالية كل بكسل على حدة، مما يتيح تحديدًا دقيقًا للحدود بين الكائنات والخلفية.
التطبيقات الواقعية#
يُشغّل تصنيف الصور مجموعة واسعة من تطبيقات الذكاء الاصطناعي في العالم الحقيقي عبر صناعات متنوعة:
التشخيص الطبي#
في المجال الطبي، تساعد نماذج التصنيف أطباء الأشعة على تحليل الفحوصات التشخيصية. ويمكن لأدوات تحليل الصور الطبية تصنيف صور الأشعة السينية أو صور الرنين المغناطيسي بسرعة إلى "طبيعية" أو "غير طبيعية"، أو تحديد حالات معينة مثل اكتشاف الأورام، مما يتيح فرز المرضى وتشخيصهم بسرعة أكبر.
مراقبة الجودة في التصنيع#
تستخدم المصانع الفحص البصري المؤتمت للحفاظ على معايير المنتجات. تلتقط الكاميرات الموجودة على خطوط التجميع صورًا للمكوّنات، وتضع نماذج التصنيف عليها فورًا تسمية "ناجح" أو "فاشل" استنادًا إلى العيوب المرئية. وتضمن مراقبة الجودة المؤتمتة وصول العناصر غير المعيبة فقط إلى مرحلة التغليف.
الزراعة الذكية#
يستفيد المزارعون من الذكاء الاصطناعي في الزراعة لمراقبة صحة المحاصيل. ومن خلال تصنيف الصور التي تلتقطها الطائرات المسيّرة أو الهواتف الذكية، تستطيع الأنظمة تحديد علامات المرض أو نقص العناصر الغذائية أو انتشار الآفات، مما يتيح تنفيذ تدخلات مستهدفة في الزراعة الدقيقة.
تنفيذ التصنيف باستخدام Ultralytics YOLO26#
يوفر إطار عمل Ultralytics YOLO26، المشهور باكتشاف الكائنات، أداءً رائدًا في مهام تصنيف الصور. وقد حُسّنت بنيته لتحقيق السرعة والدقة، مما يجعله مناسبًا للتطبيقات الفورية.
فيما يلي مثال موجز يوضح كيفية تحميل نموذج مُدرَّب مسبقًا وتصنيف صورة باستخدام حزمة ultralytics Python:
from ultralytics import YOLO
# Load a pre-trained YOLO26 classification model
model = YOLO("yolo26n-cls.pt")
# Run inference on an image source
results = model("https://ultralytics.com/images/bus.jpg")
# Print the top predicted class name
print(f"Prediction: {results[0].names[results[0].probs.top1]}")بالنسبة إلى الفرق التي تسعى إلى تبسيط سير عملها، تعمل منصة Ultralytics على تبسيط خط الأنابيب بأكمله. فهي تتيح للمستخدمين إدارة مجموعات بيانات التصنيف، وإجراء التدريب المستند إلى السحابة، ونشر النماذج بتنسيقات متنوعة مثل ONNX أو TensorRT من دون الحاجة إلى بنية تحتية برمجية واسعة النطاق.









