Image Classification
استكشف أساسيات تصنيف الصور، من CNNs إلى استخدامات الذكاء الاصطناعي في العالم الحقيقي. تعلم تدريب ونشر مصنفات متطورة مع Ultralytics YOLO26.
تصنيف الصور هو مهمة أساسية في الرؤية الحاسوبية (CV) حيث يقوم نموذج التعلم الآلي بتحليل صورة بأكملها وتعيين تسمية واحدة لها من مجموعة محددة مسبقاً من الفئات. في الأساس، يجيب على سؤال: "ما هو الموضوع الأساسي لهذه الصورة؟" كعنصر أساسي في الذكاء الاصطناعي (AI)، تمكن هذه العملية الأنظمة الآلية من تنظيم وفهرسة وتفسير البيانات البصرية على نطاق واسع. على الرغم من أن الأمر قد يبدو بسيطاً للعين البشرية، إلا أن تمكين الحواسيب من التعرف على الأنماط يتطلب خوارزميات تعلم آلي (ML) متطورة لسد الفجوة بين البكسلات الخام والمفاهيم ذات المعنى.
آلية عمل التصنيف#
يعتمد تصنيف الصور الحديث بشكل كبير على بنيات التعلم العميق (DL) المعروفة باسم الشبكات العصبية التلافيفية (CNNs). تم تصميم هذه الشبكات لمحاكاة الطريقة التي يعالج بها القشرة البصرية البيولوجية المعلومات. من خلال عملية تسمى استخراج الميزات، يتعلم النموذج تحديد السمات منخفضة المستوى مثل الحواف والنسيج في الطبقات المبكرة، ثم يدمجها في النهاية للتعرف على الأشكال والأشياء المعقدة في الطبقات الأعمق.
لبناء مصنف، يستخدم المطورون التعلم الخاضع للإشراف، حيث يتم تزويد النموذج بكميات هائلة من بيانات التدريب التي تحتوي على أمثلة مصنفة. كانت مجموعات البيانات العامة الكبيرة مثل ImageNet آلات أساسية في دفع دقة هذه الأنظمة. خلال مرحلة الاستدلال، يُخرج النموذج درجة احتمال لكل فئة، وغالباً ما يستخدم دالة سوفتماكس لتحديد الفئة الأكثر ترجيحاً.
التصنيف مقابل مهام الرؤية الأخرى#
من المهم التمييز بين تصنيف الصور وقدرات رؤية الحاسوب ذات الصلة، حيث يعتمد اختيار التقنية على المشكلة المحددة:
- التصنيف مقابل اكتشاف الكائنات: يقوم التصنيف بتعيين تسمية واحدة للصورة بأكمله. في المقابل، يحدد اكتشاف الكائنات موقع الكائنات متعددة داخل مشهد عن طريق رسم مربع محيط حول كل منها.
- التصنيف مقابل تجزئة الصور: بينما يدرس التصنيف السياق العالمي، توفر التجزئة دقة على مستوى البكسل. تقوم التجزئة الدلالية بتصنيف كل بكسل فردي، مما يتيح تحديد الحدود بدقة بين الكائنات والخلفية.
تطبيقات العالم الحقيقي#
يشغل تصنيف الصور مجموعة واسعة من تبيقات الذكاء الاصطناعي في العالم الحقيقي عبر صناعات متنوعة:
التشخيص في الرعاية الصحية#
في المجال الطبي، تساعد نماذج التصنيف أطباء الأشعة من خلال تحليل الفحوصات التشخيصية. يمكن لأدوات تحليل الصور الطبية تصنيف الأشعة السينية أو التصوير بالرنين المغناطيسي بسرعة على أنها "طبيعية" أو "غير طبيعية"، أو تحديد حالات معينة مثل اكتشاف الأورام، مما يتيح فرز المرضى وتشخيصهم بشكل أسرع.
مراقبة الجودة في التصنيع#
تستفيد المصانع من الفحص البصري الآلي للحفاظ على معايير المنتجات. تلتقت الكاميرات الموجودة على خطوط التجميع صوراً للمكونات، وتقوم نماذج التصنيف بتسميتها فوراً على أنها "ناجحة" أو "فاشلة" بناءً على العيوب الظاهرة. يضمن هذا مراقبة الجودة الآلية وصول العناصر الخالية من العيوب فقط إلى مرحلة التعبئة والتغليف.
الزراعة الذكية#
يستفيد المزارعون من الذكاء الاصطناعي في الزراعة لمراقبة صحة المحاصيل. من خلال تصنيف الصور الملتقطة بواسطة الطائرات بدون طيار أو الهواتف الذكية، يمكن للأنظمة تحديد علامات المرض، أو نقص المغذيات، أو الإصابة بالآفات، مما يتيح تدخلات الزراعة الدقيقة المستهدفة.
تنفيذ التصنيف باستخدام Ultralytics YOLO26#
يقدم إطار عمل Ultralytics YOLO26، على الرغم من شهرته في الاكتشاف، أداءً متطوراً لـ مهام تصنيف الصور. بنيته محسنة للسرعة والدقة، مما يجعله مناسباً للتطبيقات في الوقت الفعلي.
إليك مثال موجز حول كيفية تحميل نموذج مدرب مسبقاً وتصنيف صورة باستخدام حزمة Python ultralytics:
from ultralytics import YOLO
# Load a pre-trained YOLO26 classification model
model = YOLO("yolo26n-cls.pt")
# Run inference on an image source
results = model("https://ultralytics.com/images/bus.jpg")
# Print the top predicted class name
print(f"Prediction: {results[0].names[results[0].probs.top1]}")للفريق الذي يسعى لتبسيط سير العمل، يبسط Ultralytics Platform مسار العمل بأكمله. يتيح للمستخدمين إدارة مجموعات بيانات التصنيف، وإجراء التدريب السحابي، ونشر النشر إلى تنسيقات مختلفة مثل ONNX أو TensorRT دون الحاجة إلى البنية التحتية البرمجية الواسعة.






