استخدام زيادات Albumentations لتنويع بياناتك
تعرف على كيفية استخدام Albumentations للزيادات عند تدريب Ultralytics YOLO11 المخصص لتحسين أداء النموذج ببيانات تدريب متنوعة.

عند بناء حل computer vision، يمكن أن يكون جمع مجموعة متنوعة من الصور لتدريب نماذج الذكاء الاصطناعي المرئي جزءاً حاسماً من العملية. غالباً ما يتطلب ذلك الكثير من الوقت والمال، وأحياناً لا تكون الصور المجمعة متنوعة بالدرجة الكافية لكي تتعلم النماذج بفعالية.
على سبيل المثال، يمكن تدريب نماذج الرؤية الحاسوبية مثل Ultralytics YOLO11 خصيصاً على مجموعات بيانات الصور لمختلف computer vision tasks المرتبطة بتطبيقات متنوعة. البيانات المتنوعة هي المفتاح لأنها تساعد النموذج على التعميم بشكل أفضل، مما يتيح له التعرف على الكائنات والأنماط في مجموعة واسعة من سيناريوهات العالم الحقيقي.
إذا كنت تعاني من نقص في البيانات المتنوعة، يمكن أن تكون تقنيات زيادة بيانات الصور (image data augmentation) حلاً رائعاً. يمكن أن تساعد أساليب مثل التدوير، والقلب، وتعديل السطوع في زيادة تنوع مجموعة بياناتك، مما يحسن قدرة النموذج على التعامل مع نطاق أوسع من الظروف.
لهذا السبب تدعم Ultralytics تكاملاً لتزياد بيانات الصور. باستخدام Albumentations، وهي أداة شائعة تقدم مجموعة من التحويلات، يمكنك إنشاء بيانات مرئية متنوعة. يسطّح هذا التكامل عملية تدريب YOLO11 من خلال زيادة صور التدريب تلقائياً، مما يؤدي إلى تحسين أداء النموذج.
في هذه المقالة، سنستكشف كيفية استخدام تكامل Albumentations، وفوائده، وتأثيره على تدريب النموذج.
ما هو Albumentations؟#
يمكن لـ Computer vision models التعلم من مجموعة واسعة من الصور عالية الجودة للتعرف على الكائنات في بيئات مختلفة. يمكن أن يكون جمع مجموعات بيانات كبيرة من مصادر العالم الحقيقي بطيئاً ومكلفاً وغير فعال. لتبسيط هذه المهمة، يمكنك استخدام image data augmentation لإنشاء تنويعات جديدة للصور الموجودة، مما يساعد النماذج على التعلم من سيناريوهات مختلفة دون جمع المزيد من البيانات.
على وجه التحديد، يمكنك الاستفادة من Albumentations، وهي مكتبة مفتوحة المصدر تم تقديمها لزيادة كفاءة بيانات الصور في عام 2018. وهي تدعم مجموعة متنوعة من العمليات، بدءاً من التغييرات الهندسية البسيطة مثل التدوير والقلب وصولاً إلى تعديلات أكثر تعقيداً مثل السطوع، والتباين، وإضافة الضوضاء.

Fig 1. أمثلة على أنواع مختلفة من زيادات بيانات الصور.
الميزات الرئيسية لـ Albumentations#
تشتهر Albumentations بأدائها العالي، مما يعني أنها تستطيع معالجة الصور بسرعة وكفاءة. وبناءً على مكتبات محسنة مثل OpenCV وNumPy، فإنها تتعامل مع مجموعات البيانات الكبيرة بأقل وقت معالجة، مما يجعلها مثالية للزيادة السريعة للبيانات أثناء تدريب النموذج.
إليك بعض الميزات الرئيسية الأخرى لـ Albumentations:
- مجموعة واسعة من التحويلات: يوفر Albumentations أكثر من 70 نوعاً من الزيادات. تساعد هذه التنويعات النماذج على تعلم اكتشاف الكائنات على الرغم من التغيرات في الإضاءة، أو الزوايا، أو الخلفيات.
- محسن للسرعة: يستخدم تقنيات تحسين متقدمة مثل SIMD (تعليمات فردية، بيانات متعددة)، والتي تعالج نقاط بيانات متعددة في وقت واحد لتسريع زيادة الصور والتعامل مع مجموعات البيانات الكبيرة بكفاءة.
- ثلاثة مستويات من الزيادات: يعزز البيانات بثلاث طرق. على سبيل المثال، تقوم زيادات مستوى البكسل بتعديل السطوع واللون دون تغيير الكائنات. في الوقت نفسه، تعدل زيادات المستوى المكاني موقع الكائن مع الحفاظ على التفاصيل الرئيسية، وتدمج زيادات مستوى المزج أجزاءً من صور مختلفة لإنشاء عينات جديدة.
لماذا يجب عليك استخدام تكامل Albumentations؟#
قد تتساءل: هناك العديد من الطرق لتطبيق الزيادات على مجموعة البيانات، ويمكنك حتى إنشاء طريقتك الخاصة باستخدام أدوات مثل OpenCV. إذاً، لماذا تختار تكاملاً يدعم مكتبة مثل Albumentations؟
يمكن أن يستغرق إنشاء زيادات يدوياً باستخدام أدوات مثل OpenCV وقتاً طويلاً ويتطلب بعض الخبرة. قد يكون من الصعب أيضاً ضبط التحويلات بدقة للحصول على أفضل النتائج. يجعل تكامل Albumentations هذه العملية أسهل. فهو يقدم العديد من التحويلات الجاهزة للاستخدام التي يمكن أن توفر لك الوقت والجهد عند إعداد dataset.
سبب آخر لاختيار تكامل Albumentations هو أنه يعمل بسلاسة مع خط أنابيب model training الخاص بـ Ultralytics. فهو يجعل التدريب المخصص لـ YOLO11 أسهل بكثير، حيث تُطبق الزيادات تلقائياً أثناء التدريب. إنه يسطّح العملية، بحيث يمكنك التركيز أكثر على تحسين نموذجك بدلاً من التعامل مع إعداد البيانات.
البدء مع تكامل Albumentations#
من المثير للاهتمام أن استخدام عمليات التكامل الخاصة بـ Albumentations لتدريب نموذج Ultralytics YOLO11 أسهل بكثير مما قد تبدو عليه. بمجرد إعداد المكتبات المناسبة، سيقوم التكامل تلقائياً بتطبيق عمليات تحسين بيانات الصور أثناء التدريب. وهذا يساعد النموذج على التعلم من الاختلافات المختلفة للصور باستخدام نفس مجموعة البيانات.
بعد ذلك، دعنا نستعرض كيفية تثبيت واستخدام تكامل Albumentations عند التدريب المخصص لـ Ultralytics YOLO11.
تثبيت حزمة Python الخاصة بـ Ultralytics وAlbumentations#
قبل تطبيق الزيادات، يجب تثبيت كل من Ultralytics Python package وAlbumentations. تم تصميم التكامل بحيث تعمل كلا المكتبتين معاً بسلاسة افتراضياً، لذلك لا داعي للقلق بشأن التكوينات المعقدة.
يمكن إكمال عملية التثبيت بأكملها في غضون بضع دقائق فقط باستخدام أمر pip واحد، وهو أداة إدارة حزم لتثبيت مكتبات Python، كما هو موضح في الصورة أدناه.

الشكل 2. تثبيت Ultralytics وAlbumentations.
بمجرد تثبيت Albumentations، يطبق وضع تدريب نموذج Ultralytics زيادات الصور تلقائياً أثناء التدريب. إذا لم تثبت Albumentations، فلن تُطبق هذه الزيادات. لمزيد من التفاصيل، يمكنك الرجوع إلى official Ultralytics documentation.
تدريب Ultralytics YOLO11 بمساعدة تكامل Albumentations#
دعنا نحصل على فهم أفضل لما يحدث تحت غطاء تكامل Albumentations.
إليك نظرة فاحصة على عمليات التحسين التي يتم تطبيقها أثناء تدريب Ultralytics YOLO11:
- التمويه (Blur): يضيف هذا التحويل تمويهاً طفيفاً إلى الصورة. إنه يساعد النموذج على اكتشاف الكائنات حتى عندما تكون خارج نطاق التركيز.
- تمويه الوسيط (Median blur): يقلل من الضوضاء العشوائية مع الحفاظ على حواف الكائنات في الصورة. وهذا يجعل من الأسهل على النموذج اكتشاف الكائنات في البيئات المعقدة.
- التدرج الرمادي (Grayscale): من خلال تحويل الصورة إلى أسود وأبيض، يمكن أن تساعد هذه الزيادة النموذج على التركيز على الأشكال والقوام بدلاً من الألوان.
- CLAHE (موازنة المدرج التكراري التكيفي المحدود بالتباين): تعمل هذه الزيادة على تعزيز التباين في الصور، لا سيما في المناطق المظلمة جداً أو التي يصعب رؤيتها، مثل ظروف الإضاءة المنخفضة أو الضبابية. وهذا يجعل الكائنات في تلك المناطق أوضح وأسهل للنموذج للتعرف عليها.

Fig 3. مثال على زيادة التدرج الرمادي المطبقة على صورة قطة.
تطبيقات Ultralytics YOLO11 وتكامل Albumentations#
إذا كنت تقوم بالتدريب المخصص لـ Ultralytics YOLO11 لتطبيق معين، يمكن أن يساعد تكامل Albumentations في تعزيز أداء النموذج من خلال التكيف مع الظروف المختلفة. دعنا نناقش بعض التطبيقات الواقعية والتحديات التي يمكن لهذا التكامل حلها.
تحسين التصوير الطبي#
تساعد Vision AI in healthcare الأطباء في تحليل الصور الطبية بدقة أكبر للمساعدة في التشخيص وتحسين رعاية المرضى. في الواقع، around a fifth of healthcare organizations تستخدم بالفعل حلول الذكاء الاصطناعي.
ومع ذلك، يأتي إنشاء حلول الرؤية الحاسوبية هذه مع مجموعة تحدياته الخاصة. يمكن أن تختلف المسوحات الطبية بشكل كبير بين المستشفيات، متأثرة بعوامل مثل المعدات المختلفة، والإعدادات، وحتى خبرة الفنيين. يمكن أن تؤثر الاختلافات في السطوع والتباين والتعرض على اتساق ودقة نماذج الذكاء الاصطناعي للرؤية، مما يجعل من الصعب عليها العمل بشكل موثوق عبر بيئات مختلفة.
وهنا يصبح تكامل أدوات مثل Albumentations ضرورياً. من خلال إنشاء إصدارات متعددة ومحسنة من نفس المسح، يمكن Albumentations النموذج من التعلم من مجموعة متنوعة من جودات الصور. يساعد هذا النموذج ليصبح أكثر قوة، مما يسمح له باكتشاف الأمراض بدقة عبر كل من الصور عالية ومنخفضة الجودة.

Fig 4. صور أشعة سينية مزادة.
تعزيز الأمن والمراقبة#
تطبيق آخر مثير للاهتمام للذكاء الاصطناعي المرئي وهو في مجال الأمن والمراقبة. يمكن أن تساعد Real-time object detection فرق الأمن في تحديد التهديدات المحتملة بسرعة.
من الشواغل الرئيسية المتعلقة بهذا التطبيق هو أن كاميرات الأمن تلتقط اللقطات تحت ظروف إضاءة مختلفة طوال اليوم، وهذه الظروف يمكن أن تؤثر بشكل كبير على كيفية فهم النموذج لمثل هذه الصور. يمكن لعوامل مثل بيئات الإضاءة المنخفضة، أو الوهج، أو ضعف الرؤية أن تجعل من الصعب على نماذج الرؤية الحاسوبية اكتشاف الكائنات أو التعرف على التهديدات المحتملة باستمرار.
يساعد تكامل Albumentations من خلال تطبيق تحويلات لمحاكاة ظروف الإضاءة المختلفة. وهذا يسمح للنموذج بالتعلم لاكتشاف الكائنات في كل من بيئات الإضاءة الساطعة والمنخفضة، مما يجعله أكثر موثوقية ويحسن أوقات الاستجابة في الظروف الصعبة.
إعادة تعريف سير عمل البيع بالتجزئة وتجربة العملاء#
انسكاب في ممر بالسوبر ماركت، أو كلب يجري عبر المتجر، أو طفل يسقط عرض منتجات هي مجرد أمثلة قليلة للأحداث اليومية التي يمكن أن تكون حالات حافة لـ vision AI in retail. يُستخدم الرؤية الحاسوبية بشكل متزايد لتحسين تجربة العملاء من خلال تتبع سلوك المتسوقين، ومراقبة حركة مرور المشاة، وتحديد المنتجات على الأرفف. ومع ذلك، قد يكون من الصعب على أنظمة الذكاء الاصطناعي فهم هذه المواقف في العالم الحقيقي ومعالجتها بدقة.
على الرغم من أنه لا يمكن تمثيل كل سيناريو في مجموعة بيانات رؤية حاسوبية، يساعد تكامل Albumentations من خلال زيادة البيانات لتغطية العديد من المواقف المحتملة، مثل الإضاءة غير المتوقعة، أو الزوايا غير العادية، أو العوائق. يساعد هذا نماذج الرؤية الحاسوبية على التكيف مع ظروف مختلفة، مما يحسن قدرتها على التعامل مع حالات الحافة وإجراء تنبؤات دقيقة في بيئات البيع بالتجزئة الديناميكية.
أبرز النقاط#
يمكن أن يكون جمع بيانات واقعية متنوعة لتدريب النماذج أمراً معقداً، لكن Albumentations يجعله أسهل من خلال إنشاء تنويعات للصور تساعد النماذج على التكيف مع ظروف مختلفة.
يعمل تكامل Albumentations المدعوم من Ultralytics على تبسيط عملية تطبيق هذه الزيادات أثناء تدريب YOLO11 بشكل مخصص. يؤدي هذا إلى جودة أفضل لمجموعة البيانات، مما يفيد مجموعة واسعة من الصناعات من خلال إنتاج نماذج ذكاء اصطناعي للرؤية أكثر دقة وموثوقية.
انضم إلى our community واستكشف GitHub repository الخاص بنا لمعرفة المزيد حول الذكاء الاصطناعي، وتحقق من our licensing options لبدء مشاريع الذكاء الاصطناعي المرئي الخاصة بك. هل أنت مهتم بالابتكارات مثل AI in manufacturing أو computer vision in self-driving؟ تفضل بزيارة صفحات الحلول الخاصة بنا لاكتشاف المزيد.






