YOLO Vision 2026:
التكاملات

دليل حول بنية U-Net وتطبيقاتها

تعرّف على بنية U-Net، وكيف تدعم تجزئة الصور، وتطبيقاتها، وسبب أهميتها في تطور الرؤية الحاسوبية.

ABAbirami Vina5 min read
بنية U-Net لتجزئة الصور

الرؤية الحاسوبية هي فرع من فروع الذكاء الاصطناعي (AI) يركز على تحليل البيانات المرئية. وقد مهّدت الطريق للعديد من الأنظمة المتقدمة، مثل أتمتة عملية فحص المنتجات في المصانع ومساعدة المركبات ذاتية القيادة على التنقل في الطرق.

إحدى أكثر مهام رؤية الحاسوب شهرة هي كشف الأشياء. تُمكّن هذه المهمة النماذج من تحديد مواقع الأشياء داخل صورة والتعرف عليها باستخدام صناديق الإحاطة (bounding boxes). على الرغم من أن صناديق الإحاطة مفيدة لمختلف التطبيقات، إلا أنها توفر فقط تقديراً تقريبياً لموقع الشيء.

ومع ذلك، في مجالات مثل الرعاية الصحية، حيث الدقة أمر بالغ الأهمية، تعتمد حالات استخدام الذكاء الاصطناعي في الرؤية على أكثر من مجرد تحديد الشيء. فغالبًا ما تتطلب أيضًا معلومات تتعلق بالشكل والموقع الدقيق للأشياء.

هذا هو بالضبط ما صُممت لتأديته مهمة الرؤية الحاسوبية المتمثلة في التجزئة (Segmentation). فبدلاً من استخدام صناديق الإحاطة، تكشف نماذج التجزئة عن الكائنات على مستوى البكسل. على مر السنين، طوّر الباحثون نماذج رؤية حاسوبية متخصصة للتجزئة.

أحد هذه النماذج هو U-Net. وعلى الرغم من أن النماذج الأحدث والأكثر تقدمًا قد تفوقت على أدائه، إلا أن U-Net يحتل مكانة بارزة في تاريخ الرؤية الحاسوبية. في هذه المقالة، سنلقي نظرة عن قرب على بنية U-Net، وكيفية عملها، والمجالات التي تُستخدم فيها، وكيف مقارنتها بنماذج التجزئة الأكثر حداثة المتوفرة اليوم.

تجزئة مشهد جوي باستخدام نموذج التعلم العميق U-Net

الشكل 1. مثال على التجزئة باستخدام نموذج التعلم العميق U-Net. (المصدر)

تاريخ تجزئة الصور#

قبل أن نتعمق في ماهية U-Net، دعنا أولاً نفهم بشكل أفضل كيف تطورت نماذج تجزئة الصور.

في البداية، اعتمدت رؤية الحاسوب على تقنيات تقليدية مثل كشف الحواف، أو العتبة (thresholding)، أو نمو المناطق لفصل الأشياء في الصورة. استُخدمت هذه التقنيات للكشف عن حدود الأشياء باستخدام الحواف، وفصل المناطق حسب كثافة البكسل، وتجميع البكسلات المتشابهة. لقد نجحت في الحالات البسيطة ولكنها غالبًا ما فشلت عندما كانت الصور تحتوي على ضوضاء، أو أشكال متداخلة، أو حدود غير واضحة.

في أعقاب صعود التعلم العميق في عام 2012، قدم الباحثون مفهوم الشبكات التلافيفية الكاملة (FCNs) في عام 2014 لمهام مثل التجزئة الدلالية. استبدلت هذه النماذج أجزاء معينة من الشبكة التلافيفية للسماح للكمبيوتر بالنظر إلى الصورة بأكملها دفعة واحدة، بدلاً من تجزئتها إلى قطع أصغر. وقد جعل هذا من الممكن للنموذج إنشاء خرائط مفصلة تعرض محتويات الصورة بشكل أكثر وضوحاً.

الخط الزمن تطور خوارزميات التجزئة القائمة على التعلم العميق

الشكل 2. تطور خوارزميات التجزئة القائمة على التعلم العميق. (المصدر)

بناءً على شبكات FCN، تم تقديم U-Net من قبل باحثين في جامعة فرايبورغ في عام 2015. وقد صُممت في الأصل لتجزئة الصور الطبية الحيوية. وعلى وجه الخصوص، صُممت U-Net لتعمل بكفاءة عالية في المواقف التي تكون فيها البيانات المشروحة محدودة.

في غضون ذلك، أضافت الإصدارات اللاحقة مثل UNet++ و TransUNet ترقيات مثل طبقات الانتباه واستخراج الميزات بشكل أفضل. تساعد طبقات الانتباه النموذج على التركيز على المناطق الرئيسية، بينما يلتقط استخراج الميزات المحسن معلومات أكثر تفصيلاً.

ما هو U-Net، وكيف تتدفق الميزات عبر النموذج؟#

نموذج U-Net هو نموذج تعلم عميق مُصمم خصيصاً لتجزئة الصور. يأخذ صورة كمدخل وينتج قناع تجزئة يصنف كل بكسل وفقاً للكائن أو المنطقة التي ينتمي إليها.

حصل النموذج على اسمه من بنيته التي تشبه حرف U. وهو يتكون من جزأين رئيسيين: مُشفر (encoder) يضغط الصورة ويتعلم ميزاتها، ومُفكك (decoder) يوسعها مرة أخرى إلى الحجم الأصلي. يخلق هذا التصميم شكل U متماثلًا، مما يساعد النموذج على فهم الهيكل العام للصورة وتفاصيلها الدقيقة.

إحدى الميزات الحاسمة في U-Net هي استخدام وصلات التخطي (skip connections)، التي تسمح بتمرير المعلومات من المُشفر مباشرة إلى المُفكك. وهذا يعني أن النموذج يمكنه الحفاظ على التفاصيل المهمة التي قد تضيع عند ضغط الصورة.

نظرة عامة على بنية U-Net#

إليك لمحة عن كيفية عمل بنية U-Net:

  • صورة الإدخال: تبدأ U-Net بصورة ثنائية الأبعاد، مثل الفحص الطبي أو صورة الأقمار الصناعية. الهدف هو تعيين تسمية فئة لكل بكسل في الصورة.
  • أخذ العينات لأسفل (Downsampling): تمر الصورة عبر طبقات تلافيفية تتعلم ميزات مرئية مهمة. ومع انتقال الصورة عبر طبقات مختلفة، تنخفض دقتها، ويحدد النموذج أنماطًا أوسع.
  • طبقة الاختناق (Bottleneck layer): في مركز الشبكة، تصل خرائط الميزات إلى أصغر دقة مكانية لها بينما تلتقط ميزات دلالية عالية المستوى. ببساطة، هذا التمثيل المضغوط لخرائط الميزات هو السياق العام للمدخل.
  • أخذ العينات لأعلى (Upsampling): تقوم الشبكة بعد ذلك بإعادة بناء الصورة عن طريق زيادة الدقة تدريجيًا. تساعد التلافيف المنقولة في توسيع خرائط الميزات مرة أخرى نحو الحجم الأصلي.
  • وصلات التخطي: يتم ربط خرائط الميزات من مسار أخذ العينات لأسفل مع تلك الموجودة في مسار أخذ العينات لأعلى. وهذا يساعد في الحفاظ على التفاصيل المكانية الدقيقة مع دمج المعلومات السياقية عالية المستوى.
  • المخرج هو خريطة تجزئة: المخرج النهائي هو قناع تجزئة لكل بكسل يطابق حجم المدخل. يتم تصنيف كل بكسل في فئة مثل شيء، أو خلفية، أو منطقة اهتمام.

مخطط لبنية المُشفّر والمُفكّك في نموذج U-Net

الشكل 3. مخطط بنية U-Net. (المصدر)

فهم الفرق بين ViT و U-Net#

أثناء استكشافك لـ U-Net، قد تتساءل عن مدى اختلافها عن نماذج التعلم العميق الأخرى، مثل مُحوّل الرؤية (ViT)، والذي يمكنه أيضاً أداء مهام التجزئة. ورغم أن كلا النموذجين يمكنهما أداء مهام متشابهة، إلا أنهما يختلفان من حيث التصميم وطريقة معالجتهما للتجزئة.

يعمل U-Net من خلال معالجة الصور على مستوى البكسل عبر طبقات تلافيفية في هيكل مُشفر ومُفكك. وغالبًا ما يُستخدم للمهام التي تتطلب تجزئة دقيقة، مثل الفحوصات الطبية أو مشاهد السيارات ذاتية القيادة.

من ناحية أخرى، يقوم محول الرؤية (ViT) بتقسيم الصور إلى رقع (patches) ويعالجها في وقت واحد عبر آليات الانتباه. يستخدم الانتباه الذاتي (آلية تسمح للنموذج بوزن أهمية أجزاء مختلفة من الصورة بالنسبة لبعضها البعض) لالتقاط كيفية ارتباط أجزاء مختلفة من الصورة ببعضها البعض، على عكس نهج U-Net التلافيفي.

فرق مهم آخر هو أن ViT يحتاج عمومًا إلى مزيد من البيانات ليعمل بشكل جيد، لكنه رائع في التقاط الأنماط المعقدة. في المقابل، يعمل U-Net بشكل جيد مع مجموعات البيانات الأصغر ويكون أسرع في التدريب وغالبًا ما يتطلب وقت تدريب أقل.

تطبيقات نموذج U-Net#

الآن بعد أن أصبح لدينا فهم أفضل لماهية U-Net وكيف يعمل، دعونا نستكشف كيف تم تطبيق U-Net عبر مجالات مختلفة.

تجزئة نزيف المخ في التصوير الطبي#

أصبح نموذج U-Net طريقة موثوقة للتجزئة على مستوى البكسل للصور الطبية المعقدة، لا سيما خلال فترة ذروته في الأبحاث. وقد استخدمه الباحثون لتحديد المناطق الرئيسية في الفحوصات الطبية، مثل الأوراق والأورام وعلامات النزيف الداخلي في صور الأشعة المقطعية والرنين المغناطيسي. وقد أدى هذا النهج إلى تحسين دقة التشخيص بشكل كبير وتبسيط تحليل البيانات الطبية المعقدة في البيئات البحثية.

أحد الأمثلة على تأثير U-Net في أبحاث الرعاية الصحية هو استخدامه في تحديد السكتة الدماغية ونزيف المخ في الفحوصات الطبية. يمكن للباحثين استخدام U-Net لتحليل فحوصات الرأس وتسليط الضوء على مناطق القلق، مما يتيح تحديدًا أسرع للحالات التي تتطلب اهتمامًا فوريًا.

تجزئة آفات السكتة الدماغية النزفية في الفحوصات الطبية باستخدام نموذج 3D U-Net

الشكل 4. تجزئة آفات السكتة الدماغية النزفية باستخدام 3D U-Net. (المصدر)

تجزئة المحاصيل في الزراعة#

مجال آخر استخدم فيه الباحثون U-Net هو الزراعة، لا سيما لتجزئة المحاصيل والأعشاب الضارة والتربة. إنه يساعد المزارعين على مراقبة صحة النبات، وتقدير العوائد، واتخاذ قرارات أفضل عبر المزارع الكبيرة. على سبيل المثال، يمكن لـ U-Net فصل المحاصيل عن الأعشاب الضارة، مما يجعل استخدام مبيدات الأعشاب أكثر كفاءة ويقلل من الهدر.

لمعالجة تحديات مثل ضبابية الحركة في صور الطائرات بدون طيار، قام الباحثون بتحسين U-Net بتقنيات إزالة ضبابية الصور. ويضمن هذا تجزئة أكثر وضوحاً، حتى عندما يتم جمع البيانات أثناء الحركة، كما هو الحال أثناء المسوحات الجوية.

نموذج U-Net يفصل المحاصيل عن الأعشاب الضارة في حقل زراعي

الشكل 5. فصل المحاصيل عن الأعشاب الضارة في الحقول الزراعية باستخدام U-Net. (المصدر)

القيادة الذاتية#

قبل تقديم نماذج الذكاء الاصطناعي الأكثر تقدمًا، لعبت U-Net دوراً حيوياً في استكشاف كيف يمكن للتجزئة أن تعزز القيادة ذاتية القيادة. في المركبات ذاتية القيادة، يمكن استخدام التجزئة الدلالية الخاصة بـ U-Net لتصنيف كل بكسل في الصورة إلى فئات مثل الطريق، والمركبة، والماشية أو المشاة، وعلامات الممر. وهذا يمنح السيارة رؤية واضحة لمحيطها، مما يساعد في الملاحة الآمنة واتخاذ القرارات الفعالة.

مشهد على الطريق مع تجزئة المنطقة القابلة للقيادة باستخدام U-Net

الشكل 6. مشهد على الطريق حيث يتم تجزئة المنطقة القابلة للقيادة باستخدام U-Net. (المصدر)

إيجابيات وسلبيات U-Net#

حتى اليوم، يظل U-Net خيارًا جيدًا لتجزئة الصور بين الباحثين نظرًا لتوازنه بين البساطة والدقة والقابلية للتكيف. إليك بعض المزايا الرئيسية التي تجعله متميزًا:

  • قابل للتكيف مع طرائق مختلفة: تم تكييف U-Net مع أنواع بيانات مختلفة، بما في ذلك الفحوصات الطبية ثلاثية الأبعاد، وصور الأقمار الصناعية، وحتى إطارات الفيديو.
  • استنتاج سريع عند التحسين: عند ضبطه بشكل صحيح، يمكن لـ U-Net العمل بكفاءة، مما يجعله مناسبًا للتطبيقات في الوقت الفعلي أو شبه الفعلي.
  • المصدر المفتوح والمجتمع: يتوفر U-Net عبر مكتبات التعلم العميق الرئيسية وهو مدعوم بمجتمع كبير من المطورين والباحثين.

على الرغم من أن U-Net لديه العديد من نقاط القوة، إلا أن هناك أيضًا بعض القيود التي يجب وضعها في الاعتبار. إليك بعض العوامل التي يجب مراعاتها:

  • حساس لجودة البيانات: يمكن أن يتأثر أداء U-Net سلبًا بالبيانات منخفضة الجودة، مثل الصور المليئة بالضوضاء أو منخفضة الدقة.
  • عرضة للإفراط في التخصيص (overfitting) مع مجموعات البيانات الصغيرة: على الرغم من أن U-Net يعمل بشكل جيد مع البيانات المحدودة، إلا أنه لا يزال يخاطر بالإفراط في التخصيص إذا لم يتم تنظيمه بشكل صحيح، خاصة عندما تكون مجموعة البيانات صغيرة جدًا أو تفتقر إلى التنوع.
  • الموارد الحسابية: يمكن أن يكون U-Net مكلفًا من الناحية الحسابية، خاصة عند العمل مع مجموعات بيانات كبيرة، مما يتطلب موارد أجهزة كبيرة للتدريب.

أبرز النقاط#

لقد كان U-Net علامة فارقة في تطور تجزئة الصور. لقد أثبت أن نماذج التعلم العميق يمكن أن تحقق نتائج دقيقة باستخدام مجموعات بيانات أصغر، خاصة في مجالات مثل التصوير الطبي.

مهد هذا الاختراق الطريق لتطبيقات أكثر تقدمًا في مجالات مختلفة. مع استمرار تطور رؤية الحاسوب، تظل نماذج التجزئة مثل U-Net أساسية في تمكين الآلات من فهم وتفسير البيانات المرئية بدقة عالية.

هل تتطلع إلى بناء مشاريع الرؤية الحاسوبية الخاصة بك؟ استكشف مستودع GitHub الخاص بنا للتعمق أكثر في الذكاء الاصطناعي وتعرف على خيارات الترخيص لدينا. وتعرف على كيف تساهم الرؤية الحاسوبية في الرعاية الصحية في تحسين الكفاءة واستكشف تأثير الذكاء الاصطناعي في قطاع التجزئة من خلال زيارة صفحة الحلول الخاصة بنا! انضم إلى مجتمعنا المتنامي الآن!

Explore solutions

Real-time AI that works with your team

الذكاء الاصطناعي في الروبوتات

شغّل آلات أكثر ذكاءً باستخدام نماذج Ultralytics YOLO. يدفع الذكاء الاصطناعي للرؤية في الروبوتات الملاحة الذاتية، والإدراك، وتتبع الكائنات، والتحكم في الوقت الفعلي.
اعرف المزيد
Real-time AI that works with your team

الذكاء الاصطناعي في الخدمات اللوجستية

بسّط العمليات اللوجستية باستخدام نماذج Ultralytics YOLO. تُمكّن الرؤية بالذكاء الاصطناعي فحص الطرود، والفرز، وتتبع المركبات، ومراقبة السلامة في المستودعات في الوقت الفعلي.
اعرف المزيد
Real-time AI that works with your team

الذكاء الاصطناعي في التجزئة

أعد تصور تجارة التجزئة مع نماذج Ultralytics YOLO. تعزز الرؤية بالذكاء الاصطناعي تتبع المخزون، ومراقبة الأرفف، وإدارة الطوابير، ورؤى أكثر ذكاءً للعملاء.
اعرف المزيد
Real-time AI that works with your team

الذكاء الاصطناعي في الرعاية الصحية

قم ببناء حلول الرعاية الصحية مع نماذج Ultralytics YOLO. يعمل الذكاء الاصطناعي البصري في الرعاية الصحية على تعزيز سرعة التصوير الطبي، والتشخيص الأكثر ذكاءً، ومراقبة المرضى.
اعرف المزيد
Real-time AI that works with your team

الذكاء الاصطناعي في التصنيع

حسّن عمليات التصنيع باستخدام نماذج Ultralytics YOLO. تقود الرؤية بالذكاء الاصطناعي مراقبة الجودة، واكتشاف العيوب، والامتثال لمعدات الوقاية الشخصية (PPE)، وأتمتة خطوط التجميع.
اعرف المزيد
Real-time AI that works with your operation

الذكاء الاصطناعي في مجال السيارات

طبق رؤية الحاسوب في مجال السيارات مع نماذج Ultralytics YOLO. يعمل الذكاء الاصطناعي البصري على تعزيز السلامة على الطرق، ومساعدة السائق، وأتمتة المركبات من أجل طرق أكثر ذكاءً.
اعرف المزيد
Real-time AI tailored to your operation

الذكاء الاصطناعي في الزراعة

ادمج الذكاء الاصطناعي البصري في الزراعة الذكية باستخدام نماذج Ultralytics YOLO. عزز مراقبة المحاصيل، وتتبع الماشية، والزراعة الدقيقة للحصول على إنتاجية أعلى وأكثر ذكاءً.
اعرف المزيد
Real-time AI that works with your team

الذكاء الاصطناعي في الروبوتات

شغّل آلات أكثر ذكاءً باستخدام نماذج Ultralytics YOLO. يدفع الذكاء الاصطناعي للرؤية في الروبوتات الملاحة الذاتية، والإدراك، وتتبع الكائنات، والتحكم في الوقت الفعلي.
اعرف المزيد
Real-time AI that works with your team

الذكاء الاصطناعي في الخدمات اللوجستية

بسّط العمليات اللوجستية باستخدام نماذج Ultralytics YOLO. تُمكّن الرؤية بالذكاء الاصطناعي فحص الطرود، والفرز، وتتبع المركبات، ومراقبة السلامة في المستودعات في الوقت الفعلي.
اعرف المزيد
Real-time AI that works with your team

الذكاء الاصطناعي في التجزئة

أعد تصور تجارة التجزئة مع نماذج Ultralytics YOLO. تعزز الرؤية بالذكاء الاصطناعي تتبع المخزون، ومراقبة الأرفف، وإدارة الطوابير، ورؤى أكثر ذكاءً للعملاء.
اعرف المزيد
Real-time AI that works with your team

الذكاء الاصطناعي في الرعاية الصحية

قم ببناء حلول الرعاية الصحية مع نماذج Ultralytics YOLO. يعمل الذكاء الاصطناعي البصري في الرعاية الصحية على تعزيز سرعة التصوير الطبي، والتشخيص الأكثر ذكاءً، ومراقبة المرضى.
اعرف المزيد
Real-time AI that works with your team

الذكاء الاصطناعي في التصنيع

حسّن عمليات التصنيع باستخدام نماذج Ultralytics YOLO. تقود الرؤية بالذكاء الاصطناعي مراقبة الجودة، واكتشاف العيوب، والامتثال لمعدات الوقاية الشخصية (PPE)، وأتمتة خطوط التجميع.
اعرف المزيد
Real-time AI that works with your operation

الذكاء الاصطناعي في مجال السيارات

طبق رؤية الحاسوب في مجال السيارات مع نماذج Ultralytics YOLO. يعمل الذكاء الاصطناعي البصري على تعزيز السلامة على الطرق، ومساعدة السائق، وأتمتة المركبات من أجل طرق أكثر ذكاءً.
اعرف المزيد
Real-time AI tailored to your operation

الذكاء الاصطناعي في الزراعة

ادمج الذكاء الاصطناعي البصري في الزراعة الذكية باستخدام نماذج Ultralytics YOLO. عزز مراقبة المحاصيل، وتتبع الماشية، والزراعة الدقيقة للحصول على إنتاجية أعلى وأكثر ذكاءً.
اعرف المزيد
Real-time AI that works with your team

الذكاء الاصطناعي في الروبوتات

شغّل آلات أكثر ذكاءً باستخدام نماذج Ultralytics YOLO. يدفع الذكاء الاصطناعي للرؤية في الروبوتات الملاحة الذاتية، والإدراك، وتتبع الكائنات، والتحكم في الوقت الفعلي.
اعرف المزيد
Real-time AI that works with your team

الذكاء الاصطناعي في الخدمات اللوجستية

بسّط العمليات اللوجستية باستخدام نماذج Ultralytics YOLO. تُمكّن الرؤية بالذكاء الاصطناعي فحص الطرود، والفرز، وتتبع المركبات، ومراقبة السلامة في المستودعات في الوقت الفعلي.
اعرف المزيد
Real-time AI that works with your team

الذكاء الاصطناعي في التجزئة

أعد تصور تجارة التجزئة مع نماذج Ultralytics YOLO. تعزز الرؤية بالذكاء الاصطناعي تتبع المخزون، ومراقبة الأرفف، وإدارة الطوابير، ورؤى أكثر ذكاءً للعملاء.
اعرف المزيد
Real-time AI that works with your team

الذكاء الاصطناعي في الرعاية الصحية

قم ببناء حلول الرعاية الصحية مع نماذج Ultralytics YOLO. يعمل الذكاء الاصطناعي البصري في الرعاية الصحية على تعزيز سرعة التصوير الطبي، والتشخيص الأكثر ذكاءً، ومراقبة المرضى.
اعرف المزيد
Real-time AI that works with your team

الذكاء الاصطناعي في التصنيع

حسّن عمليات التصنيع باستخدام نماذج Ultralytics YOLO. تقود الرؤية بالذكاء الاصطناعي مراقبة الجودة، واكتشاف العيوب، والامتثال لمعدات الوقاية الشخصية (PPE)، وأتمتة خطوط التجميع.
اعرف المزيد
Real-time AI that works with your operation

الذكاء الاصطناعي في مجال السيارات

طبق رؤية الحاسوب في مجال السيارات مع نماذج Ultralytics YOLO. يعمل الذكاء الاصطناعي البصري على تعزيز السلامة على الطرق، ومساعدة السائق، وأتمتة المركبات من أجل طرق أكثر ذكاءً.
اعرف المزيد
Real-time AI tailored to your operation

الذكاء الاصطناعي في الزراعة

ادمج الذكاء الاصطناعي البصري في الزراعة الذكية باستخدام نماذج Ultralytics YOLO. عزز مراقبة المحاصيل، وتتبع الماشية، والزراعة الدقيقة للحصول على إنتاجية أعلى وأكثر ذكاءً.
اعرف المزيد

لنبنِ مستقبل الذكاء الاصطناعي معاً!

ابدأ رحلتك مع مستقبل تعلم الآلة