ما تحسين النماذج؟ دليل سريع
تعرّف على كيفية مساعدة تقنيات تحسين النماذج، مثل ضبط المعلمات الفائقة، وتشذيب النماذج، وتكميم النماذج، لنماذج الرؤية الحاسوبية على العمل بكفاءة أكبر.

تحسين النماذج هو عملية تهدف إلى رفع كفاءة نماذج التعلّم الآلي وأدائها. ومن خلال تحسين بنية النموذج ووظيفته، يتيح التحسين للنماذج تقديم نتائج أفضل باستخدام حد أدنى من الموارد الحاسوبية وتقليل وقتَي التدريب والتقييم.
تكتسب هذه العملية أهمية خاصة في مجالات مثل الرؤية الحاسوبية، حيث تتطلب النماذج غالبًا موارد كبيرة لتحليل الصور المعقدة. وفي البيئات محدودة الموارد، مثل الأجهزة المحمولة أو الأنظمة الطرفية، يمكن للنماذج المحسّنة العمل بكفاءة باستخدام موارد محدودة مع الحفاظ على الدقة.
تُستخدم عدة تقنيات شائعة لتحقيق تحسين النماذج، منها ضبط المعاملات الفائقة، وتقليص النماذج، وتكميم النماذج، والدقة المختلطة. في هذه المقالة، سنستكشف هذه التقنيات والفوائد التي تقدمها إلى تطبيقات الرؤية الحاسوبية. لنبدأ!
فهم تحسين النماذج#
تحتوي نماذج الرؤية الحاسوبية عادةً على طبقات عميقة وبنى معقدة ممتازة في التعرّف على الأنماط الدقيقة في الصور، لكنها قد تتطلب قدرًا كبيرًا من القدرة المعالجة. وعند نشر هذه النماذج على أجهزة ذات عتاد محدود، مثل الهواتف المحمولة أو الأجهزة الطرفية، فقد تواجه تحديات أو قيودًا معينة.
يمكن أن تؤدي محدودية القدرة المعالجة والذاكرة والطاقة في هذه الأجهزة إلى انخفاض ملحوظ في الأداء، إذ تواجه النماذج صعوبة في مواكبة المتطلبات. وتُعد تقنيات تحسين النماذج أساسية لمعالجة هذه التحديات. فهي تساعد على تبسيط النموذج، وتقليل احتياجاته الحاسوبية، وضمان استمرار عمله بفعالية حتى مع محدودية الموارد. ويمكن تحسين النماذج من خلال تبسيط بنية النموذج، أو تقليل دقة العمليات الحسابية، أو إزالة المكونات غير الضرورية لجعل النموذج أخف وأسرع.

الشكل 1. أسباب تحسين النماذج. الصورة من إعداد المؤلف.
فيما يلي بعض تقنيات تحسين النماذج الأكثر شيوعًا، والتي سنستكشفها بمزيد من التفصيل في الأقسام التالية:
- ضبط المعاملات الفائقة: يتضمن ذلك تعديل المعاملات الفائقة بصورة منهجية، مثل معدل التعلّم وحجم الدفعة، لتحسين أداء النموذج.
- تقليص النموذج: تزيل هذه التقنية الأوزان والوصلات غير الضرورية من الشبكة العصبية، مما يقلل تعقيدها وتكلفتها الحاسوبية.
- تكميم النموذج: يتضمن التكميم تقليل دقة أوزان النموذج وعمليات التنشيط، عادةً من 32 بت إلى 16 بت أو 8 بت، مما يقلل بدرجة كبيرة من البصمة الذاكرية والمتطلبات الحاسوبية.
- تعديلات الدقة: تُعرف أيضًا باسم التدريب بالدقة المختلطة، وتتضمن استخدام تنسيقات دقة مختلفة لأجزاء مختلفة من النموذج وتحسين استخدام الموارد دون المساس بالدقة.
شرح: المعاملات الفائقة في نماذج التعلّم الآلي#
يمكنك مساعدة النموذج على التعلّم والأداء بصورة أفضل من خلال ضبط معاملاته الفائقة، وهي إعدادات تحدد كيفية تعلّم النموذج من البيانات. ويُعد ضبط المعاملات الفائقة تقنية لتحسين هذه الإعدادات، مما يرفع كفاءة النموذج ودقته. وعلى عكس المعاملات التي يتعلمها النموذج أثناء التدريب، فإن المعاملات الفائقة قيم محددة مسبقًا توجه عملية التدريب.
لنستعرض بعض أمثلة المعاملات الفائقة التي يمكن ضبطها:
- معدل التعلّم: يتحكم هذا المعامل في حجم الخطوة التي يتخذها النموذج لتعديل أوزانه الداخلية. ويمكن لمعدل التعلّم الأعلى تسريع التعلّم، لكنه قد يؤدي إلى تجاوز الحل الأمثل، في حين قد يكون المعدل الأقل أكثر دقة لكنه أبطأ.
- حجم الدفعة: يحدد عدد عينات البيانات التي تُعالَج في كل خطوة تدريب. توفر أحجام الدفعات الأكبر تعلّمًا أكثر استقرارًا، لكنها تحتاج إلى ذاكرة أكبر. أما الدفعات الأصغر فتتدرب أسرع، لكنها قد تكون أقل استقرارًا.
- العصور: يمكنك باستخدام هذا المعامل تحديد عدد المرات التي يرى فيها النموذج مجموعة البيانات كاملة. وقد تحسن العصور الإضافية الدقة، لكنها تزيد خطر فرط التكيّف.
- حجم النواة: يحدد حجم المرشح في الشبكات العصبية الالتفافية (CNNs). تلتقط النوى الأكبر أنماطًا أوسع، لكنها تحتاج إلى معالجة أكبر؛ بينما تركز النوى الأصغر على التفاصيل الدقيقة.
كيف يعمل ضبط المعاملات الفائقة#
يبدأ ضبط المعاملات الفائقة عمومًا بتحديد نطاق من القيم المحتملة لكل معامل فائق. ثم تستكشف خوارزمية بحث تركيبات مختلفة ضمن هذه النطاقات لتحديد الإعدادات التي تحقق أفضل أداء.
تشمل أساليب الضبط الشائعة البحث الشبكي، والبحث العشوائي، والتحسين البايزي. يختبر البحث الشبكي كل تركيبة ممكنة من القيم ضمن النطاقات المحددة. ويختار البحث العشوائي التركيبات عشوائيًا، وغالبًا ما يجد إعدادات فعالة بسرعة أكبر. ويستخدم التحسين البايزي نموذجًا احتماليًا للتنبؤ بقيم واعدة للمعاملات الفائقة استنادًا إلى النتائج السابقة. ويقلل هذا النهج عادةً عدد التجارب المطلوبة.
في النهاية، يُجرى تقييم أداء النموذج لكل تركيبة من المعاملات الفائقة. وتتكرر العملية حتى تحقيق النتائج المطلوبة.
المعاملات الفائقة مقارنةً بمعاملات النموذج#
أثناء العمل على ضبط المعاملات الفائقة، قد تتساءل عن الفرق بين المعاملات الفائقة ومعاملات النموذج.
المعاملات الفائقة هي قيم تُحدد قبل التدريب وتتحكم في كيفية تعلّم النموذج، مثل معدل التعلّم أو حجم الدفعة. وتظل هذه الإعدادات ثابتة أثناء التدريب وتؤثر مباشرةً في عملية التعلّم. أما معاملات النموذج، فيتعلمها النموذج نفسه أثناء التدريب. وتشمل هذه المعاملات الأوزان والانحيازات، التي تتغير أثناء تدريب النموذج وتوجه في النهاية تنبؤاته. وبعبارة أخرى، تشكل المعاملات الفائقة مسار التعلّم، بينما تمثل معاملات النموذج نتائج عملية التعلّم هذه.

الشكل 2. مقارنة المعاملات والمعاملات الفائقة.
لماذا يُعد تقليص النماذج مهمًا في التعلّم العميق؟#
تقليص النموذج هو تقنية لتقليل الحجم تزيل الأوزان والمعاملات غير الضرورية من النموذج، مما يجعله أكثر كفاءة. وفي الرؤية الحاسوبية، ولا سيما مع الشبكات العصبية العميقة، يمكن لعدد كبير من المعاملات، مثل الأوزان وعمليات التنشيط (المخرجات الوسيطة التي تساعد على حساب المخرج النهائي)، أن يزيد التعقيد والمتطلبات الحاسوبية معًا. ويساعد التقليص على تبسيط النموذج من خلال تحديد المعاملات ذات الإسهام المحدود في الأداء وإزالتها، مما ينتج نموذجًا أخف وأكثر كفاءة.

الشكل 3. قبل تقليص النموذج وبعده.
بعد تدريب النموذج، يمكن لتقنيات مثل التقليص القائم على المقدار أو تحليل الحساسية تقييم أهمية كل معامل. ثم تُقلَّص المعاملات منخفضة الأهمية باستخدام إحدى التقنيات الرئيسية الثلاث: تقليص الأوزان، أو تقليص العُقد، أو التقليص البنيوي.
يزيل تقليص الأوزان الوصلات الفردية ذات التأثير المحدود في المخرج. ويزيل تقليص العُقد العُقد العصبية الكاملة التي تسهم مخرجاتها بدرجة ضئيلة في وظيفة النموذج. أما التقليص البنيوي فيزيل أقسامًا أكبر، مثل المرشحات الالتفافية أو العُقد الموجودة في الطبقات كاملة الاتصال، مما يحسن كفاءة النموذج. وبعد اكتمال التقليص، يُعاد تدريب النموذج من أجل الضبط الدقيق للمعاملات المتبقية، بما يضمن احتفاظه بدقة عالية في صورة أصغر.
تقليل زمن الاستجابة في نماذج الذكاء الاصطناعي باستخدام التكميم#
يقلل تكميم النموذج عدد البتات المستخدمة لتمثيل أوزان النموذج وعمليات التنشيط. وعادةً ما يحول القيم عالية الدقة ذات الفاصلة العائمة، التي تمثل 32 بت، إلى دقة أقل، مثل الأعداد الصحيحة ذات 16 بت أو 8 بت. ومن خلال تقليل دقة البتات، يخفض التكميم بدرجة كبيرة حجم النموذج وبصمته الذاكرية وتكلفته الحاسوبية.
في الرؤية الحاسوبية، تُعد القيم العائمة ذات 32 بت معيارًا شائعًا، لكن تحويلها إلى 16 بت أو 8 بت يمكن أن يحسن الكفاءة. وهناك نوعان رئيسيان من التكميم: تكميم الأوزان وتكميم عمليات التنشيط. يقلل تكميم الأوزان دقة أوزان النموذج، محققًا توازنًا بين تقليل الحجم والدقة. ويقلل تكميم عمليات التنشيط دقة هذه العمليات، مما يخفض متطلبات الذاكرة والحوسبة بصورة أكبر.

الشكل 4. مثال على التكميم من قيمة عائمة ذات 32 بت إلى عدد صحيح ذي 8 بت.
كيف تسرّع الدقة المختلطة عمليات الاستدلال بالذكاء الاصطناعي#
الدقة المختلطة هي تقنية تستخدم درجات دقة عددية مختلفة لأجزاء متنوعة من الشبكة العصبية. ومن خلال الجمع بين قيم عالية الدقة، مثل القيم العائمة ذات 32 بت، وقيم أقل دقة، مثل القيم العائمة ذات 16 بت أو 8 بت، تتيح الدقة المختلطة لـنماذج الرؤية الحاسوبية تسريع التدريب وتقليل استخدام الذاكرة دون التضحية بالدقة.
أثناء التدريب، تتحقق الدقة المختلطة باستخدام دقة أقل في طبقات محددة، مع الحفاظ على دقة أعلى حيثما تكون مطلوبة عبر الشبكة. ويتم ذلك من خلال تحويل الأنواع وتوسيع الخسارة. إذ يحول تحويل الأنواع أنواع البيانات بين درجات الدقة المختلفة وفقًا لمتطلبات النموذج. ويضبط توسيع الخسارة الدقة المنخفضة لمنع التدفق العددي السفلي، مما يضمن استقرار التدريب. وتفيد الدقة المختلطة خصوصًا في النماذج الكبيرة وأحجام الدفعات الكبيرة.

الشكل 5. يستخدم التدريب بالدقة المختلطة نوعَي الفاصلة العائمة ذوي 16 بت (FP16) و32 بت (FP32).
تحقيق التوازن بين دقة النموذج وكفاءته#
بعد أن استعرضنا عدة تقنيات لتحسين النماذج، لنناقش كيفية تحديد التقنية التي ينبغي استخدامها بناءً على احتياجاتك الخاصة. يعتمد الاختيار على عوامل مثل العتاد المتاح، والقيود الحاسوبية وقيود الذاكرة في بيئة النشر، ومستوى الدقة المطلوب.
فعلى سبيل المثال، تناسب النماذج الأصغر والأسرع الأجهزة المحمولة محدودة الموارد، بينما يمكن استخدام النماذج الأكبر والأعلى دقة على الأنظمة عالية الأداء. إليك كيفية توافق كل تقنية مع أهداف مختلفة:
- التقليص: يُعد مثاليًا لتقليل حجم النموذج دون التأثير بدرجة كبيرة في الدقة، مما يجعله مناسبًا جدًا للأجهزة محدودة الموارد، مثل الهواتف المحمولة أو أجهزة إنترنت الأشياء (IoT).
- التكميم: خيار ممتاز لتقليص حجم النموذج وتسريع الاستدلال، ولا سيما على الأجهزة المحمولة والأنظمة المضمنة محدودة الذاكرة والقدرة المعالجة. ويعمل جيدًا في التطبيقات التي تقبل انخفاضًا طفيفًا في الدقة.
- الدقة المختلطة: صُممت هذه التقنية للنماذج واسعة النطاق، وتقلل استخدام الذاكرة وتسرّع التدريب على عتاد مثل وحدات GPU وTPUs التي تدعم العمليات بالدقة المختلطة. وتُستخدم غالبًا في المهام عالية الأداء التي تكون فيها الكفاءة مهمة.
- ضبط المعاملات الفائقة: رغم أنه يتطلب موارد حاسوبية كبيرة، فإنه ضروري للتطبيقات التي تتطلب دقة عالية، مثل التصوير الطبي أو القيادة الذاتية.
أهم النقاط المستخلصة#
يُعد تحسين النماذج جزءًا حيويًا من التعلّم الآلي، ولا سيما عند نشر الذكاء الاصطناعي في تطبيقات واقعية. وتساعد تقنيات مثل ضبط المعاملات الفائقة، وتقليص النماذج، والتكميم، والدقة المختلطة على تحسين أداء نماذج الرؤية الحاسوبية وكفاءتها واستخدامها للموارد. وتجعل هذه التحسينات النماذج أسرع وأقل استهلاكًا للموارد، مما يجعلها مثالية للأجهزة محدودة الذاكرة والقدرة المعالجة. كما يسهل توسيع النماذج المحسّنة ونشرها عبر منصات مختلفة، مما يتيح حلولًا للذكاء الاصطناعي فعالة وقابلة للتكيف مع مجموعة واسعة من الاستخدامات.
زُر مستودع GitHub الخاص بـ Ultralytics وانضم إلى مجتمعنا لمعرفة المزيد عن تطبيقات الذكاء الاصطناعي في التصنيع والزراعة.









