Model Weights
تعرف على كيفية عمل أوزان النموذج كمعرفة للذكاء الاصطناعي. استكشف كيف يستخدم Ultralytics YOLO26 الأوزان المحسنة لتدريب واستدلال أسرع وأكثر دقة.
أوزان النموذج هي المعاملات القابلة للتعلم داخل نموذج التعلم الآلي والتي تحول بيانات الإدخال إلى مخرجات متوقعة. في الشبكة العصبية، تمثل هذه الأوزان قوة الاتصالات بين الخلايا العصبية عبر الطبقات المختلفة. عند تهيئة النموذج، عادةً ما يتم تعيين هذه الأوزان بقيم عشوائية وصغيرة، مما يعني أن النموذج لا "يعلم" شيئاً. من خلال عملية تُسمى التدريب، يقوم النموذج بتعديل هذه الأوزان بشكل تكراري بناءً على الأخطاء التي يرتكبها، متعلمًا تدريجيًا التعرف على الأنماط والسمات والعلاقات داخل البيانات. يمكنك التفكير في أوزان النموذج على أنها "ذاكرة" أو "معرفة" الذكاء الاصطناعي؛ فهي تخزن ما تعلمه النظام من بيانات التدريب.
دور الأوزان في التعلم#
The primary goal of training a neural network is to find the optimal set of model weights that minimizes the error between the model's predictions and the actual ground truth. This process involves passing data through the network—a step known as the forward pass—and then calculating a loss value using a specific loss function. If the prediction is incorrect, an optimization algorithm like Stochastic Gradient Descent (SGD) or the newer Muon optimizer used in YOLO26 calculates how much each weight contributed to the error.
من خلال تقنية تُسمى الانتشار العكسي، تقوم الخوارزمية بتحديث الأوزان بشكل طفيف لتقليل الخطأ في المرة القادمة. تتكرر هذه الدورة آلاف أو ملايين المرات حتى تستقر أوزان النموذج ويحقق النظام دقة عالية. بمجرد اكتمال التدريب، يتم "تجميد" الأوزان وحفظها، مما يسمح بنشر النموذج لـالاستدلال على بيانات جديدة وغير مرئية.
أوزان النموذج مقابل التحيزات#
من المهم التمييز بين الأوزان والتحيزات (biases)، حيث إنهما يعملان معًا ولكنهما يخدمان أغراضًا مختلفة. في حين أن أوزان النموذج تحدد قوة واتجاه الاتصال بين الخلايا العصبية (مما يتحكم في ميل التنشيط)، فإن التحيزات تسمح بإزاحة دالة التنشيط إلى اليسار أو اليمين. يضمن هذا الإزاحة أن النموذج يمكنه ملاءمة البيانات بشكل أفضل، حتى عندما تكون جميع ميزات الإدخال صفرًا. معًا، تشكل الأوزان والتحيزات المعاملات القابلة للتعلم التي تحدد سلوك بنيات مثل الشبكات العصبية التلافيفية (CNNs).
تطبيقات العالم الحقيقي#
أوزان النموذج هي المكون الأساسي الذي يمكن أنظمة الذكاء الاصطناعي من العمل في مختلف الصناعات. إليك مثالان ملموسان على كيفية تطبيقها:
- الرؤية الحاسوبية في قطاع التجزئة: في نظام سوبر ماركت ذكي، يستخدم نموذج مثل YOLO26 أوزانه المدربة لتحديد المنتجات على الرف. لقد "تعلمت" الأوزان السمات المرئية - مثل شكل علبة حبوب الإفطار أو لون علبة المشروبات الغازية - مما يسمح للنظام باكتشاف العناصر، وإدارة المخزون، وحتى تسهيل عمليات الدفع الآلي بكفاءة.
- تحليل الصور الطبية: في الرعاية الصحية، تستخدم نماذج التعلم العميق أوزانًا متخصصة لتحليل الأشعة السينية أو فحوصات التصوير بالرنين المغناطيسي. على سبيل المثال، يستخدم النموذج المدرب على اكتشاف الأورام أوزانه للتمييز بين الأنسجة السليمة والتشوهات المحتملة. تلتقط هذه الأوزان أنماطًا معقدة وغير خطية في بيانات البكسل قد تكون خفية على العين البشرية، مما يساعد أطباء الأشعة في إجراء تشخيصات أسرع.
حفظ وتحميل الأوزان#
من الناحية العملية، يتضمن التعامل مع أوزان النموذج حفظ المعاملات المدربة في ملف وتحميلها لاحقًا للتنبؤ أو الضبط الدقيق. في نظام Ultralytics البيئي، يتم تخزين هذه عادةً كملفات .pt (PyTorch).
إليك مثال بسيط حول كيفية تحميل الأوزان المدربة مسبقًا في نموذج YOLO وتشغيل تنبؤ:
from ultralytics import YOLO
# Load a model with pre-trained weights (e.g., YOLO26n)
model = YOLO("yolo26n.pt")
# Run inference on an image using the loaded weights
results = model("https://ultralytics.com/images/bus.jpg")
# Print the number of detected objects
print(f"Detected {len(results[0].boxes)} objects.")التعلم بنقل المعرفة والضبط الدقيق#
One of the most powerful aspects of model weights is their portability. Instead of training a model from scratch—which requires massive datasets and significant compute power—developers often use transfer learning. This involves taking a model with weights pre-trained on a large dataset like COCO or ImageNet and adapting it to a specific task.
على سبيل المثال، قد تأخذ الأوزان من كاشف كائنات عام وتقوم بضبطها بدقة على مجموعة بيانات أصغر من الألواح الشمسية. نظرًا لأن الأوزان المدربة مسبقًا تفهم بالفعل الحواف والأشكال والقوام، فإن النموذج يتقارب بشكل أسرع بكثير ويتطلب بيانات مصنفة أقل. أدوات مثل Ultralytics Platform تبسط هذه العملية، مما يسمح فرق العمل بإدارة مجموعات البيانات، وتدريب النماذج على السحابة، ونشر الأوزان المحسنة لأجهزة الحافة بسلاسة.
الضغط والتحسين#
غالبًا ما تركز أبحاث الذكاء الاصطناعي الحديثة على تقليل حجم ملف أوزان النموذج دون التضحية بالأداء، وهي عملية تُعرف باسم تكميم النموذج. من خلال تقليل دقة الأوزان (على سبيل المثال، من الفاصلة العائمة 32-بت إلى أعداد صحيحة 8-بت)، يمكن للمطورين تقليل استخدام الذاكرة بشكل كبير وتحسين سرعة الاستدلال. هذا أمر بالغ الأهمية لنشر النماذج على الأجهزة مقيدة الموارد مثل الهواتف المحمولة أو أجهزة Raspberry Pi. بالإضافة إلى ذلك، تقنيات مثل التقليم (pruning) تزيل الأوزان التي تساهم بشكل طفيف في المخرجات، مما يؤدي إلى تبسيط النموذج بشكل أكبر لتطبيقات الوقت الحقيقي.






