أبرز محطات Ultralytics في YOLO Vision 2025!
انضم إلينا في ملخص لأكبر حدث تنظمه Ultralytics لهذا العام، والذي يعرض إطلاق Ultralytics YOLO26، وجلسات نقاشية ملهمة، وأبرز إنجازات المجتمع.

اجتمع مجتمع الذكاء الاصطناعي والرؤية الحاسوبية في 25 سبتمبر لحضور YOLO Vision 2025 (YV25)، وهو حدث الرؤية الحاسوبية الهجين السنوي الذي تنظمه Ultralytics. استضاف الحدث في لندن في The Pelligon وتم بثه عالمياً، ورحب الحدث بمجموعة متنوعة من الباحثين والمهندسين ومحبي الذكاء الاصطناعي لتبادل الأفكار والتعرف على الابتكارات الجديدة، مثل Ultralytics YOLO26.
في عامه الرابع، واصل الحدث نموه من حيث النطاق والتأثير. لقد حصد بث YV25 المباشر بالفعل أكثر من 6,800 مشاهدة، وحقق أكثر من 49,000 ظهور، وجمع ما يقرب من 2,000 ساعة من وقت المشاهدة.
انطلق حدث YV25 بكلمة افتتاحية ألقاها مضيفنا Oisin Lunny، والذي ضبط نغمة اليوم من خلال تشجيع الحاضرين على التواصل والمشاركة والاستفادة القصوى من الحدث. وكما عبر قائلاً: "يعد YOLO Vision 2025 المؤتمر الذي يوحد مجتمع رؤية الذكاء الاصطناعي مفتوح المصدر للتركيز على البيانات، والتعلم الآلي، وتطورات الرؤية الحاسوبية".
في هذا المقال، سنستعرض أبرز مقتطفات YOLO Vision 2025، بما في ذلك إطلاق المنتج، والكلمات الرئيسية، والجلسات النقاشية، والعروض التوضيحية الحية، ولحظات المجتمع التي جعلت اليوم مميزاً. لنبدأ!
من مجرد GPU واحد إلى تمويل بقيمة 30 مليون دولار في الجولة (أ)#
قُبيل الحدث، كان هناك الكثير من الحماس المحيط بإطلاق المنتج الجديد، وقد استهل Glenn Jocher، مؤسسنا والرئيس التنفيذي، اليوم بالبناء على تلك الطاقة.
شاركنا رحلة Ultralytics، مستذكراً كيف كان في عام 2020 يجري تجارب على بطاقة 1080 Ti واحدة متصلة بجهاز MacBook الخاص به، وهو إعداد أصبح قديماً اليوم. ومن تلك البدايات المتواضعة، نمت Ultralytics لتصبح مجتمعاً عالمياً بمليارات الاستنتاجات اليومية التي تعمل بواسطة نماذج YOLO.
تحدث Glenn أيضاً عن إتمام Ultralytics مؤخراً لجولة تمويل الفئة أ بقيمة 30 مليون دولار. وشرح كيف سيقود هذا الاستثمار المرحلة التالية من النمو من خلال السماح للشركة بتوسيع نطاق الفريق، وتوسيع نطاق الأبحاث، وتوفير الموارد الحوسبية اللازمة لمواصلة دفع حدود الرؤية الحاسوبية.
Ultralytics YOLO26: نموذج YOLO أفضل وأسرع وأصغر#
مضى Glenn ليعلن عن جهود جديدة من Ultralytics. الأول هو Ultralytics YOLO26، أحدث نموذج في عائلة Ultralytics YOLO، المصمم ليكون أصغر وأسرع وأكثر كفاءة مع تحقيق دقة أكبر. والثاني هو Ultralytics Platform، وهي مساحة عمل SaaS جديدة متكاملة تجمع بين البيانات والتدريب والنشر والمراقبة لجعل بناء حلول رؤية الحاسوب أسهل من أي وقت مضى، ومن المتوقع الإعلان عنها في المستقبل القريب.

شكل 1. Glenn Jocher يعلن عن Ultralytics YOLO26 على المسرح في YOLO Vision 2025.
تم تصميم YOLO26 من Ultralytics لدفع الأداء نحو الأمام مع الحفاظ على عمليته للاستخدام في العالم الحقيقي. تعمل النسخة الأصغر بالفعل بشكل أسرع بنسبة تصل إلى 43% على وحدات المعالجة المركزية (CPUs) مع الاستمرار في تحسين الدقة، مما يجعلها مثالية للتطبيقات بدءاً من الأجهزة المحمولة وحتى أنظمة المؤسسات الكبيرة. سيتوفر YOLO26 للجمهور بحلول نهاية أكتوبر.
إليك لمحة عن الميزات الرئيسية لـ YOLO26:
- هندسة مبسطة: تم إزالة وحدة خسارة بؤرة التوزيع (DFL)، والتي كانت تبطئ النماذج سابقاً. يعمل نموذج Ultralytics YOLO26 الآن بكفاءة أكبر دون التضحية بالدقة.
- تنبؤات أسرع: يقدم نموذج Ultralytics YOLO26 خياراً لتخطي خطوة كبح غير الماكسيمام (NMS)، مما يمكنه من تقديم النتائج بسرعة أكبر وتسهيل النشر في الوقت الفعلي.
- أفضل في رصد الأجسام الصغيرة: تعمل طرق التدريب الجديدة على تحسين الاستقرار وتعزيز الدقة بشكل كبير، خاصة عند اكتشاف تفاصيل صغيرة في مشاهد معقدة.
- تدريب أكثر ذكاءً: يجمع مُحسّن MuSGD الجديد بين نقاط قوة تقنيتي تدريب، مما يساعد النموذج على التعلم بشكل أسرع والوصول إلى دقة أعلى.
نظرة أولى على منصة Ultralytics#
بعد تقديم YOLO26، دعا Glenn Prateek Bhatnagar، رئيس هندسة المنتجات لدينا، لاستعراض المشروع القادم في الأفق، وهو منصة Ultralytics Platform. صُممت المنصة لتلخيص سير عمل الرؤية الحاسوبية بأكمله، وتهدف إلى جمع مجموعات البيانات، والتسميد التوضيحي، والتدريب، والنشر، والمراقبة في مكان واحد.
شبه Prateek الأمر بصيانة سيارة: بدلاً من زيارة ورش مختلفة للإطارات، والمحركات، وناقلات الحركة، يحدث كل شيء في مرآب واحد. بنفس الطريقة، تمنح المنصة المطورين مساحة عمل متكاملة لإدارة دورة الحياة الكاملة لنموذج ذكاء اصطناعي بصري.
عرض العرض التوضيحي أدوات تعليق توضيحي مدعومة بالذكاء الاصطناعي تسرع إعداد مجموعات البيانات، وخيارات تدريب قابلة للتخصيص لكل من الخبراء والمبتدئين، ومراقبة في الوقت الفعلي لتشغيلات التدريب.
رؤى من جلسة نقاشية حول النشر على الحافة (Edge Deployment)#
كان من أبرز محطات YV25 الأخرى حلقة نقاشية حول النشر على الحافة (edge deployment)، أدارها Oisin Lunny. شارك في الجلسة كل من Yuki Tsuji من شركة Sony Semiconductor Solutions، وDavid Plowman من Raspberry Pi، وGlenn Jocher.
استكشفت المناقشة كيف يقلل نقل الذكاء الاصطناعي إلى الحافة من زمن الاستجابة، ويخفض التكاليف، ويحسن الخصوصية. عرض Yuki مستشعر IMX500 من Sony، الذي يمكنه تشغيل الاستنتاج مباشرة على الشريحة. وفي الوقت نفسه، تحدث David عن كيفية توسع Raspberry Pi من جذورها في عالم الصنّاع إلى تطبيقات تجارية واسعة النطاق.

شكل 2. جلسة نقاشية حول النشر على الحافة تضم Oisin Lunny وYuki Tsuji وDavid Plowman وGlenn Jocher.
تطرقت الحلقة أيضاً إلى أحد أكبر العقبات التي تواجه المطورين: جعل النماذج تعمل بسلاسة عبر الأجهزة المختلفة. وهنا يبرز الدور الرئيسي الذي تلعبه حزمة Ultralytics بايثون (Python package).
مع مجموعة واسعة من خيارات التصدير، يصبح من السهل نقل نموذج مدرب إلى مرحلة الإنتاج على الهواتف المحمولة، أو الأنظمة المدمجة، أو أجهزة المؤسسات. من خلال إزالة عناء تحويل النماذج، تساعد Ultralytics الفرق على التركيز على بناء الحلول بدلاً من الصراع مع مشكلات التوافق.
كما أوضح David، "أعلم من تجربتي المريرة أن تحويل النماذج أمر فظيع، وإذا قام شخص آخر بذلك نيابة عني، فسيجعل ذلك الحياة أسهل بكثير. وهنا تقوم Ultralytics حقاً بتحسين القصة وتقديم شيء ذي قيمة لمستخدمينا."
تسريع الابتكار وأجهزة الذكاء الاصطناعي#
تحدث تطورات برمجيات الذكاء الاصطناعي بالتوازي مع الأجهزة، ومعاً تقودان موجة جديدة من الابتكار في رؤية الحاسوب. وبينما تواصل نماذج مثل Ultralytics YOLO دفع الدقة للأمام، يعتمد تأثيرها في العالم الحقيقي أيضاً على المنصات التي تعمل عليها.
على سبيل المثال، عرضت Seeed Studio كيف أن الأجهزة المعيارية منخفضة التكلفة مثل لوحات reCamera وXIAO، المحملة مسبقاً بنماذج Ultralytics YOLO، تسهل على المطورين الانتقال من النموذج الأولي إلى أنظمة الذكاء الاصطناعي في العالم الحقيقي. هذا النوع من التكامل بين الأجهزة والبرمجيات يخفض حاجز الدخول ويظهر كيف يسرع الابتكار على مستوى الأجهزة التبني بشكل مباشر.
إليك بعض النقاط الرئيسية من كلمات YV25 الرئيسية الأخرى التي أكدت كيف يفتح التصميم المشترك للأجهزة والبرمجيات إمكانيات جديدة:
- التكميم يفتح مكاسب كبيرة في السرعة: أظهرت Intel كيف أن تحويل نماذج Ultralytics YOLO إلى OpenVINO مع التكميم أدى إلى تعزيز الاستنتاج من 54 FPS إلى 606 FPS في 30 دقيقة فقط، مما يسلط الضوء على قوة التحسين.
- أدوات كاملة المكدس تجعل نشر الذكاء الاصطناعي على الحافة عملياً: سلطت NVIDIA الضوء على كيفية عمل أجهزة Jetson، وTensorRT، وTriton Inference Server، وDeepStream SDK معاً لتبسيط نشر الذكاء الاصطناعي البصري عالي الأداء على الحافة.
- الأنظمة البيئية المفتوحة تسرع النمذجة الأولية: أكدت AMD على منصتها الشاملة المبنية على وحدات معالجة الرسومات (GPUs) ومكدس برمجيات ROCm، مما يساعد المطورين على الانتقال بسرعة من النموذج الأولي إلى النشر مع التحكم في التكاليف.
- الرقائق منخفضة الطاقة توسع الذكاء الاصطناعي للأجهزة المقيدة: قدمت DEEPX معالجاتها DX-M1 وDX-M2، التي تقدم عشرات من TOPS بأقل من 5 وات لتمكين استنتاج متقدم في أنظمة مدمجة ومحدودة الطاقة.
الاتجاهات الحديثة في الرؤية الحاسوبية#
مع تقدم كل من البرمجيات والأجهزة يداً بيد، تتطور رؤية الحاسوب أسرع من أي وقت مضى. هذه التطورات المتوازية لا تحسن الدقة والسرعة فحسب، بل تشكل أيضاً كيفية نشر الذكاء الاصطناعي البصري في العالم الحقيقي. في YV25، أتيحت للمشاركين الفرصة للاستماع إلى خبراء في مجالات الروبوتات، والنشر على الحافة، والذكاء الاصطناعي متعدد الوسائط، حيث قدم كل منهم منظوراً مختلفاً حول اتجاه هذا المجال.
على سبيل المثال، في كلمته الرئيسية، أظهر Michael Hart من D-Robotics كيف أن دمج نماذج Ultralytics YOLO مع لوحة RDK X5 المدمجة الخاصة بهم (وهي وحدة رؤية ذكاء اصطناعي مدمجة صغيرة) يمكن الروبوتات من تشغيل نماذج رؤية متقدمة في الوقت الفعلي. أظهر عرضه الحي مدى التقدم الذي حققته روبوتات اليوم، حيث تطورت من تجارب مخبرية إلى أنظمة عملية تعمل بالذكاء الاصطناعي.

شكل 3. سلط Michael Hart الضوء على كيفية اعتماد الروبوتات التي تعمل بالذكاء الاصطناعي اليوم على رؤية الحاسوب.
وبالمثل، أكد كل من Alexis Crowell وSteven Hunsche من Axelera AI على التحديات والفرص المتعلقة بنشر ذكاء الرؤية الاصطناعي على الحافة. من خلال عروض حية، شرحا كيف تجمع وحدات المعالجة Metis AI Processing Units (AIPUs) الخاصة بـ Axelera AI بين بنية RISC-V والحوسبة الرقمية داخل الذاكرة لتقديم أداء عالٍ باستهلاك منخفض جداً للطاقة. ومن خلال تغليفها في أشكال مألوفة مثل M.2 وPCIe، يجعل التصميم المشترك للأجهزة والبرمجيات للمنصة عملية توسيع نطاق الذكاء الاصطناعي على الحافة عملية وعالية الكفاءة.
وفي جلسة أخرى، استكشفت Merve Noyan من Hugging Face صعود الذكاء الاصطناعي متعدد الوسائط (multimodal AI)، حيث تجمع النماذج بين الرؤية والنصوص والصوت ومدخلات أخرى. وتحدثت عن حالات الاستخدام التي تتراوح من تحليل المستندات إلى الوكلاء المتجسدين، مؤكدةً كيف يسرع الابتكار مفتوح المصدر من تبني الذكاء الاصطناعي.
موازنة التقدم التقني مع القيم الإنسانية#
بينما تضمن حدث YV25 محادثات ملهمة ذات نظرة شمولية، فإنه تضمن أيضاً جلسات عملية بعمق. قدم Jiri Borovec من Lightning AI دليلاً عملياً توضيحياً يُظهر كيفية تدريب وضبط نماذج Ultralytics YOLO باستخدام PyTorch Lightning ودعم وحدات معالجة رسومية متعددة (multi-GPU).
استعرض أمثلة برمجية وسلط الضوء على كيف تجعل الأدوات مفتوحة المصدر، والوثائق الواضحة، والأطر المرنة من السهل على المطورين توسيع نطاق التدريب، والتحقق من كل مرحلة، وتكييف سير العمل لمشاريعهم الخاصة. لقد كان تذكيراً بمدى أهمية المجتمع والأدوات المتاحة للتقدم الحقيقي في رؤية الحاسوب.
على الجانب الآخر، حث المتحدثون الجمهور على التفكير في الدور الأوسع للذكاء الاصطناعي في المجتمع. في كلمته الرئيسية، جادل Gerd Leonhard، المتنبئ المستقبلي، والإنساني، والرئيس التنفيذي لـ The Futures Agency، بأن "التكنولوجيا محايدة أخلاقياً حتى نستخدمها نحن"، مؤكداً أن السؤال الحقيقي ليس فقط ما يمكن للذكاء الاصطناعي فعله، بل ما يجب عليه فعله. وحذر من الوقوع في فخاخ مثل النزعة الاختزالية وغياب الحقيقة، داعياً إلى ذكاء اصطناعي يخدم حقاً مصالح البشرية طويلة الأمد.

شكل 4. Gerd Leonhard يشارك أفكاره حول بناء حلول الذكاء الاصطناعي مع الحفاظ عليها متمحورة حول الإنسان.
استمر هذا التركيز على المسؤولية في حوار مفتوح مع Carissa Véliz من جامعة أكسفورد، التي أكدت على الخصوصية والأمان. وأشارت إلى أن مجتمعات المصادر المفتوحة حيوية لمراجعة وتحسين التعليمات البرمجية، وأن الأخلاق والتصميم لا ينفصلان. وكانت رسالتها واضحة: يجب على المطورين توقع سوء الاستخدام وبناء أنظمة تضع كرامة الإنسان والرفاه الاجتماعي في المقام الأول.
التواصل في لندن في YV25#
بخطوة تتجاوز المحادثات والعروض التوضيحية، وفر YV25 أيضاً مساحة للناس للتواصل. خلال استراحات القهوة والغداء، اختلط الحضور، وشاركوا التجارب، وقارنوا الأساليب، وأطلقوا تعاونات جديدة.
بالنسبة إلى فريق Ultralytics، كانت أيضاً فرصة رائعة للاتقاء شخصياً. ومع انتشار الأعضاء في جميع أنحاء العالم، تساعد لحظات كهذه على تعزيز الروابط والاحتفال بالتقدم معاً.

شكل 5. فريق Ultralytics يختتم يوماً ملهماً في YOLO Vision 2025.
اختتم اليوم بحفل بعد المؤتمر، حيث أتيحت للمشاركين فرصة الاسترخاء ومواصلة التواصل. كانت لحظة للتأمل، وإعادة الشحن، والتطلع إلى الفصل التالي من الابتكار في الذكاء الاصطناعي البصري.
دفع حدود الذكاء الاصطناعي البصري معاً#
كان YOLO Vision 2025 احتفالاً بالأفكار والابتكار والمجتمع. مهد إطلاق Ultralytics YOLO26 الطريق، تلاه محادثات جذابة حول النشر على الحافة والذكاء الاصطناعي المتمحور حول الإنسان والتي سلطت الضوء على التقدم السريع للذكاء الاصطناعي البصري وتأثيره المتزايد على العالم.
بالإضافة إلى الجلسات الرئيسية، جمع الحدث الناس معاً. شارك الباحثون والمطورون والعشاق تجاربهم، وأثاروا محادثات هادفة، واستكشفوا إمكانيات جديدة للمستقبل. انتهى الحدث بنبرة إيجابية، مع شعور المشاركين بالحماس تجاه مستقبل نماذج Ultralytics YOLO ورؤية الحاسوب.
هل أنت مستعد لاستكشاف الذكاء الاصطناعي؟ انضم إلى مجتمعنا ومستودع GitHub لمعرفة المزيد عن الذكاء الاصطناعي والرؤية الحاسوبية. تفضل بزيارة صفحتنا للحلول لاستكشاف المزيد من تطبيقات الرؤية الحاسوبية في الزراعة والذكاء الاصطناعي في الروبوتات. تحقق من خيارات الترخيص الخاصة بنا وابدأ في استخدام الرؤية الحاسوبية اليوم!






