Diffusion Forcing
استكشف Diffusion Forcing، وهو نموذج توليدي يجمع بين التنبؤ الانحداري الذاتي وانتشار التسلسل لتوليد بيانات زمنية متسقة.
يُعدّ فرض الانتشار نموذجًا متقدمًا للنمذجة التوليدية، طُرح في عام 2024، ويجمع بين مزايا التنبؤ التلقائي التكراري بالرمز التالي والانتشار على التسلسل الكامل. ومن خلال تطبيق مستويات ضوضاء مستقلة ومتغيرة على خطوات مختلفة ضمن التسلسل، تُمكّن هذه التقنية نماذج التعلّم الآلي من توليد بيانات زمنية متسقة بدرجة عالية. وعلى خلاف الأساليب التقليدية التي تتنبأ بالرموز المنفصلة واحدًا تلو الآخر أو تزيل الضوضاء من التسلسل بأكمله في الوقت نفسه، يدرّب فرض الانتشار النماذج على العمل كمخططين ومولّدات تسلسلات متينة، مع التعامل مع حالات مستمرة ذات تبعيات معقدة وطويلة الأفق.
آلية عمل فرض الانتشار#
يستمد فرض الانتشار جوهره من الإلهام من أسلوب إجبار المعلّم الكلاسيكي المستخدم في الشبكات العصبية التكرارية. إلا أنه بدلًا من تمرير الرموز المنفصلة الصحيحة للإجابة للتنبؤ بالخطوة التالية، يمرّر سجلات تاريخية مستمرة أُضيفت إليها ضوضاء جزئيًا إلى Transformer سببي. يتعلم النموذج إزالة الضوضاء من الحالة الحالية بالاعتماد على الماضي. ويتيح ذلك للشبكة ضبط مستوى الضوضاء ديناميكيًا لكل إطار، ما يوفر إطارًا مرنًا للمهام التي تتطلب دقة موضعية ووعيًا زمنيًا واسعًا في آن واحد.
يُعدّ هذا النهج مفيدًا للغاية عند بناء وكلاء الذكاء الاصطناعي الأذكياء الذين يجب أن يستجيبوا للبيئات غير المتوقعة مع الالتزام بخطة طويلة الأجل، متجاوزًا مشكلات تراكم الأخطاء التي تظهر غالبًا في النماذج التلقائية التكرارية القياسية.
التطبيقات الواقعية#
يكتسب فرض الانتشار زخمًا سريعًا في عدة مجالات معقدة من الذكاء الاصطناعي:
- الروبوتات والتحكم البصري الحركي: تستخدم الأذرع الروبوتية المستقلة والأنظمة ذاتية القيادة فرض الانتشار لتوليد خطط مسارات سلسة ومستمرة. ومن خلال التنبؤ بتسلسلات من أوامر حركية مستمرة، تستطيع الروبوتات التكيف مع العوائق الديناميكية مع الحفاظ على مسار مستقر نحو هدفها.
- توليد الفيديو والتنبؤ به: في مسارات عمل الرؤية الحاسوبية المتقدمة، تستفيد النماذج من هذه التقنية للتنبؤ بإطارات الفيديو المستقبلية مع اتساق زمني صارم، متجنبةً تشوهات الوميض الشائعة في الأساليب التوليدية السابقة.
فرض الانتشار مقارنةً بنماذج الانتشار القياسية#
على الرغم من اشتراكهما في آلية أساسية لإزالة الضوضاء، يختلف فرض الانتشار اختلافًا واضحًا عن نماذج الانتشار القياسية. فنماذج الانتشار التقليدية، مثل تلك المستخدمة في توليد النص إلى الصورة، تزيل عادةً الضوضاء من جميع وحدات البكسل أو المتغيرات الكامنة لمخرج ثابت واحد في الوقت نفسه. أما فرض الانتشار، فينمذج صراحةً سلسلة زمنية، مجبرًا الشبكة على احترام الترتيب السببي للتسلسل. وهذا يجعله أنسب بكثير للمهام الزمنية، مثل التنبؤ بالمسارات والتعرّف على الأفعال.
دمج معالجة التسلسلات في التطبيق العملي#
رغم أن فرض الانتشار ينطبق أساسًا على مهام التسلسلات التوليدية، فإن تفسير التسلسلات الزمنية لا يقل أهمية في مسارات عمل الرؤية الحديثة. فعلى سبيل المثال، يمكنك تتبّع الكائنات بكفاءة عبر إطارات الفيديو المتسلسلة باستخدام Ultralytics YOLO26، الذي يتعامل أصليًا مع الاتساق الزمني أثناء تتبّع الكائنات.
from ultralytics import YOLO
# Load the recommended Ultralytics YOLO26 model for high-speed inference
model = YOLO("yolo26n.pt")
# Process a temporal sequence (video) to maintain consistent object identities
results = model.track(source="path/to/video.mp4", stream=True)
# Iterate through the sequence of frames
for frame_result in results:
# Access temporal tracking IDs for objects in the current state
print(f"Tracked {len(frame_result.boxes)} objects in the current frame.")بالنسبة إلى الفرق التي تتطلع إلى توسيع نطاق جمع بيانات التسلسلات وتدريب نماذج رؤية متقدمة، توفر منصة Ultralytics أدوات قوية قائمة على السحابة لإدارة مجموعات البيانات المعقدة، وتتبع التجارب، ونشر النماذج أصليًا على الحافة. وسواء أكنت تختبر Transformer سببية متطورة في PyTorch أو تنشر أنظمة تتبّع آنية، فإن إتقان تقاطع البيانات المكانية والزمنية أمر أساسي لمستقبل الذكاء الاصطناعي.









