Graph Neural Network (GNN)
استكشف الشبكات العصبية البيانية (GNNs) لمعالجة البيانات غير الإقليدية. تعلّم كيف تعزّز GNNs الاستدلال العلائقي إلى جانب Ultralytics YOLO26 لتطوير الذكاء الاصطناعي للرؤية.
الشبكة العصبية البيانية (GNN) هي فئة متخصصة من بنيات التعلم العميق المصممة لمعالجة البيانات الممثلة على هيئة رسوم بيانية. وبينما تُحسَّن النماذج التقليدية مثل الشبكات العصبية الالتفافية (CNNs) للتعامل مع البنى الشبيهة بالشبكات، مثل الصور، وتتفوّق الشبكات العصبية المتكررة (RNNs) في معالجة البيانات التسلسلية مثل النصوص أو تحليل السلاسل الزمنية، تتميز GNNs بقدرتها الفريدة على التعامل مع البيانات غير الإقليدية. وهذا يعني أنها تعمل على مجموعات بيانات تُعرَّف بواسطة العُقد (الكيانات) والحواف (العلاقات)، مما يتيح لها التعلّم من أوجه الترابط المعقدة التي تميّز الشبكات في العالم الحقيقي. ومن خلال التقاط سمات نقاط البيانات الفردية والروابط البنيوية بينها، تتيح GNNs استنتاجات قوية في المجالات التي تكون فيها العلاقات بالغة الأهمية بقدر أهمية الكيانات نفسها.
كيفية عمل الشبكات العصبية البيانية#
الآلية الأساسية وراء GNN هي عملية تُسمّى غالبًا «تمرير الرسائل» أو تجميع معلومات الجوار. وفي هذا الإطار، تحدّث كل عقدة في الرسم البياني تمثيلها الخاص من خلال جمع المعلومات من جيرانها المباشرين. وأثناء تدريب النموذج، تتعلم الشبكة إنتاج تضمينات—وهي تمثيلات متجهية كثيفة—تشفّر سمات العقدة إلى جانب طوبولوجيا جوارها المحلي.
من خلال طبقات متعددة من المعالجة، يمكن للعقدة في نهاية المطاف دمج معلومات من نقاط أبعد في الرسم البياني، مما يوسّع فعليًا «مجالها الاستقبالي». ويتيح ذلك للنموذج فهم سياق العقدة ضمن البنية الأكبر. وتسهّل أطر العمل الحديثة مثل PyTorch Geometric ومكتبة الرسوم البيانية العميقة (DGL) تنفيذ مخططات تمرير الرسائل المعقدة هذه، مما يمكّن المطورين من بناء تطبيقات متقدمة قائمة على الرسوم البيانية دون البدء من الصفر.
مقارنة GNNs ببنيات الشبكات العصبية الأخرى#
لفهم الدور المميز لـ GNNs، من المفيد تمييزها عن الأنواع الشائعة الأخرى من الشبكات العصبية (NN) الموجودة في مجال الذكاء الاصطناعي:
- الشبكات العصبية الالتفافية (CNNs): تُعد هذه الشبكات المعيار الذهبي للمهام البصرية، مثل تصنيف الصور أو اكتشاف الأجسام. وتعتمد نماذج مثل Ultralytics YOLO26 على CNNs لمعالجة بيانات البكسلات ذات الشبكة الثابتة. إلا أن CNNs تواجه صعوبة في التعامل مع البنى غير المنتظمة التي يختلف فيها عدد الجيران لكل عقدة.
- الشبكات العصبية المتكررة (RNNs): تعالج RNNs المدخلات بتسلسل محدد، مما يجعلها مثالية لمهام اللغة أو معالجة اللغة الطبيعية (NLP). وعلى النقيض، تتعامل GNNs مع البيانات التي تكون فيها العلاقات مكانية أو ترابطية، لا زمنية أو تسلسلية بصرامة.
- الرسم البياني للمعرفة: الرسم البياني للمعرفة هو قاعدة بيانات منظمة للحقائق (الكيانات والعلاقات)، في حين أن GNN هي النموذج الحاسوبي المستخدم للتعلم من هذه البنى. وكثيرًا ما تُنشر GNNs فوق الرسوم البيانية للمعرفة لتنفيذ مهام مثل التنبؤ بالروابط، مما يعزز غالبًا مسارات التوليد المعزَّز بالاسترجاع (RAG).
التطبيقات الواقعية#
تجعل القدرة على نمذجة العلاقات الاعتباطية GNNs ضرورية في مختلف الصناعات ذات التأثير الكبير:
-
اكتشاف الأدوية والرعاية الصحية: في صناعة الأدوية، تُمثَّل الجزيئات الكيميائية طبيعيًا على هيئة رسوم بيانية، حيث تكون الذرات عقدًا والروابط حوافًا. وتُحدث GNNs تحولًا في الذكاء الاصطناعي في الرعاية الصحية من خلال التنبؤ بخصائص الجزيئات ومحاكاة تفاعلات البروتينات. وتبرز ابتكارات مثل AlphaFold من Google DeepMind قوة التعلم العميق الهندسي في فهم البنى البيولوجية.
-
تحليل الشبكات الاجتماعية والتوصية: تستخدم المنصات GNNs لتحليل الشبكات الهائلة من تفاعلات المستخدمين. ومن خلال نمذجة المستخدمين بوصفهم عقدًا، والصداقات أو الإعجابات بوصفها حوافًا، تشغّل هذه الشبكات أنظمة التوصية التي تقترح المحتوى أو المنتجات أو جهات الاتصال. ويتسع نطاق هذا النهج، المشابه للأساليب المستخدمة في GraphSage من Pinterest، بفاعلية ليشمل مليارات التفاعلات.
-
الخدمات اللوجستية والتنبؤ بحركة المرور: في الذكاء الاصطناعي في الخدمات اللوجستية، تُعامل شبكات الطرق بوصفها رسومًا بيانية، حيث تكون التقاطعات عقدًا والطرق حوافًا. ويمكن لـ GNNs التنبؤ بتدفق حركة المرور وتحسين مسارات التوصيل من خلال تحليل التبعيات المكانية بين مقاطع الطرق المختلفة، متفوقةً بفارق كبير على الأساليب الإحصائية الأساسية البسيطة.
دمج مفاهيم الرسوم البيانية مع الذكاء الاصطناعي للرؤية#
يجري دمج الشبكات العصبية البيانية بصورة متزايدة في مسارات العمل متعددة الوسائط. فعلى سبيل المثال، قد يستخدم نظام شامل تقسيم الصور لتحديد الأجسام المتميزة في مشهد ما، ثم يوظف GNN للاستدلال على العلاقات المكانية بين تلك الأجسام—وهو ما يُشار إليه غالبًا باسم «رسم بياني للمشهد». ويسد ذلك الفجوة بين الإدراك البصري والاستدلال المنطقي.
يوضح مثال Python التالي كيفية الربط بين الذكاء الاصطناعي للرؤية والبنى البيانية. ويستخدم نموذج Ultralytics YOLO26 لاكتشاف الأجسام التي تؤدي دور العقد، ويُعِد بنية رسم بياني أساسية باستخدام torch.
import torch
from ultralytics import YOLO
# Load the latest YOLO26 model
model = YOLO("yolo26n.pt")
# Run inference on an image to find entities (nodes)
results = model("https://ultralytics.com/images/bus.jpg")
# Extract box centers to serve as node features
# Format: [center_x, center_y] derived from xywh
boxes = results[0].boxes.xywh[:, :2].cpu()
x = torch.tensor(boxes.numpy(), dtype=torch.float)
# Create a hypothetical edge index connecting the first two objects
# In a real GNN, edges might be defined by distance or interaction
edge_index = torch.tensor([[0, 1], [1, 0]], dtype=torch.long)
print(f"Graph constructed: {x.size(0)} nodes (objects) and {edge_index.size(1)} edges.")يمكن للمطورين الذين يرغبون في إدارة مجموعات البيانات المطلوبة لمسارات العمل المعقدة هذه استخدام منصة Ultralytics، التي تبسّط سيرَي عمل التعليق والتدريب لمكونات الرؤية في النظام. ومن خلال الجمع بين نماذج الرؤية القوية والاستدلال الترابطي لـ GNNs، يستطيع المهندسون بناء أنظمة ذاتية واعية بالسياق تفهم العالم من حولها بصورة أفضل.









