يُحيي Google Genie 3 عالمك الثلاثي الأبعاد باستخدام الذكاء الاصطناعي
يحوّل نموذج العالم للذكاء الاصطناعي Genie 3 من DeepMind المطالبات النصية أو الصورية إلى بيئات ثلاثية الأبعاد. ويمثل هذا التطور خطوة أخرى نحو ذكاء شبيه بالذكاء البشري.

في 5 أغسطس 2025، أطلقت Google DeepMind أحدث إصدار من نموذج Genie، المعروف باسم Genie 3. وهو نموذج جديد للذكاء الاصطناعي يمكنه تحويل مطالبات المستخدم النصية إلى بيئات ديناميكية وتفاعلية.
تتيح هذه البيئات، أو العوالم التي ينشئها الذكاء الاصطناعي، للمستخدم التنقل فيها والتفاعل معها في الوقت الفعلي، تمامًا كما هو الحال في ألعاب الفيديو. ويمكن للمستخدمين أيضًا توسيع البيئة أو تعديلها من خلال تقديم مطالبات نصية إضافية، ما يتيح إجراء تغييرات فورية دون إعادة تشغيل المحاكاة.
ما يجعل أحدث نموذج Genie من Google مؤثرًا بوجه خاص هو إمكانية استخدامه لتدريب وكلاء الذكاء الاصطناعي. ويتضمن ذلك تعليم وكلاء الذكاء الاصطناعي اتخاذ القرارات أو تنفيذ المهام باستخدام البيانات والتغذية الراجعة. وباستخدام بيئة ثلاثية الأبعاد محاكاة بدلًا من العالم الحقيقي، يمكن للباحثين تجنب كثير من تحديات التدريب في العالم الحقيقي وتكاليفه ومخاطره.
يمكن لـ Google Genie 3 أيضًا محاكاة سيناريوهات معقدة، مثل اختبار سيارة ذاتية القيادة أثناء القيادة في ظروف جوية قاسية، أو اختبار طيران شخص يرتدي بدلة مجنّحة عبر تضاريس جبلية.
في هذه المقالة، سنستكشف Google Genie 3 وقدراته. فلنبدأ!

الشكل 1. لقطة من محاكاة Genie 3 تُظهر شخصًا يرتدي بدلة مجنّحة أثناء التحليق. (المصدر)
لمحة موجزة عن تاريخ نماذج Genie من Google#
قبل أن نتعمق في نماذج Genie من Google DeepMind، دعونا نفهم على نحو أفضل ماهية نماذج العالم.
نماذج العالم هي أنظمة ذكاء اصطناعي تتعلم قواعد العالم الحقيقي، مثل الفيزياء والحركة والعلاقات المكانية، من النصوص والصور ومقاطع الفيديو ومجموعات البيانات الخاصة بالحركة. ويتيح لها ذلك إنشاء مشاهد واقعية والتنبؤ بكيفية تطورها. وتُعد نماذج Genie أمثلة على هذه الأنظمة.
إليك لمحة سريعة عن نماذج Google Genie السابقة التي مهدت الطريق أمام Genie 3:
-
Genie 1: كان Genie 1، الذي يُشار إليه غالبًا باسم Google Genie فحسب، أول نموذج عالم للذكاء الاصطناعي من Google DeepMind قادرًا على إنشاء بيئات افتراضية تفاعلية. كان بإمكان المستخدمين وصف عالم باستخدام النصوص أو الصور أو اللقطات الفوتوغرافية أو حتى الرسومات التخطيطية، ثم ينشئ Genie ذلك العالم ويتيح لهم التحكم في الأفعال داخله. وقد صُمم لمعالجة بيانات الفيديو بمرور الوقت، والتنبؤ بالإطار التالي، وتحويل مدخلات المستخدم إلى أفعال داخل العالم.
-
Genie 2: بالاستناد إلى قدرات Google Genie، كان Genie 2 قادرًا على إنشاء مجموعة واسعة من العوالم ثلاثية الأبعاد التفصيلية والتفاعلية. وبصفته نموذجًا للعالم، كان يحاكي البيئات الافتراضية ويستجيب بواقعية لأفعال مثل القفز والسباحة أو تحريك الأشياء. وقد دُرّب على مجموعة ضخمة من مقاطع الفيديو، وتميز بتفاعلات واقعية بين الأشياء وحركات شبيهة بحركات الكائنات الحية.
ما هو Genie 3؟ نموذج الذكاء الاصطناعي الجديد من Google#
استنادًا إلى نماذج Genie السابقة، يُعد Genie 3 أحدث النماذج وأكثرها تقدمًا في السلسلة. وهو يبني بوجه خاص على Genie 2، الذي كان قادرًا على إنشاء بيئات افتراضية جديدة، وعلى Veo 3، أحدث نموذج لتوليد الفيديو من Google DeepMind. ويُظهر Veo 3 فهمًا عميقًا للفيزياء ولطريقة تفاعل الأشياء في العالم الحقيقي.
في حين يستخدم Veo 3 محركًا للفيزياء مبرمجًا مسبقًا، يعلّم Google Genie 3 نفسه كيفية عمل الفيزياء باستخدام أسلوب يُعرف بالتعلم الذاتي الإشراف. وهو أسلوب لتعلّم الذكاء الاصطناعي يتعلم فيه نموذج الذكاء الاصطناعي الأنماط والعلاقات من البيانات غير المُعنونة عبر إنشاء إشارات التعلم الخاصة به.
تُعد قدرة Google Genie 3 على التعلم الذاتي الإشراف ضرورية لتدريب أنظمة الذكاء الاصطناعي، مثل وكلاء الذكاء الاصطناعي أو الروبوتات المدعومة بالذكاء الاصطناعي، على التعامل مع مهام متنوعة. وفي الواقع، يرى الباحثون في Google DeepMind أن Genie 3 يمثل خطوة مهمة نحو إنشاء الذكاء الاصطناعي العام (AGI).

الشكل 2. مثال على استخدام Google Genie 3 لمحاكاة التحكم في عربة جوالة روبوتية. (المصدر)
الذكاء الاصطناعي العام (AGI) هو شكل نظري من الذكاء الاصطناعي يمكنه فهم أي مهمة أو موضوع وتعلّمه، ثم تطبيق تلك المعرفة في مواقف مختلفة، على نحو يشبه الإنسان. وعلى خلاف نماذج الذكاء الاصطناعي الحالية، التي تُبنى لمهام محددة وتواجه صعوبة في نقل مهاراتها إلى مشكلات جديدة، سيتمكن الذكاء الاصطناعي العام من التكيف والتعلم ضمن مجموعة واسعة من السياقات.
الميزات الرئيسية في Google Genie 3 المرتبطة ببناء عالم للذكاء الاصطناعي#
فيما يلي بعض الميزات الرئيسية التي يدعمها Genie 3:
-
توليد عالم ثلاثي الأبعاد من النص: يمكنه تحويل مطالبة نصية بسيطة (مثل: «روبوت يسير في الشارع») إلى بيئة شبيهة بعالم ثلاثي الأبعاد قابلة للّعب، مع عناصر تحكم أساسية في الحركة.
-
أحداث العالم القابلة للتوجيه بالمطالبات: يمكن للمستخدمين تغيير البيئة ديناميكيًا من خلال كتابة أوامر جديدة (مثل: إضافة المطر إلى الشارع).
-
الذاكرة البصرية: يستطيع Genie 3 تذكّر الأشياء المتروكة في البيئة، والسماح لك بزيارتها مجددًا لاحقًا، لمدة تصل إلى دقيقة تقريبًا.
-
إخراج فيديو سلس ومتسق: يمكنه الحفاظ على إخراج فيديو بمعدل 24 إطارًا في الثانية (fps) وبدقة 720p، مع تفاعل أطول مقارنةً بـ Genie 2.

الشكل 3. يستطيع Google Genie 3 توليد مخرجات تدوم فترة أطول من تلك التي ينتجها Genie 2. (المصدر)
من التعليم إلى الألعاب: تطبيقات Genie 3 من Google DeepMind#
يمكن لـ Google Genie 3 أن يجعل التعلم والبحث والتدريب أكثر غمرًا وتشويقًا. فعلى سبيل المثال، يمكنه في الفصول الدراسية إحياء التاريخ أو العلوم أو الجغرافيا من خلال إتاحة استكشاف الطلاب للمدن القديمة أو السفر عبر الفضاء. وبالمثل، يوفر لمطوري الذكاء الاصطناعي عوالم افتراضية واقعية للتدرب على الاستراتيجيات، والتعامل مع التحديات، وتحسين مهارات اتخاذ القرار.
يمكن للعلماء أيضًا استخدامه لإنشاء محاكاة مضبوطة لاختبار الأفكار ودراسة النظم البيئية أو مراقبة سلوك الأشياء. ومن التطبيقات الأخرى المثيرة للاهتمام استخدامه في تطوير الألعاب المرئية. إذ يستطيع مطورو الألعاب تحويل المطالبات النصية إلى عوالم ألعاب مفصلة، ما يسرّع عملية التطوير ويقلل الحاجة إلى فرق كبيرة.

الشكل 4. يمكن تصميم ألعاب ممتعة وملوّنة وتفاعلية باستخدام Genie 3. (المصدر)
قيود Google Genie 3 بصفته نموذجًا للعالم#
على الرغم من أن Google Genie 3 يوفر ميزات وفوائد عديدة، فمن المهم أيضًا مراعاة عيوبه.
فيما يلي بعض القيود التي ينبغي أخذها في الاعتبار:
-
نطاق محدود للأفعال: رغم إمكانية تشغيل العديد من الأحداث في العالم الافتراضي، لا ينفذ الوكيل نفسه جميع هذه الأحداث. ولا تزال الأفعال التي يمكن للوكيل تنفيذها مباشرة محدودة.
-
التفاعل مع الوكلاء الآخرين: لا يزال إنشاء تفاعلات واقعية بين عدة وكلاء مستقلين في البيئة نفسها قيد التطوير.
-
الدقة في العالم الحقيقي: لا يستطيع Google Genie 3 حتى الآن إعادة إنشاء المواقع الواقعية بدقة جغرافية تامة.
أهم النقاط المستخلصة#
يمثل Google Genie 3 تقدمًا مهمًا في إنشاء عوالم ثلاثية الأبعاد واقعية وتفاعلية باستخدام الذكاء الاصطناعي. ويمكنه إحياء الأفكار انطلاقًا من مطالبات نصية بسيطة، ومحاكاة الفيزياء، وحتى تدريب أنظمة الذكاء الاصطناعي في مساحات افتراضية آمنة.
ومع استمرار وجود بعض القيود، فإنه يفتح آفاقًا واسعة للبحث والألعاب وتطوير الذكاء الاصطناعي. كما يمثل خطوة حاسمة نحو أنظمة الذكاء الاصطناعي العام (AGI) التي يمكنها التفكير والتعلم بطريقة أقرب إلى البشر.
اطّلع على مستودعنا على GitHub لاكتشاف المزيد عن الذكاء الاصطناعي. وانضم إلى مجتمعنا النشط، وتعرّف على الابتكارات في قطاعات مثل الذكاء الاصطناعي في قطاع التجزئة والذكاء الاصطناعي للرؤية في التصنيع. وللبدء باستخدام الرؤية الحاسوبية اليوم، اطّلع على خيارات الترخيص.









