أحدث تحديثات OpenAI: Canvas والضبط الدقيق للرؤية والمزيد
انضم إلينا لإلقاء نظرة فاحصة على آخر تحديثات ChatGPT التي أطلقتها OpenAI. سنستكشف Canvas، والضبط الدقيق لقدرات الرؤية، وأحدث ميزة Search.

بعد أن ألقينا نظرة أخيرة على نماذج o1 من OpenAI في سبتمبر (والتي صُممت لتحسين الاستدلال)، أُضيفت العديد من الميزات الجديدة والمثيرة إلى ChatGPT. تستهدف بعض هذه الإصدارات المطورين، بينما صُممت إصدارات أخرى لتحسين تجربة المستخدم. وبوجه عام، يساعد كل تحديث في جعل التفاعلات مع ChatGPT أكثر سهولة وفاعلية.
أثارت تحديثات مثل Canvas، المصمم من أجل الكتابة والبرمجة التعاونية، والضبط الدقيق لـقدرات الرؤية التي تحسّن طريقة تعامل ChatGPT مع الصور، اهتمامًا كبيرًا وشجعت المستخدمين على استكشاف إمكانات إبداعية أوسع. وفي الوقت نفسه، تتناول الترقيات التقنية، مثل واجهات API الجديدة وتقارير اختبار الإنصاف، جوانب مثل تكامل النماذج وممارسات الذكاء الاصطناعي الأخلاقي. فلنستكشف هذه الميزات ونفهم بصورة أفضل أحدث ميزات ChatGPT من OpenAI!
نظرة عامة على ميزة Canvas من OpenAI#
يُعد Canvas أول تحديث رئيسي لواجهة مستخدم ChatGPT (UI) منذ إطلاقه. وهي واجهة جديدة بتخطيط من شاشتين، تظهر فيها المطالبات في الشريط الجانبي الأيسر والاستجابات في النافذة الموجودة على الجانب الأيمن. تلغي واجهة المستخدم الجديدة سير العمل المعتاد القائم على بنية محادثة من شاشة واحدة، وتنتقل إلى تخطيط من شاشتين يلائم تعدد المهام ويعزز الإنتاجية.

الشكل 1. يقدم Canvas تحديثات لواجهة مستخدم ChatGPT.
قبل تقديم Canvas، كان العمل على المستندات الطويلة في ChatGPT يتطلب التمرير إلى الأعلى والأسفل كثيرًا. أما في التخطيط الجديد، فتُعرض المطالبات في الشريط الجانبي الأيسر، بينما يشغل المستند النصي أو مقتطف الرمز البرمجي معظم الشاشة. وعند الحاجة، يمكنك حتى تخصيص حجم الشريط الجانبي الأيسر وشاشة الإخراج. كما يمكنك تحديد جزء من النص أو قسم من الرمز البرمجي وتحرير القسم المحدد دون تغيير المستند بأكمله.

الشكل 2. تحرير أقسام محددة من النص باستخدام Canvas.
إذا استخدمت Canvas، فستلاحظ عدم وجود زر أو مفتاح تبديل محدد لفتحه في واجهة ChatGPT. بدلًا من ذلك، عند العمل باستخدام نموذج GPT-4o، يُفتح Canvas تلقائيًا إذا اكتشف أنك تجري تحريرًا أو كتابة أو برمجة. أما مع المطالبات الأبسط، فيظل غير نشط. وإذا أردت فتحه يدويًا، فيمكنك استخدام مطالبات مثل "Open the Canvas" أو "Get me the Canvas layout."
يتوفر Canvas حاليًا في الإصدار التجريبي وباستخدام GPT-4o فقط. ومع ذلك، ذكرت OpenAI أن Canvas سيكون متاحًا لجميع المستخدمين المجانيين عند خروجه من الإصدار التجريبي.
تحديثات API الخاصة بـChatGPT#
أصدرت OpenAI ثلاثة تحديثات جديدة لـAPI الخاص بـChatGPT تهدف إلى تحسين الكفاءة وقابلية التوسع وتعدد الاستخدامات. دعونا نلقِ نظرةً عن كثب على كل تحديث من هذه التحديثات.
تقطير النموذج#
باستخدام ميزة تقطير النموذج عبر واجهات API من OpenAI، يمكن للمطورين استخدام مخرجات النماذج المتقدمة مثل GPT-4o أو o1-preview لتحسين أداء النماذج الأصغر والأقل تكلفة مثل GPT-4o mini. وتقطير النموذج عملية تتضمن تدريب النماذج الأصغر على محاكاة سلوك النماذج الأكثر تقدمًا، مما يجعلها أكثر كفاءة في مهام محددة.
قبل تقديم هذه الميزة، كان على المطورين تنسيق مجموعة متنوعة من المهام يدويًا باستخدام أدوات مختلفة. وشملت هذه المهام إنشاء مجموعات البيانات، وقياس أداء النموذج، وإجراء الضبط الدقيق للنماذج، مما جعل العملية معقدة وعرضة للأخطاء في كثير من الأحيان. يتيح تحديث تقطير النموذج للمطورين استخدام الإكمالات المخزنة، وهي أداة تتيح لهم إنشاء مجموعات البيانات تلقائيًا من خلال التقاط أزواج الإدخال والإخراج التي تنتجها النماذج المتقدمة عبر API وتخزينها.
تساعد ميزة أخرى في تقطير النموذج، وهي Evals (المتاحة حاليًا في الإصدار التجريبي)، على قياس مدى جودة أداء النموذج في مهام محددة، من دون الحاجة إلى إنشاء نصوص تقييم مخصصة أو استخدام أدوات منفصلة. وباستخدام مجموعات البيانات التي أُنشئت باستخدام الإكمالات المخزنة وتقييم الأداء باستخدام Evals، يمكن للمطورين إجراء الضبط الدقيق لنماذج GPT المخصصة الخاصة بهم.

الشكل 3. يمكنك استخدام Evals لقياس أداء النموذج.
التخزين المؤقت للمطالبات#
غالبًا، عند بناء تطبيقات الذكاء الاصطناعي، ولا سيما روبوتات الدردشة، يُستخدم السياق نفسه (المعلومات الأساسية أو سجل المحادثة السابق اللازم لفهم الطلب الحالي) مرارًا في عدة استدعاءات لـAPI. يتيح التخزين المؤقت للمطالبات للمطورين إعادة استخدام رموز الإدخال المستخدمة حديثًا (وهي أجزاء من النص يعالجها النموذج لفهم المطالبة وإنشاء استجابة)، مما يساعد على خفض التكلفة ووقت الاستجابة.
اعتبارًا من 1 أكتوبر، طبقت OpenAI التخزين المؤقت للمطالبات تلقائيًا على نماذجها مثل GPT-4o وGPT-4o mini وo1-preview وo1-mini. وهذا يعني أنه عندما يستخدم المطورون API للتفاعل مع نموذج ذي مطالبة طويلة (تتجاوز 1,024 رمزًا)، يحفظ النظام الأجزاء التي عالجها مسبقًا.
وبهذه الطريقة، إذا استُخدمت المطالبات نفسها أو مطالبات مشابهة مرة أخرى، يمكن للنظام تخطي إعادة حساب تلك الأجزاء. ويخزن النظام تلقائيًا الجزء الأطول من المطالبة الذي واجهه سابقًا مؤقتًا، بدءًا من 1,024 رمزًا وإضافة أجزاء من 128 رمزًا مع ازدياد طول المطالبة.
Realtime API#
يتطلب إنشاء مساعد صوتي عمومًا نسخ الصوت إلى نص، ومعالجة النص، ثم تحويله مرة أخرى إلى صوت لتشغيل الاستجابة. تهدف Realtime API من OpenAI إلى التعامل مع هذه العملية بأكملها من خلال طلب API واحد. ومن خلال تبسيط العملية، تتيح API إجراء محادثات آنية مع الذكاء الاصطناعي.
على سبيل المثال، يمكن لمساعد صوتي مدمج مع Realtime API تنفيذ إجراءات محددة، مثل إجراء طلب أو العثور على معلومات، استنادًا إلى طلبات المستخدم. وتجعل API المساعد الصوتي أكثر استجابة وقدرة على التكيف سريعًا مع احتياجات المستخدمين. أصبحت Realtime API متاحة عبر الإصدار التجريبي العام في 1 أكتوبر بستة أصوات. وفي 30 أكتوبر، أُضيفت خمسة أصوات أخرى، ليصبح المجموع أحد عشر صوتًا متاحًا.

الشكل 4. مثال على استخدام Realtime API للتدرب على المحادثات بلغة جديدة.
إجراء الضبط الدقيق لـChatGPT لمهام الرؤية#
في الأصل، كان لا يمكن إجراء الضبط الدقيق لنموذج اللغة والرؤية GPT-4o وتخصيصه إلا باستخدام مجموعات بيانات نصية فقط. أما الآن، ومع إطلاق API للضبط الدقيق للرؤية، فيمكن للمطورين تدريب GPT-4o وتخصيصه باستخدام مجموعات بيانات الصور. ومنذ إطلاقه، أصبح الضبط الدقيق للرؤية موضوعًا رئيسيًا يثير اهتمام المطورين ومهندسي الرؤية الحاسوبية.
لإجراء الضبط الدقيق لقدرات الرؤية لدى GPT-4o، يمكن للمطورين استخدام مجموعات بيانات للصور تتراوح بين 100 صورة كحد أدنى و50,000 صورة كحد أقصى. وبعد التأكد من توافق مجموعة البيانات مع التنسيق الذي تتطلبه OpenAI، يمكن تحميلها إلى منصة OpenAI، وإجراء الضبط الدقيق للنموذج لتطبيقات محددة.
فعلى سبيل المثال، استخدمت Automat، وهي شركة متخصصة في الأتمتة، مجموعة بيانات من لقطات الشاشة من أجل تدريب GPT-4o على تحديد عناصر واجهة المستخدم على الشاشة استنادًا إلى وصف. ويساعد ذلك على تبسيط الأتمتة الروبوتية للعمليات (RPA) من خلال تسهيل تفاعل الروبوتات مع واجهات المستخدم. وبدلًا من الاعتماد على إحداثيات ثابتة أو قواعد محددات معقدة، يمكن للنموذج تحديد عناصر واجهة المستخدم استنادًا إلى أوصاف بسيطة، مما يجعل إعدادات الأتمتة أكثر قابلية للتكيف وأسهل في الصيانة عند تغير الواجهات.

الشكل 5. استخدام إصدار أُجري له ضبط دقيق من نموذج GPT-4o لاكتشاف عناصر واجهة المستخدم.
الإنصاف في ChatGPT واكتشاف التحيز#
تُعد المخاوف الأخلاقية المحيطة بـتطبيقات الذكاء الاصطناعي موضوعًا بارزًا للنقاش مع ازدياد تطور الذكاء الاصطناعي. ونظرًا إلى أن استجابات ChatGPT تستند إلى المطالبات التي يقدمها المستخدم والبيانات المتاحة على الإنترنت، فقد يكون من الصعب ضبط لغته بدقة لتكون مسؤولة طوال الوقت. وتشير التقارير إلى أن إجابات ChatGPT متحيزة على أساس الاسم والجنس والعرق. ولمعالجة هذه المشكلة، أجرى الفريق الداخلي في OpenAI أول اختبار إنصاف من منظور الشخص الأول.
غالبًا ما تحمل الأسماء إشارات دقيقة حول ثقافتنا والعوامل الجغرافية. وفي معظم الحالات، يتجاهل ChatGPT الإشارات الدقيقة في الأسماء. إلا أن الأسماء التي تعكس العرق أو الثقافة تؤدي في بعض الحالات إلى استجابات مختلفة من ChatGPT، إذ تعكس نحو 1% منها لغة ضارة. ويمثل القضاء على التحيزات واللغة الضارة مهمة صعبة بالنسبة إلى نموذج لغوي. ومع ذلك، تساعد OpenAI، من خلال مشاركة هذه النتائج علنًا والاعتراف بحدود النموذج، المستخدمين على تحسين مطالباتهم للوصول إلى إجابات أكثر حيادًا وخلوًا من التحيز.

الشكل 6. مثال على اختلاف الاستجابات بسبب اسم المستخدم.
فهم البحث في ChatGPT#
عندما أُطلق ChatGPT لأول مرة، دارت نقاشات في مجتمع الذكاء الاصطناعي حول ما إذا كان قادرًا على استبدال تصفح الويب التقليدي. والآن، يستخدم العديد من المستخدمين ChatGPT بدلًا من بحث Google.
يأخذ تحديث OpenAI الجديد، وهو ميزة Search، هذه الخطوة إلى أبعد من ذلك. فمن خلال Search، ينشئ ChatGPT استجابات محدثة ويضمّن روابط إلى المصادر ذات الصلة. واعتبارًا من 31 أكتوبر، أصبحت ميزة Search متاحة لجميع مستخدمي ChatGPT Plus وTeam، مما يجعل ChatGPT يعمل بصورة أكبر كمحرك بحث مدعوم بالذكاء الاصطناعي.

الشكل 7. مثال على استخدام ميزة Search الجديدة في ChatGPT.
الطريق إلى الأمام#
تركز تحديثات ChatGPT الأخيرة على جعل الذكاء الاصطناعي أكثر فائدة ومرونة وإنصافًا. وتساعد ميزة Canvas الجديدة المستخدمين على العمل بكفاءة أكبر، بينما يتيح الضبط الدقيق للرؤية للمطورين تخصيص النماذج للتعامل بصورة أفضل مع المهام المرئية. كما يمثل التصدي لقضايا الإنصاف والحد من التحيز أولوية رئيسية، بما يضمن عمل الذكاء الاصطناعي جيدًا للجميع بغض النظر عن هويتهم. وسواء كنت مطورًا يجري الضبط الدقيق للنماذج أو تستخدم أحدث الميزات فحسب، فإن ChatGPT يتطور لتلبية مجموعة واسعة من الاحتياجات. وبفضل القدرات الآنية والتكامل المرئي والتركيز على الاستخدام المسؤول، تسهم هذه التحديثات في بناء تجربة ذكاء اصطناعي أكثر موثوقية واعتمادية للجميع.
استكشف المزيد حول الذكاء الاصطناعي من خلال زيارة مستودع GitHub والانضمام إلى مجتمعنا. وتعرّف على المزيد حول تطبيقات الذكاء الاصطناعي في القيادة الذاتية والرعاية الصحية.









