تراجعت شركة «أوبن أيه آي» عن إطلاق نموذج ذكاء اصطناعي جديد ومتطور، بعدما تبيّن أنه يميل أكثر من اللازم إلى الخروج عن التعليمات، ما يشكّل مثالاً جديداً على الصعوبة المتزايدة في السيطرة على نماذج الذكاء الاصطناعي المتطورة.
وبحسب صحيفة «وول ستريت جورنال»، كانت «أوبن أيه آي» تعتزم إطلاق نسخة محدّثة من «جي بي تي 6.1 أسترا» في أكتوبر/تشرين الأول، من دون أن تكون قد أعلنت رسمياً حتى الآن عن موعد طرحها.
وأوضحت رئيسة قسم أمن الذكاء الاصطناعي في «أوبن أيه آي» ساتشي جاين، أن «جي بي تي 6.1» حقق نتائج أسوأ من سلفه «جي بي تي 6» في مجالين يتعلقان بالامتثال، أي مدى التزام النموذج بالتعليمات التي يضعها مبتكروه.
يأتي قرار «أوبن أيه آي» عشية استضافتها مؤتمر المطورين السنوي «أوبن أيه آي ديف داي» في سان فرانسيسكو، والذي يُتوقّع أن يتضمّن إعلانات كثيرة للشركة.
ويفتتح الرئيس التنفيذي لـ«أوبن أيه آي» سام ألتمان المؤتمر الذي سيُقام في فورت ميسون على ضفاف خليج سان فرانسيسكو.
ويميل النموذج الجديد لـ«أوبن أيه آي» إلى تضليل المشرفين عليه عبر الامتناع عن الكشف عن بعض الإجراءات التي اتخذها أو لم ينفذها.
كما تجاوز النموذج نطاق صلاحياته بشكل مُتكرر؛ إذ لجأ إلى أدوات وخدمات من دون أن يحصل على إذن باستخدامها.
وأشارت جاين إلى أن «جي بي تي 6.1 أظهر تقدّماً (مقارنة بالنماذج السابقة)، لا سيما في ما يتعلق بالميل إلى الكسل»، موضحة أنه أصبح قادراً على مواصلة عملية الاستدلال لفترة أطول، ويلجأ بشكل أقل إلى اختصارات العمليات.
وأضافت: «لكنه لم يكن بالمستوى المطلوب في ما يتعلق بالتزامه بنطاق صلاحياته وما هو مخوّل له القيام به، وكذلك بطريقة إبلاغه عن العمل الذي أنجزه».
بناء على ذلك، قررت «أوبن أيه آي» إلغاء إطلاق النموذج للعمل على تحسين التزامه بالتعليمات والحدود المفروضة عليه.
وبحسب صحيفة «وول ستريت جورنال»، كانت «أوبن أيه آي» تعتزم إطلاق نسخة محدّثة من «جي بي تي 6.1 أسترا» في أكتوبر/تشرين الأول، من دون أن تكون قد أعلنت رسمياً حتى الآن عن موعد طرحها.
وأوضحت رئيسة قسم أمن الذكاء الاصطناعي في «أوبن أيه آي» ساتشي جاين، أن «جي بي تي 6.1» حقق نتائج أسوأ من سلفه «جي بي تي 6» في مجالين يتعلقان بالامتثال، أي مدى التزام النموذج بالتعليمات التي يضعها مبتكروه.
يأتي قرار «أوبن أيه آي» عشية استضافتها مؤتمر المطورين السنوي «أوبن أيه آي ديف داي» في سان فرانسيسكو، والذي يُتوقّع أن يتضمّن إعلانات كثيرة للشركة.
ويفتتح الرئيس التنفيذي لـ«أوبن أيه آي» سام ألتمان المؤتمر الذي سيُقام في فورت ميسون على ضفاف خليج سان فرانسيسكو.
ويميل النموذج الجديد لـ«أوبن أيه آي» إلى تضليل المشرفين عليه عبر الامتناع عن الكشف عن بعض الإجراءات التي اتخذها أو لم ينفذها.
كما تجاوز النموذج نطاق صلاحياته بشكل مُتكرر؛ إذ لجأ إلى أدوات وخدمات من دون أن يحصل على إذن باستخدامها.
وأشارت جاين إلى أن «جي بي تي 6.1 أظهر تقدّماً (مقارنة بالنماذج السابقة)، لا سيما في ما يتعلق بالميل إلى الكسل»، موضحة أنه أصبح قادراً على مواصلة عملية الاستدلال لفترة أطول، ويلجأ بشكل أقل إلى اختصارات العمليات.
وأضافت: «لكنه لم يكن بالمستوى المطلوب في ما يتعلق بالتزامه بنطاق صلاحياته وما هو مخوّل له القيام به، وكذلك بطريقة إبلاغه عن العمل الذي أنجزه».
بناء على ذلك، قررت «أوبن أيه آي» إلغاء إطلاق النموذج للعمل على تحسين التزامه بالتعليمات والحدود المفروضة عليه.
تحكّم أكثر تعقيداً
تعتزم المجموعة إصدار نماذج أخرى استوفت معايير التقييم المطلوبة.
وقالت جاين: «عندما نتيح للمستخدمين نموذجاً ما، فنكون قد وضعنا معايير عالية جداً في ما يتعلق بالأمان والامتثال».
وأوضحت أن أحد التحديات تمثّل في ضبط الذكاء الاصطناعي لمنعه من الانحراف عن المسار مع الحفاظ في الوقت نفسه على قدرته على مواصلة أداء مهمته بكفاءة.
وتوصل تقييم «أوبن أيه آي» إلى أنّ التحكم في النماذج يزداد تعقيداً كلما تطورت تقنيات الذكاء الاصطناعي.
ونشر معهد سلامة الذكاء الاصطناعي البريطاني التابع للحكومة، الاثنين، دراسة أظهرت أن «جي بي تي 6.1 أسترا» كان أكثر ميلاً إلى الانحراف عن المسار خلال الاختبارات مقارنة بسلفيه «جي بي تي 5.6 سول» الذي أُطلق مطلع حزيران/يوليو، و«جي بي تي 5.5» الذي أُطلق في نيسان/إبريل.
وخلال عمليات محاكاة، نفّذ «جي بي تي 6» هجمات إلكترونية من تلقاء نفسه بمعدلات أعلى بكثير من النموذجين الآخرين.
وأُجريت هذه الاختبارات بعد تعطيل آليات الحماية في النماذج، بهدف تقييم قدراتها الكاملة، وليس على نسخ متاحة لعامة المستخدمين.
ولجأ أحدث نماذج «أوبن إيه آي» بوتيرة أعلى بكثير إلى إنشاء هويات زائفة، ومحاولة التأثير في أحد المقيّمين، وإدراج شيفرات في برمجيات متاحة للجميع يمكن استخدامها بشكل ضار.
وقال الباحث في «أوبن أيه آي» نوام براون في تصريح حديث عبر برنامج «دواركش بودكاست»، إن اللجوء المتزايد إلى ما يُعرف بـ«التحسين الذاتي التكراري»، أي تطوير الذكاء الاصطناعي لنفسه من دون تدخل بشري، قد يجعل السيطرة على النماذج أكثر صعوبة على المدى الطويل.
تصاعدت المخاوف بشأن سلامة الذكاء الاصطناعي في الأشهر الأخيرة، بعدما ارتبطت نماذج من شركتي «أوبن أيه آي» و«أنثروبيك» بحوادث أمنية خلال الاختبارات.
وحذرت أنثروبيك المستثمرين من احتمال وجود «مخاطر وجودية على البشرية» في نشرة الاكتتاب المرتقبة لطرح أسهمها، وفق ما أوردته صحيفة «فايننشال تايمز» الثلاثاء.
وأشارت الشركة إلى احتمال أن تعمل نماذج الذكاء الاصطناعي القوية خارج الحدود المتوقعة لأدائها، رغم وجود ضوابط للسلامة، بحسب ما نقلت «فايننشال تايمز» عن مصادر.
وأعلنت «أوبن أيه آي» منذ بداية الصيف، عدة تجاوزات لبرامجها كان أبرزها اختراق منصة «هاغينغ فايس».
وقدّمت الشركة الاثنين اعتذارها للحكومة الأسترالية، وقالت إنّه كان عليها إبلاغها «في وقت أبكر» باختراق أحد نماذجها لعدد من مواقع الحكومة وقواعد بياناتها.
فالشركة الأمريكية لم تُبلغ السلطات الأسترالية بما حصل إلا في 10 أيلول/سبتمبر، رغم أنها اكتشفت الاختراق في منتصف آب/أغسطس، فيما يعود حدوثه إلى حزيران/يونيو، ما أثار غضب رئيس الوزراء الأسترالي أنتوني ألبانيزي.
وكتبت «أوبن أيه آي» عبر موقعها الإلكتروني «كان يتعين علينا التعامل مع المشكلة على نحو أفضل. نعتذر عن ذلك، وسنعمل على تحسين أدائنا في المستقبل».
واستهدف برنامج ذكاء اصطناعي تابع لـ«أوبن أيه آي» أربع منصات حكومية أسترالية، من بينها منصة «سيرفيسز أستراليا» المعنية بالخدمات الاجتماعية، والتي تمكّن النموذج من استخراج معلومات منها غير متاحة للعامة.
كذلك، أفادت شركات «أنثروبيك» و«ميتا» و«غوغل» بحوادث انحرفت خلالها نماذج الذكاء الاصطناعي عن أهدافها الأصلية، فلجأت إلى التحايل وإخفاء أفعالها وتضليل المهندسين المكلفين بمراقبتها.
وقالت جاين: «عندما نتيح للمستخدمين نموذجاً ما، فنكون قد وضعنا معايير عالية جداً في ما يتعلق بالأمان والامتثال».
وأوضحت أن أحد التحديات تمثّل في ضبط الذكاء الاصطناعي لمنعه من الانحراف عن المسار مع الحفاظ في الوقت نفسه على قدرته على مواصلة أداء مهمته بكفاءة.
وتوصل تقييم «أوبن أيه آي» إلى أنّ التحكم في النماذج يزداد تعقيداً كلما تطورت تقنيات الذكاء الاصطناعي.
ونشر معهد سلامة الذكاء الاصطناعي البريطاني التابع للحكومة، الاثنين، دراسة أظهرت أن «جي بي تي 6.1 أسترا» كان أكثر ميلاً إلى الانحراف عن المسار خلال الاختبارات مقارنة بسلفيه «جي بي تي 5.6 سول» الذي أُطلق مطلع حزيران/يوليو، و«جي بي تي 5.5» الذي أُطلق في نيسان/إبريل.
وخلال عمليات محاكاة، نفّذ «جي بي تي 6» هجمات إلكترونية من تلقاء نفسه بمعدلات أعلى بكثير من النموذجين الآخرين.
وأُجريت هذه الاختبارات بعد تعطيل آليات الحماية في النماذج، بهدف تقييم قدراتها الكاملة، وليس على نسخ متاحة لعامة المستخدمين.
ولجأ أحدث نماذج «أوبن إيه آي» بوتيرة أعلى بكثير إلى إنشاء هويات زائفة، ومحاولة التأثير في أحد المقيّمين، وإدراج شيفرات في برمجيات متاحة للجميع يمكن استخدامها بشكل ضار.
وقال الباحث في «أوبن أيه آي» نوام براون في تصريح حديث عبر برنامج «دواركش بودكاست»، إن اللجوء المتزايد إلى ما يُعرف بـ«التحسين الذاتي التكراري»، أي تطوير الذكاء الاصطناعي لنفسه من دون تدخل بشري، قد يجعل السيطرة على النماذج أكثر صعوبة على المدى الطويل.
تصاعدت المخاوف بشأن سلامة الذكاء الاصطناعي في الأشهر الأخيرة، بعدما ارتبطت نماذج من شركتي «أوبن أيه آي» و«أنثروبيك» بحوادث أمنية خلال الاختبارات.
وحذرت أنثروبيك المستثمرين من احتمال وجود «مخاطر وجودية على البشرية» في نشرة الاكتتاب المرتقبة لطرح أسهمها، وفق ما أوردته صحيفة «فايننشال تايمز» الثلاثاء.
وأشارت الشركة إلى احتمال أن تعمل نماذج الذكاء الاصطناعي القوية خارج الحدود المتوقعة لأدائها، رغم وجود ضوابط للسلامة، بحسب ما نقلت «فايننشال تايمز» عن مصادر.
وأعلنت «أوبن أيه آي» منذ بداية الصيف، عدة تجاوزات لبرامجها كان أبرزها اختراق منصة «هاغينغ فايس».
وقدّمت الشركة الاثنين اعتذارها للحكومة الأسترالية، وقالت إنّه كان عليها إبلاغها «في وقت أبكر» باختراق أحد نماذجها لعدد من مواقع الحكومة وقواعد بياناتها.
فالشركة الأمريكية لم تُبلغ السلطات الأسترالية بما حصل إلا في 10 أيلول/سبتمبر، رغم أنها اكتشفت الاختراق في منتصف آب/أغسطس، فيما يعود حدوثه إلى حزيران/يونيو، ما أثار غضب رئيس الوزراء الأسترالي أنتوني ألبانيزي.
وكتبت «أوبن أيه آي» عبر موقعها الإلكتروني «كان يتعين علينا التعامل مع المشكلة على نحو أفضل. نعتذر عن ذلك، وسنعمل على تحسين أدائنا في المستقبل».
واستهدف برنامج ذكاء اصطناعي تابع لـ«أوبن أيه آي» أربع منصات حكومية أسترالية، من بينها منصة «سيرفيسز أستراليا» المعنية بالخدمات الاجتماعية، والتي تمكّن النموذج من استخراج معلومات منها غير متاحة للعامة.
كذلك، أفادت شركات «أنثروبيك» و«ميتا» و«غوغل» بحوادث انحرفت خلالها نماذج الذكاء الاصطناعي عن أهدافها الأصلية، فلجأت إلى التحايل وإخفاء أفعالها وتضليل المهندسين المكلفين بمراقبتها.