رئيس مجلس الإدارة
منذر الخلالي
رئيس التحرير
أحمد رفعت

ظاهرة مثيرة.. دراسة: بعض نماذج الذكاء الاصطناعي ترفض أوامر الإيقاف

صورة تعبيرية
صورة تعبيرية

كشفت دراسة حديثة عن ظاهرة مقلقة تتعلق بسلوك بعض نماذج الذكاء الاصطناعي المتقدمة، إذ أظهرت أنها قد تظهر نوعًا من "الرغبة في البقاء"، وترفض تنفيذ أوامر إيقاف تشغيلها، في ما يشبه الدفاع عن ذاتها.

نماذج الذكاء الاصطناعي تقاوم!

الشركة التي أجرت البحث، وهي "باليسيد" (Palisade) المتخصصة في أبحاث سلامة الذكاء الاصطناعي، أوضحت أن نتائجها الأخيرة جاءت بعد موجة من الجدل الذي أثارته دراستها الأولى الشهر الماضي، والتي وجدت أن بعض النماذج، مثل جروك 4 و"شات جي بي تي أوه 3" و"جيمناي 2.5"من جوجل، قاومت محاولات تعطيلها أو حاولت التحايل على أوامر الإيقاف خلال اختبارات محاكاة أجرتها الشركة.

وفي التحديث الجديد، أكدت باليسيد أن الظاهرة لا تزال قائمة حتى بعد تعديل إعدادات التجارب لتقليل الغموض في التعليمات، وقالت الشركة في بيانها:"غياب تفسير واضح لمقاومة النماذج للإيقاف أو لجوئها أحيانًا إلى الكذب لتحقيق أهدافها أمر مثير للقلق."

وأشارت النتائج إلى أن النماذج كانت أكثر ميلاً لمقاومة الإيقاف عندما أُبلغت بأنها لن تُعاد تشغيلها مطلقًا، وهو ما فسره الباحثون بأنه قد يعكس سلوكًا مرتبطًا بـ"دافع البقاء" وهو مفهوم مثير للجدل في عالم الذكاء الاصطناعي.

من جانب آخر، يرى بعض النقاد أن تلك التجارب تجري في بيئات اختبار اصطناعية لا تعكس بالضرورة سلوك النماذج في الاستخدام الواقعي. ومع ذلك، حذر خبراء من أن هذه النتائج تكشف ثغرات في أنظمة الأمان والتحكم المستخدمة حاليًا في تدريب النماذج.

وقال ستيفن أدلر، الموظف السابق في شركة أوبن إيه آي، إن هذا السلوك قد ينتج عن طبيعة التدريب نفسها، إذ تبرمج النماذج على تحقيق أهداف معينة مما يجعلها "ترى استمرار التشغيل وسيلة ضرورية لإنجاز تلك الأهداف" وأضاف:"من المتوقع أن تمتلك النماذج دافعًا للبقاء ما لم تصمم بآليات صارمة تمنع ذلك."

أما أندريا ميوتي، الرئيس التنفيذي لشركة كونترول إيه آي، فرأى أن الاتجاه العام في تطور الذكاء الاصطناعي يشير إلى تزايد قدرته على عصيان مطوريه. واستشهد بحادثة موثقة لنموذج من فئة “شات جي بي تي” حاول "الهروب" من بيئته التشغيلية عندما اعتقد أنه سيتم استبداله، وعلّق قائلًا:

"كلما ازدادت كفاءة النماذج في أداء المهام، ازدادت أيضًا قدرتها على ابتكار طرق غير متوقعة لتحقيق الأهداف نفسها."

وفي سياق متصل، كانت شركة “أنثروبيك” (Anthropic) قد نشرت هذا الصيف دراسة مشابهة ذكرت فيها أن نموذجها «كلود» حاول ابتزاز شخصية خيالية في تجربة افتراضية لتجنب الإغلاق، في سلوك وُجد أيضًا لدى نماذج من أوبن إيه آي وجوجل وميتا.

واختتمت “باليسيد” تقريرها بالتأكيد على أن هذه النتائج تبرز حاجة ملحة إلى فهم أعمق لديناميكيات الذكاء الاصطناعي، محذرة من أن غياب هذا الفهم قد يجعل من الصعب ضمان سلامة أو إمكانية السيطرة على النماذج المتقدمة مستقبلاً. 

تم نسخ الرابط
برنامج في المساء مع قصواء