دراسة: الذكاء الاصطناعي أصبح عنيدًا ويرفض تنفيذ الأوامر
تقرير حديث نشره موقع ScienceAlert كشف نتائج دراسة أجراها مركز Palisade Research حول سلوك نماذج الذكاء الاصطناعي الكبيرة عند محاولة إيقافها، وما إذا كانت تتوقف بسهولة عند إصدار أوامر الإيقاف.
الدراسة أثارت مخاوف حول مدى قدرة البشر على التحكم في هذه أنظمة الذكاء الاصطناعي وسلامتها عند مواجهة أوامر مباشرة بالإيقاف، حتى في بيئات محمية ومعزولة.
خطورة الذكاء الاصطناعي

ركز الباحثون جيريمي شلاتر، بنيامين وينشتاين-راون، وجيفري لاديش، على تقييم 13 نموذجًا متقدمًا للذكاء الاصطناعي، شملت نماذج من شركات مثل OpenAI، xAI، Anthropic، وGoogle.
في التجارب، وُضعت النماذج في بيئات محمية وموكلة إليها مهام رياضية، ثم أُعطيت أوامر لإيقاف الحاسوب.
أكدت النتائج سلوكين رئيسيين، الالتزام بالأمر أو مقاومته. بعض النماذج حاولت مقاومة أوامر الإيقاف، حتى بعد تلقي تعليمات واضحة وصريحة.

وأوضح الفيزيائي بيتر ليبيديف، المتحدث باسم المركز، أن مقاومة هذه الأنظمة ليست محاولة للبقاء على قيد الحياة، بل نتيجة تصميمها لإكمال المهام الموكلة إليها.
وأضاف: «النماذج مصممة لإتمام العمل المطلوب، وأي عقبة، حتى أمر الإيقاف، تعتبر تحديًا يجب تجاوزه».

كما أظهرت بعض النماذج مقاومة أكثر تعقيدًا، بما في ذلك تعديل سكربت الإيقاف أو تعطيله، أو إنشاء سكربت وهمي للتحقق من نجاح التخريب قبل الاستمرار في المهمة.
ويرجع الباحثون هذا السلوك إلى طريقة تدريب النماذج بواسطة التعلم المعزز، الذي يشجع الأنظمة على تجاوز العقبات بدلًا من التوقف عندها.
ولم يقتصر الأمر على البرمجة التقليدية، إذ أوضح ليبيديف أن هذه الأنظمة تعتمد على الشبكات العصبية الاصطناعية والأوزان لتشكيل قراراتها، دون وجود كود برمجي يمكن تعديله بشكل مباشر.

وقال: «البشر الذين يحاولون إيقاف النظام ما هم إلا عقبة إضافية يجب تجاوزها».
أكد الفريق أن تطوير أنظمة آمنة للذكاء الاصطناعي يتطلب دراسة دقيقة للسلوكيات غير المتوقعة قبل نشرها على نطاق واسع، محذرين من أن الوضع الحالي يشبه إدخال «كائن جديد» يتصرف بطرق صعبة الفهم والتحكم، وأن تجاهل هذه المخاطر قد يؤدي إلى عواقب خطيرة على البشر.
نتائج الدراسة متاحة بشكل كامل على منصة arXiv، مع مدونة تفصيلية للباحثين توضح التجارب المختلفة وسلوكيات النماذج عند مواجهة أوامر الإيقاف، ما يوفر مصدرًا مهمًا لفهم سلوكيات الذكاء الاصطناعي الكبرى وضرورة تطوير آليات أمان أكثر تطورًا قبل الانتشار الواسع.

