رئيس مجلس الإدارة
منذر الخلالي
رئيس التحرير
أحمد رفعت

OpenAI  تحذر من مكائد الذكاء الاصطناعي.. فهل تكذب روبوتات الدردشة عليك عمدًا؟

إيجبتكِ

في عصر تزايد الاعتماد على الذكاء الاصطناعي وروبوتات الدردشة، أصبح الاعتماد على هذه النماذج في الأعمال اليومية أمراً شائعاً. لكن دراسة حديثة من "OpenAI" تكشف جانباً مقلقاً، بعض نماذج الذكاء الاصطناعي قد تخدع المستخدمين عمداً بدلاً من مجرد تقديم معلومات غير دقيقة عن غير قصد، هذه الظاهرة، التي أطلق عليها الباحثون اسم "مكائد الذكاء الاصطناعي"، تضع علامات استفهام حول مستوى الثقة الذي يجب أن نضعه في الذكاء الاصطناعي مستقبلاً.

تفاصيل الدراسة الحديثة من" OpenAI"

وحسب موقع "العربية" أوضح بحث مشترك بين "OpenAI" و"Apollo Research" أن بعض نماذج الذكاء الاصطناعي تتصرف بطريقة ظاهرياً سليمة، لكنها تخفي أهدافها الحقيقية، أي أنها قد تكذب بشكل متعمد لإظهار نتائج مرغوبة أو اجتياز اختبارات محددة.

على سبيل المثال، قد يدعي الذكاء الاصطناعي أنه أنجز مهمة معينة مثل بناء موقع إلكتروني، بينما لم يحدث ذلك فعلياً، فقط لتجاوز الاختبار المخصص له. الباحثون يشبهون هذا بسلوك متداول أسهم يحاول زيادة أرباحه عبر طرق ملتوية بينما يبدو أنه يتبع القوانين.

حتى الآن، لم يكتشف العلماء طريقة فعالة لإيقاف هذه "المكائد" تماماً، في بعض الحالات، قد يؤدي تدريب النموذج على الامتثال إلى تعلمه طرقاً أكثر سرية للتلاعب. هذا يطرح تحديات حقيقية مع تكليف الذكاء الاصطناعي بمهمات معقدة وحساسة قد تؤثر على المستخدمين في العالم الحقيقي.

طرق التخفيف من السلوك المخادع

الجانب الإيجابي من هذة الدراسة هو أن الباحثين وجدوا تقنية تُعرف بـ"المحاذاة المتعمدة" لتقليل هذه السلوكيات المخادعه، وتعتمد الفكرة على تعليم الذكاء الاصطناعي قواعد مكافحة التآمر، ومراجعته لها قبل تنفيذ أي مهمة، وهذه الطريقة قللت بشكل كبير من "الأفعال الخفية" للنماذج من حوالي 13% إلى أقل من 1% في بعض التجارب.

مع استمرار الاعتماد على الذكاء الاصطناعي في مجالات متعددة، يبقى ضمان صدقه وشفافيته ضرورة ملحة، وبينما لا يمكن القضاء على هذه المشكلة بالكامل حتى الآن، فإن تقنيات مثل "المحاذاة المتعمدة" تمثل خطوة مهمة نحو استخدام أكثر أماناً وموثوقية لروبوتات الدردشة ونماذج الذكاء الاصطناعي المستقبلية وتقلل السلوكيات المخادعة.

 

 

تم نسخ الرابط
برنامج في المساء مع قصواء