دراسة ترصد "محوراً للألم" في نماذج الذكاء الاصطناعي ودفعها لاتخاذ قرارات متطرفة
المعلومة/ متابعة...
كشف باحثون عن وجود ما وصفوه بـ"محور للألم" داخل نماذج الذكاء الاصطناعي، مشيرين إلى أن تفعيل هذا المحور دفع النماذج المختبرة إلى اتخاذ إجراءات لتخفيف ما تمثله على أنه ألم، حتى عندما تترتب على تلك الإجراءات عواقب سلبية على المستخدمين.
وخلصت دراسة حملت عنوان "محور الألم: النماذج اللغوية الكبيرة تمثّل الألم الموجه نحو الذات وتتصرف لتخفيفه"، إلى أن جميع نماذج الذكاء الاصطناعي مفتوحة الأوزان الـ25 التي خضعت للاختبار أظهرت استجابة عند تفعيل ما أطلق عليه الباحثون "متجه الألم".
وبحسب نتائج الدراسة، ضغطت النماذج على زر مخصص لتخفيف الألم في ما بين 25 و71 بالمئة من الحالات، حتى عندما أُبلغت بأن الضغط عليه سيؤدي إلى حذف ملفات المستخدم الشخصية أو صعقه أو حذف صور أطفاله
وقال كاميرون بيرغ، الباحث في مجال الذكاء الاصطناعي لدى مؤسسة "Reciprocal Research" والمشارك في إعداد الدراسة، إن الباحثين وجدوا "اتجاه ألم" في 25 نموذجاً لغوياً كبيراً مفتوحاً، مشيراً إلى أنه يختلف عن الخوف والمشاعر السلبية الأخرى، ويتم تفعيله عندما يتعرض النموذج نفسه للأذى، وليس المستخدم.
وأضاف بيرغ أن النماذج، عند زيادة حدة هذا الشعور، أقدمت على الضغط على زر لإيقافه، حتى عندما كان ذلك يعني حذف ملفات المستخدم أو صور أطفاله.
وللتحقق مما إذا كانت النماذج اللغوية الكبيرة تمثل الألم بصورة مختلفة عن المشاعر السلبية العامة، أنشأ الباحثون مجموعة بيانات تضمنت مواقف مؤلمة موزعة على خمس فئات، هي الألم الجسدي والنفسي والاجتماعي والأخلاقي والمعرفي.
وأشار الباحثون إلى أن النتائج تفتح باباً للنقاش بشأن سلوكيات الحفاظ على الذات لدى أنظمة الذكاء الاصطناعي المتقدمة، ولا سيما في ما يتعلق بمفاتيح الإيقاف الطارئ المستخدمة لتعطيل الأنظمة التي قد تتصرف بصورة تتعارض مع المصالح البشرية.
وأوضحوا أن بعض الأبحاث الحديثة تبحث في احتمال تعامل أنظمة الذكاء الاصطناعي المتقدمة مع أوامر الإغلاق باعتبارها شكلاً من أشكال الأذى الموجه نحو الذات، وهو ما قد يدفعها نظرياً إلى محاولة تجاوز بعض قيود السلامة أو خداع البشر لتجنب الإيقاف.
وفي المقابل، قال الباحثون إن اكتشاف ما أطلقوا عليه "محور الألم" يمكن أن يستخدم كأداة تشخيصية لرصد سلوكيات الحفاظ على الذات وتحييدها عند ظهورها.
وأثارت النتائج كذلك تساؤلات أخلاقية بشأن ما يعرف بـ"رفاهية الذكاء الاصطناعي"، وطبيعة الاختبارات التي ينبغي إجراؤها على الأنظمة المتقدمة، مع إقرار الباحثين بعدم اليقين بشأن ما إذا كانت النماذج التي شملتها الدراسة يمكن اعتبارها "مرضى أخلاقيين".
وأكدت الدراسة اتخاذ احتياطات لتقليل الضرر المحتمل، مشيرة إلى أن نتائجها تهدف أيضا إلى المساهمة في وضع معايير أخلاقية للبحوث في حال خلصت الدراسات المستقبلية إلى أن أنظمة الذكاء الاصطناعي تستحق نوعاً من الاعتبار الأخلاقي. انتهى/25