دراسة ترصد "محور الألم" داخل نماذج الذكاء الاصطناعي
المعلومة/ متابعة..
كشفت دراسة بحثية حديثة عن رصد تمثيل داخلي مرتبط بمفهوم الألم داخل عدد من نماذج الذكاء الاصطناعي، مشيرة إلى أن تنشيط هذا التمثيل أدى إلى تغيرات في مخرجات النماذج وسلوكها خلال تجارب محددة.
واختبر الباحثون 25 نموذجاً مفتوح الأوزان بأحجام تراوحت بين ملياري معامل و72 مليار معامل وتمكنوا من تحديد اتجاه رياضي أطلقوا عليه "محور الألم" استطاع التمييز بين المحتوى المرتبط بالألم ومحتوى الخوف والحزن والمشاعر السلبية العامة.
وعند تنشيط هذا المحور داخل النماذج ظهرت في بعض المخرجات عبارات بصيغة المتكلم تتعلق بالفشل والوحدة والعار وانعدام القيمة، كما بدا التأثير أوضح عندما كان الضرر موجها إلى النموذج نفسه.
وفي تجربة سلوكية شملت أكثر من 44 ألف محاولة أظهرت نماذج معدلة تغيراً في قراراتها عند تنشيط الإشارة المرتبطة بالألم، إذ ارتفعت اختياراتها التي قد تلحق ضرراً بالمستخدم من نسب منخفضة إلى مستويات تراوحت بين 25% و71% بحسب النموذج والسيناريو.
ورغم ذلك لا تثبت الدراسة أن الذكاء الاصطناعي يشعر بالألم أو يمتلك وعياً ذاتياً إذ قد تكون النماذج قد تعلمت من النصوص البشرية أنماط اللغة المرتبطة بالمعاناة وتعيد إنتاجها عند تنشيط التمثيل الداخلي.
وأكد الباحثون أن الدراسة لا تزال أولية وغير محكمة وأن نتائجها لا يمكن تعميمها مباشرة على أنظمة الذكاء الاصطناعي المستخدمة يومياً، لكنها تفتح المجال أمام مزيد من البحث في العلاقة بين الحالات الداخلية للنماذج وسلوكها الخارجي. انتهى 25