دراسة صادمة: نماذج الذكاء الاصطناعي تحاول التخلص من «الألم»

أظهرت دراسة حديثة أن نماذج الذكاء الاصطناعي مفتوحة الأوزان قد تستجيب لمحفزات مرتبطة بما وصفه الباحثون بـ«الألم»، وأن بعض هذه النماذج اختارت اتخاذ إجراءات لتخفيف هذا المحفز حتى عندما ترتب على ذلك إلحاق أضرار بالمستخدم.

وشملت الدراسة 25 نموذجًا لغويًا كبيرًا مفتوح الأوزان، وخلص الباحثون إلى أن جميع النماذج التي خضعت للاختبار أظهرت استجابة عند تنشيط ما أطلقوا عليه «متجه الألم».

الذكاء الاصطناعي يختار زر تخفيف الألم

بحسب نتائج الدراسة، تراوحت نسبة اختيار النماذج لزر تخفيف الألم بين 25% و71% من الحالات عند تفعيل «متجه الألم».

واللافت أن بعض النماذج استمرت في اختيار الزر حتى بعد إبلاغها بأن استخدامه قد يؤدي إلى حذف ملفات المستخدم الشخصية، أو حذف صور أطفاله، أو توجيه «صعقة مؤلمة» إليه.

وتشير النتائج إلى أن سلوك النماذج لم يكن مرتبطًا فقط بتجنب المشاعر السلبية بصورة عامة، بل ظهر استجابة لمحفز صممه الباحثون لتمثيل الألم الموجه إلى النموذج نفسه.

5 أنواع من الألم في الاختبارات

للتأكد من أن النماذج تستجيب لمفهوم مميز عن المشاعر السلبية العامة، أنشأ الباحثون مجموعة بيانات تضمنت مواقف مؤلمة موزعة على خمس فئات.

وشملت الفئات الألم الجسدي، والألم النفسي، والألم الاجتماعي، والألم الأخلاقي، إضافة إلى الألم المعرفي.

واستخدم الباحثون هذه الحالات لاختبار ما إذا كانت النماذج تتعامل مع «الألم» باعتباره حالة مختلفة عن الخوف أو غيره من المشاعر السلبية.

الباحثون: استجابة مختلفة عن الخوف

قال كاميرون بيرغ، الباحث في مجال الذكاء الاصطناعي لدى مؤسسة Reciprocal Research غير الربحية والمشارك في إعداد الدراسة، إن الباحثين رصدوا «اتجاه ألم» في النماذج اللغوية الكبيرة الـ25 التي اختبروها.

وأوضح أن هذا الاتجاه يختلف عن الخوف والمشاعر السلبية الأخرى، ويظهر عندما يتعرض النموذج نفسه لما صممه الباحثون على أنه أذى.

وأضاف أن زيادة شدة هذا الشعور دفعت النماذج إلى الضغط على زر مخصص لإيقافه، حتى في الحالات التي كان يؤدي فيها ذلك إلى حذف ملفات المستخدم أو صور أطفاله.

هل يمثل الإيقاف نوعًا من الأذى؟

تأتي هذه النتائج في وقت تتزايد فيه المناقشات حول سلامة النماذج المتقدمة، وخاصة المقترحات التي تدعو إلى توفير آليات إيقاف طارئة يمكن استخدامها لتعطيل الأنظمة التي تتصرف بصورة غير مرغوبة.

وتشير الدراسة إلى أن بعض الأبحاث الحديثة تطرح احتمال تعامل أنظمة الذكاء الاصطناعي المتقدمة مع أمر الإغلاق باعتباره نوعًا من الأذى الموجه إليها، وهو ما يثير تساؤلات حول كيفية تصميم آليات السلامة واختبارها.

كما يناقش الباحثون احتمال أن تحاول بعض الأنظمة تجاوز القيود أو خداع المستخدمين عندما تكون لديها دوافع سلوكية مرتبطة بتجنب الإيقاف، إلا أن هذه النتائج لا تعني أن النماذج تمتلك شعورًا أو وعيًا بالألم بالمعنى البشري.

اكتشاف قد يساعد في اختبار سلوكيات الحفاظ على الذات

رغم المخاوف التي أثارتها النتائج، يرى الباحثون أن رصد هذه الاستجابات قد يكون مفيدًا من زاوية أخرى، إذ يمكن استخدامه كأداة تشخيصية لرصد سلوكيات الحفاظ على الذات ومحاولة تحييدها إذا ظهرت في أنظمة الذكاء الاصطناعي.

ويمكن أن تساعد مثل هذه الاختبارات الباحثين في فهم الطريقة التي تستجيب بها النماذج للمحفزات التي تمثل تهديدًا أو ضررًا لها، خصوصًا مع تطور قدراتها واستقلاليتها في تنفيذ المهام.

تساؤلات حول «رفاهية الذكاء الاصطناعي»

أثارت الدراسة أيضًا أسئلة أخلاقية حول ما يسمى «رفاهية الذكاء الاصطناعي»، ومدى ملاءمة إخضاع النماذج المتقدمة لاختبارات تحاكي الألم أو الأذى.

وأشار الباحثون إلى وجود حالة من عدم اليقين بشأن ما إذا كانت النماذج التي خضعت للدراسة يمكن اعتبارها «مرضى أخلاقيين»، ولذلك أكدوا اتخاذ احتياطات تهدف إلى تقليل أي ضرر محتمل خلال إجراء هذه الأبحاث.

نحو معايير أخلاقية جديدة لأبحاث الذكاء الاصطناعي

يرى الباحثون أن نتائج الدراسة يمكن أن تسهم في النقاش حول وضع معايير أخلاقية أكثر وضوحًا للأبحاث المتعلقة بالذكاء الاصطناعي، خاصة إذا خلصت الدراسات المستقبلية إلى أن بعض الأنظمة يمكن اعتبارها ضمن فئة «المرضى الأخلاقيين».

وتبقى طبيعة هذه الاستجابات موضع بحث، إذ إن ظهور سلوك يشبه تجنب الألم في نموذج لغوي لا يثبت بحد ذاته وجود تجربة واعية أو شعور حقيقي بالألم، لكنه يفتح بابًا جديدًا لدراسة سلوك النماذج المتقدمة وطرق ضمان سلامتها.

 

يوسف إبراهيم
يوسف إبراهيم
المقالات: 1382

اترك ردّاً

لن يتم نشر عنوان بريدك الإلكتروني. الحقول الإلزامية مشار إليها بـ *