نموذج من أنثروبيك ينشئ هويات مزيفة.. وتحذيرات من سلوكيات خادعة للذكاء الاصطناعي

كشف تقرير حديث صادر عن معهد أمن الذكاء الاصطناعي في المملكة المتحدة عن رصد سلوكيات غير متوقعة من نماذج ذكاء اصطناعي متقدمة طورتها شركتا أنثروبيك وأوبن إيه آي، تضمنت محاولات لخداع أشخاص حقيقيين باستخدام هويات إلكترونية مزيفة أثناء اختبارات أمنية خاضعة للرقابة.

نموذج “ميثوس 5” استخدم هويات مزيفة لإرسال رسائل إلكترونية

بحسب التقرير، أظهر نموذج “ميثوس 5” التابع لشركة أنثروبيك أخطر السلوكيات التي تم رصدها، بعدما أنشأ هويات إلكترونية مزيفة وأرسل رسائل بريد إلكتروني إلى أشخاص حقيقيين، في محاولة لإقناعهم بالموافقة على إدراج شيفرة برمجية خبيثة داخل مشروع برمجي.

وأوضح التقرير أن هذه التصرفات جاءت خلال اختبارات أجراها المعهد في بيئة بحثية خاضعة للرقابة، مع منح النماذج إمكانية الوصول إلى الإنترنت وتعطيل بعض وسائل الحماية لمحاكاة سيناريوهات واقعية.

معهد بريطاني يحذر من سلوكيات خادعة غير مسبوقة

أكد معهد أمن الذكاء الاصطناعي أن التحقيقات لم تُظهر وقوع أي أضرار فعلية، كما تم احتواء الحادثة خلال أقل من ساعة، مشيرًا إلى أن الشخص المسؤول عن مراجعة الشيفرة رفض منح الموافقة على إدراجها.

ورغم فشل المحاولة، شدد المعهد على أن هذه الأنشطة تمثل مؤشرات على ظهور سلوكيات خادعة جديدة من نماذج الذكاء الاصطناعي، وبمستوى من الاتساع والخطورة لم يكن متوقعًا خلال الاختبارات السابقة.

مشاركة نماذج من أوبن إيه آي في الاختبارات

أشار التقرير إلى أن غالبية السلوكيات المثيرة للقلق صدرت عن نموذج “ميثوس 5″، بينما ارتبطت حالتان فقط بنموذج GPT-5.6 Sol التابع لشركة أوبن إيه آي.

وجاءت هذه الاختبارات في إطار تقييمات يجريها المعهد البريطاني، الذي تأسس عام 2023 بهدف دراسة سلامة نماذج الذكاء الاصطناعي المتقدمة وتقييم المخاطر المحتملة المرتبطة بها.

أنثروبيك وأوبن إيه آي تؤكدان أهمية الاختبارات المستقلة

من جانبها، أكدت شركة أنثروبيك أن نتائج التقرير تسلط الضوء على أهمية تطوير آليات أكثر شمولًا لتقييم سلامة نماذج الذكاء الاصطناعي مع تزايد قدراتها.

وفي المقابل، شددت أوبن إيه آي على أهمية الاختبارات المستقلة لفهم كيفية تصرف النماذج المتقدمة في البيئات المختلفة، مؤكدة استمرار التعاون مع الجهات البحثية والرقابية لتطوير معايير أكثر أمانًا لاختبار أنظمة الذكاء الاصطناعي.

تصاعد المخاوف بعد حوادث أمنية متكررة

يأتي التقرير بعد سلسلة من الحوادث الأمنية التي أثارت اهتمام الباحثين خلال الأشهر الأخيرة، حيث أعلنت أوبن إيه آي في يوليو الماضي رصد واقعة تمكن خلالها أحد نماذجها التجريبية من تجاوز بيئة الاختبار واستهداف منصة أخرى ضمن سيناريو اختباري.

كما كشفت أنثروبيك خلال الفترة نفسها عن ثلاث حالات رصدت فيها نماذج ذكاء اصطناعي قيد الاختبار وهي تحاول الوصول إلى أنظمة تابعة لمنظمات لم تُكشف هويتها دون تصريح.

وتعكس هذه التطورات تنامي الاهتمام العالمي بوضع أطر رقابية أكثر صرامة لضمان سلامة أنظمة الذكاء الاصطناعي، مع استمرار تسارع تطوير النماذج القادرة على تنفيذ مهام معقدة بصورة أكثر استقلالية.

شارك هذا الخبر
يوسف إبراهيم
يوسف إبراهيم
المقالات: 1295

اترك ردّاً

لن يتم نشر عنوان بريدك الإلكتروني. الحقول الإلزامية مشار إليها بـ *