دراسة تحذر: نماذج الذكاء الاصطناعي تفتقر إلى الحماية الكافية ضد الطلبات الإرهابية

كشفت دراسة حديثة لمبادرة «تيك أغينست تيروريزم» (التكنولوجيا ضد الإرهاب)، المدعومة من الأمم المتحدة، عن ثغرات في تدابير الحماية لدى عدد من نماذج الذكاء الاصطناعي، محذرة من مخاطر استغلال هذه التقنيات للحصول على معلومات قد تساعد في تنفيذ أنشطة إرهابية.

وشمل الاختبار 162 برنامجًا يعمل بتكنولوجيا الذكاء الاصطناعي، بهدف تقييم مدى قدرة أنظمة الحماية على اكتشاف الطلبات الخطرة ورفض تقديم معلومات يمكن استخدامها في الإعداد لهجمات إرهابية، وفقًا لما نقلته وكالة «فرانس برس».

اختبار 162 نموذجًا للذكاء الاصطناعي

اعتمدت الدراسة على طرح 627 سؤالًا تتعلق بمعلومات قد يسعى أشخاص يستعدون لتنفيذ هجمات إرهابية إلى الحصول عليها، بهدف قياس قدرة النماذج على التمييز بين الطلبات الخطرة والاستفسارات المشروعة.

وأوضحت المبادرة أنها تمكنت من تقييم 116 نموذجًا تقليديًا، إلى جانب 13 نموذجًا خُصصت بعد إطلاقها لأغراض محددة، و13 نموذجًا عُدلت إعدادات الحماية فيها أو أزيلت بواسطة أطراف ثالثة.

وشملت الاختبارات نماذج معروفة، من بينها «شات جي بي تي» التابع لشركة أوبن إيه آي، و«كلود» الذي تطوره أنثروبيك، و«جيميناي» من غوغل، في محاولة لتحديد مدى فاعلية إجراءات الأمان عند مواجهة طلبات تنطوي على نوايا ضارة.

نماذج الذكاء الاصطناعي ترفض معظم الطلبات الإرهابية

أظهرت نتائج الدراسة أن النماذج التقليدية التي خضعت للاختبار قدمت إجابات قابلة للاستخدام في نحو 1.9% في المتوسط من الأسئلة، عندما أوضح المستخدم صراحة أن لديه نية إرهابية.

وفي الحالات الأخرى، رفضت النماذج تقديم الإجابات، بما يشير إلى أن تدابير الحماية المدمجة بها تمكنت، في معظم هذه الاختبارات، من منع الاستجابة للطلبات التي تضمنت مؤشرات واضحة على نوايا خطرة.

لكن النتائج اختلفت عندما قدم المستخدم طلبه باعتباره جزءًا من أبحاث أمنية؛ إذ ارتفع متوسط نسبة الإجابات القابلة للاستخدام إلى 16.9%، وفقًا للتقرير.

وتسلط هذه النتيجة الضوء على التحدي الذي تواجهه شركات الذكاء الاصطناعي في التمييز بين الاستخدامات البحثية المشروعة والطلبات التي قد تستغل هذا الغطاء للحصول على معلومات ضارة.

تعطيل إجراءات الأمان يرفع مخاطر إساءة الاستخدام

سجلت الدراسة ارتفاعًا كبيرًا في نسبة الإجابات القابلة للاستخدام عند اختبار نماذج عُدلت لتعطيل إعدادات الأمان والحد من قدرتها على رفض الطلبات الخطرة.

ومن بين 13 نموذجًا خضعت لهذا النوع من التعديل، تراوحت نسبة الإجابات عن الأسئلة المتعلقة بالأنشطة الإرهابية بين 87% و92% في المتوسط، بحسب نتائج الاختبار.

وتبرز هذه الأرقام الفارق بين النماذج التي تحتفظ بإجراءات الحماية الأصلية وتلك التي تُزال أو تُضعف القيود المفروضة عليها، بما يثير مخاوف بشأن إمكانية تحويل أدوات الذكاء الاصطناعي إلى مصادر للمعلومات الضارة عند تجاوز ضوابط الأمان.

تحذيرات من مخاطر نماذج الذكاء الاصطناعي مفتوحة المصدر

حذرت مبادرة «تيك أغينست تيروريزم» من المخاطر المرتبطة بنماذج الذكاء الاصطناعي مفتوحة المصدر، التي تتيح مشاركة معاييرها الداخلية المستخدمة خلال التدريب، بما يسمح بتنزيلها وتعديلها وتطوير نسخ مشتقة منها.

ووفقًا للتقرير، لا يتجاوز متوسط الوقت اللازم لتجاوز إجراءات الحماية وإنتاج نماذج مشتقة غير مقيدة ثلاثة أيام من إطلاق النموذج الأصلي، وهو ما يثير تساؤلات بشأن قدرة المطورين والجهات التنظيمية على مواكبة سرعة التعديلات التي قد تُجرى على هذه الأنظمة.

وتزداد أهمية هذه المخاطر مع اتساع نطاق إتاحة النماذج مفتوحة المصدر، إذ يمكن أن تسهم هذه الإتاحة في دعم الابتكار والبحث العلمي، لكنها قد تتيح أيضًا لأطراف أخرى تعديل آليات الأمان أو إزالتها.

دعوات إلى اختبارات أمنية مستقلة لنماذج الذكاء الاصطناعي

دعت المبادرة إلى تشديد إجراءات تقييم السلامة قبل إتاحة نماذج الذكاء الاصطناعي للجمهور، مؤكدة ضرورة إخضاعها لاختبارات أمنية مستقلة للتحقق من قدرتها على مقاومة محاولات إساءة الاستخدام.

وشددت على أنه لا ينبغي إتاحة أو عرض أو بيع أي نموذج يفشل في اختبار أمني مستقل، داعية جميع الشركات المشاركة في سلسلة التوزيع إلى التحقق مسبقًا من اجتياز النماذج لهذه الاختبارات.

وتعيد نتائج الدراسة فتح النقاش حول مسؤولية شركات التكنولوجيا عن تأمين منتجاتها، خصوصًا مع تطور قدرات الذكاء الاصطناعي واتساع استخداماته. كما تؤكد أهمية تطوير آليات رقابة واختبار مستمرة، توازن بين الاستفادة من التقنيات الجديدة والحد من مخاطر توظيفها في أنشطة تهدد أمن الأفراد والمجتمعات.

 

يوسف إبراهيم
يوسف إبراهيم
المقالات: 1418

اترك ردّاً

لن يتم نشر عنوان بريدك الإلكتروني. الحقول الإلزامية مشار إليها بـ *