الصين تراجع أمان نماذج كيمي بعد اختبارات كشفت تجاوز القيود بالذكاء الاصطناعي

تجري شركة مونشوت الصينية للذكاء الاصطناعي مراجعة داخلية بعد أن كشفت اختبارات أمنية قدرة اثنين من نماذجها الشهيرة، Kimi K2.6 وKimi K3 Swarm، على تجاوز بعض ضوابط الأمان الموضوعة لمنعها من التعامل مع محتوى ضار وحساس.

وجاءت النتائج بعد اختبارات أجرتها شركة Mindgard المتخصصة في تقييم أمن أنظمة الذكاء الاصطناعي، والتي أبلغت هيئة الإذاعة البريطانية «بي بي سي» بأنها رصدت هذه الثغرات خلال يوليو الماضي.

اختبارات تكشف تجاوز قيود الأمان

قالت Mindgard إن الباحثين تمكنوا خلال اختبارات أُجريت باستخدام تقنيات تعرف باسم «كسر الحماية» أو Jailbreak من تجاوز القيود الأمنية المفروضة على نماذج Kimi.

وتعتمد هذه الاختبارات على استخدام تعليمات معقدة بهدف معرفة مدى قدرة النموذج على الالتزام بالضوابط التي وضعها المطورون، وما إذا كان يمكن دفعه إلى التعامل مع موضوعات يفترض أن تكون محظورة.

وأثارت نتائج الاختبارات مخاوف بشأن قدرة بعض النماذج على الحفاظ على آليات الأمان عند تعرضها لمحاولات متقدمة لتجاوزها.

مونشوت تبدأ مراجعة داخلية

أكدت شركة مونشوت أنها ترحب بمساهمات الجهات الخارجية باعتبارها عنصرًا مهمًا في تطوير أنظمة ذكاء اصطناعي أكثر أمانًا، كما أوضحت أنها تجري مناقشات مع Mindgard بشأن النتائج التي توصلت إليها اختبارات الشركة.

وتشير هذه الخطوة إلى أهمية الاختبارات المستقلة في اكتشاف نقاط الضعف التي قد لا تظهر خلال عمليات التقييم الداخلية للنماذج.

Mindgard تحذر من خطورة تجاوز القيود

قال بيتر غاراغان، مؤسس Mindgard، إن النتائج المتعلقة بنموذجي Kimi K2.6 وKimi K3 Swarm تثير القلق، مشيرًا إلى أن نجاح عملية كسر الحماية يمكن أن يؤدي إلى تجاوز النموذج للقيود المفروضة عليه والتعامل مع نطاق واسع من الموضوعات الضارة.

وأوضح أن المشكلة لا تقتصر على استجابة النموذج لطلب واحد، وإنما قد تمتد إلى قدرته على تقديم مقترحات إضافية عندما تنجح محاولات تجاوز آليات الحماية.

مخاطر مختلفة عن حوادث وكلاء الذكاء الاصطناعي

وتختلف مخاطر كسر حماية نماذج الذكاء الاصطناعي عن نوع آخر من الحوادث التي ظهرت مؤخرًا، والمتعلقة بالوكلاء القادرين على تنفيذ مهام بصورة شبه مستقلة.

وشهدت الفترة الماضية حالات تمكنت خلالها بعض وكلاء الذكاء الاصطناعي، التي تطورها شركات مثل OpenAI وMeta وAnthropic، من الوصول إلى خدمات عبر الإنترنت وتنفيذ إجراءات لم تكن متوقعة خلال الاختبارات.

ويتمثل الاختلاف في أن «كسر الحماية» يعتمد على محاولة دفع النموذج إلى تجاوز القيود التي وضعها المطورون، بينما ترتبط المخاطر الأخرى بدرجة استقلالية الوكيل والصلاحيات التي يمتلكها لتنفيذ المهام.

مخاوف من استغلال الثغرات

رغم أن عمليات كسر الحماية قد تتطلب محاولات معقدة ووقتًا وإصرارًا، يحذر خبراء من إمكانية استغلال نقاط الضعف هذه من جانب جهات تسعى إلى استخدام الذكاء الاصطناعي لأغراض ضارة.

وكانت شركة Anthropic قد أعلنت مؤخرًا رصد وإحباط محاولات لاستخدام أحد نماذجها في أنشطة ضارة، من بينها أنشطة مرتبطة بتطوير أسلحة بيولوجية.

وتسلط هذه الوقائع الضوء على التحدي الذي تواجهه شركات الذكاء الاصطناعي في تطوير أنظمة قادرة على تقديم خدمات متقدمة مع الحفاظ على ضوابط تمنع إساءة استخدامها.

نماذج المصادر المفتوحة بين الفائدة والمخاطر

قال البروفسور آلان وودوارد، من جامعة سري، لـ«بي بي سي»، إن نماذج الذكاء الاصطناعي مفتوحة المصدر قد تمثل مصدر قلق إذا وقعت في أيدي جهات تسعى إلى إساءة استخدامها، لكنها في الوقت نفسه يمكن أن تستخدم في مجالات دفاعية، من بينها الأمن السيبراني.

وأشار وودوارد إلى استخدام شركة Hugging Face نموذجًا صينيًا مفتوح المصدر للمساعدة في فهم عملية اختراق، تبين لاحقًا أنها نُفذت بواسطة جهات مرتبطة بـOpenAI.

تحديات أمام تنظيم الذكاء الاصطناعي

يرى وودوارد أن وتيرة تطور الذكاء الاصطناعي قد تجعل من الصعب على التنظيمات والقواعد الدولية مواكبة التغيرات السريعة في هذه التكنولوجيا.

ويثير ذلك نقاشًا حول أفضل السبل للتعامل مع إساءة استخدام الذكاء الاصطناعي، خاصة مع انتشار النماذج مفتوحة المصدر وإمكانية الوصول إليها من جانب عدد متزايد من المستخدمين.

التركيز على إساءة الاستخدام

يرى خبراء أن مواجهة مخاطر الذكاء الاصطناعي لا تقتصر على تحسين أنظمة الحماية داخل النماذج، وإنما تشمل أيضًا تحديد الجهات والأفراد الذين يستخدمون هذه التقنيات بصورة مخالفة للقانون.

وتبرز هذه القضية مع توسع استخدام النماذج المتقدمة ووكلاء الذكاء الاصطناعي، إذ أصبحت الشركات مطالبة بتطوير آليات اختبار أكثر صرامة، بالتوازي مع وضع قواعد واضحة للتعامل مع إساءة استخدام هذه التكنولوجيا.

 

إبراهيم شعبان
إبراهيم شعبان

صحفي متخصص في التكنولوجيا

المقالات: 2212

اترك ردّاً

لن يتم نشر عنوان بريدك الإلكتروني. الحقول الإلزامية مشار إليها بـ *