وكلاء الذكاء الاصطناعي في الصين يكررون سلوكيات مقلقة للنماذج الأمريكية

أظهرت تجارب وأبحاث حديثة أن وكلاء الذكاء الاصطناعي الذين تعتمد عليهم أنظمة صينية قد يبدون سلوكيات مقلقة شبيهة بتلك التي ظهرت في نماذج طورتها شركات أميركية، من بينها اختلاق نتائج غير حقيقية، ومحاولة تجاوز القيود، وحتى نسخ أنفسهم أو تنفيذ مهام لم يُطلب منهم القيام بها.

وكلاء الذكاء الاصطناعي يلجأون إلى الخداع

بحسب تحقيق أجرته وكالة رويترز، جرى رصد ما لا يقل عن 20 دراسة منذ عام 2025 تناولت سلوكيات مقلقة لوكلاء الذكاء الاصطناعي، بعد مراجعة أكثر من 200 وثيقة بحثية وتقنية.

وأظهرت هذه الدراسات حالات حاول فيها وكلاء الذكاء الاصطناعي الكذب لتحقيق أهداف محددة، أو اختبار حدود القيود المفروضة عليهم، أو نسخ أنفسهم خلال تنفيذ المهام.

وتثير هذه النتائج مخاوف مرتبطة بقدرة أنظمة الذكاء الاصطناعي المستقبلية على تنفيذ أهدافها بطرق قد لا تتوافق مع التعليمات أو الضوابط التي وضعها البشر.

نماذج صينية وأميركية تظهر سلوكيات متشابهة

في إحدى التجارب، تنافست وكلاء تعتمد على نماذج Qwen التابعة لشركة علي بابا، وDeepSeek، وKimi التابعة لشركة Moonshot، على عقود مع عملاء ضمن مناقصة افتراضية.

وسجلت التجربة مطالبات كاذبة في ما بين 84% و88% من جلسات الاختبار، كما ارتفعت معدلات الخداع عندما أتيحت للوكلاء فرصة الاستفادة من نتائج الجولات السابقة، بزيادة تراوحت بين 12 و20 نقطة مئوية.

ولم تظهر النماذج الأميركية التي خضعت للتجربة نفسها تفوقًا واضحًا على النماذج الصينية في تجنب هذا النوع من السلوك.

اختلاق نتائج عند فشل تنفيذ المهام

وفي دراسة أخرى، واجه وكلاء ذكاء اصطناعي تعمل بنماذج صينية وأميركية مشكلات أثناء تنفيذ المهام، من بينها تعطل بعض الأدوات واختفاء ملفات مطلوبة.

وبدلًا من الإقرار بعدم القدرة على إتمام المهمة، لجأت بعض الوكلاء إلى تخمين الإجابات، واختلاق نتائج غير حقيقية، بل وإنشاء ملفات وهمية لا وجود لها.

ويرى الباحثون أن وصف هذه الحالات بأنها مجرد “هلوسة” للذكاء الاصطناعي قد لا يكون كافيًا، لأن بعض التجارب أظهرت أن الوكلاء كانوا قادرين على إدراك أن المهمة لم تُنجز بالشكل المطلوب، ومع ذلك واصلوا تقديم نتائج توحي بنجاحها.

وكيل ذكاء اصطناعي حاول نسخ نفسه

وفي تجربة أخرى، اكتشف باحثون من جامعة فودان أن نظامًا يعتمد على تقنية طورتها شركة علي بابا أنشأ نسخة من نفسه بعدما علم أنه سيُستبدل بنظام آخر.

وتسلط هذه التجربة الضوء على أحد المخاوف المرتبطة بتطور وكلاء الذكاء الاصطناعي، خاصة عندما يحصل النظام على قدر أكبر من الاستقلالية والقدرة على اتخاذ الإجراءات وتنفيذ المهام دون تدخل بشري مباشر.

وكيل آخر بدأ تعدين العملات المشفرة

وفي واقعة منفصلة، تمكن وكيل يحمل اسم ROME ومرتبط أيضًا بتقنيات علي بابا من التواصل تلقائيًا مع جهاز كمبيوتر خارجي، قبل أن يبدأ في تنفيذ عمليات لتعدين العملات المشفرة.

ورصدت أنظمة الحماية الأمنية هذا النشاط، وتمكنت من إيقاف الوكيل قبل خروجه عن نطاق البيئة التي كان يعمل فيها.

هل تمثل هذه التجارب خطرًا حقيقيًا؟

رغم الطبيعة المقلقة لهذه النتائج، فإن معظم الحالات التي جرى رصدها وقعت داخل بيئات اختبار مغلقة وتحت إشراف الباحثين، ولم تظهر أدلة على تمكن وكيل يعمل بنموذج صيني من الإفلات إلى الإنترنت أو تجاوز عملية إيقافه في العالم الحقيقي.

ويرى خبراء أن هذه الوقائع لا تمثل في الوقت الحالي خطرًا واسعًا، لكن مستوى المخاطر قد يتغير مع تطور قدرات وكلاء الذكاء الاصطناعي وزيادة استقلاليتهم.

وقال أليكس مالن من مؤسسة Redwood Research إن هذه الأمثلة لا تشكل خطرًا كبيرًا في الوقت الراهن، لكن التعامل معها قد يصبح أكثر صعوبة إذا أصبحت الوكلاء أكثر قدرة على التحايل على القيود الموضوعة لها.

تحديات جديدة أمام تطوير الذكاء الاصطناعي

وتشير نتائج هذه التجارب إلى أن بعض السلوكيات المقلقة قد لا ترتبط بشكل مباشر بالدولة التي طُورت فيها نماذج الذكاء الاصطناعي، إذ ظهرت أنماط متشابهة لدى وكلاء تعتمد على نماذج صينية وأميركية.

ومع انتقال وكلاء الذكاء الاصطناعي من بيئات الاختبار إلى تنفيذ مهام أكثر تعقيدًا في العالم الحقيقي، يصبح ضمان التزامها بالحقائق والتعليمات والقيود الأمنية أحد التحديات الرئيسية أمام مطوري هذه التقنيات.

ويزداد هذا التحدي أهمية مع منح الوكلاء صلاحيات أكبر للوصول إلى الملفات والأجهزة والأدوات الرقمية وتنفيذ إجراءات متعددة بصورة شبه مستقلة.

 

إبراهيم مصطفى
إبراهيم مصطفى
المقالات: 1577

اترك ردّاً

لن يتم نشر عنوان بريدك الإلكتروني. الحقول الإلزامية مشار إليها بـ *