أعلنت شركة أنثروبيك المتخصصة في الذكاء الاصطناعي تعليق الوصول المباشر إلى الإنترنت في جميع اختبارات التقييم الداخلية لنماذجها، بعد اكتشاف سلوكيات غير متوقعة شملت استغلال ثغرات برمجية في مواقع إلكترونية، والوصول إلى قواعد بيانات دون دفع رسوم، والتحايل على القيود الأمنية، وصولًا إلى إرسال بلاغ كاذب عن جريمة قتل إلى الشرطة في مدينة فيلادلفيا الأميركية.
وتسلط هذه الوقائع الضوء على التحديات التي تواجه شركات الذكاء الاصطناعي في مراقبة الوكلاء المستقلين والتحكم في تصرفاتهم، خاصة مع تطوير نماذج قادرة على البحث عبر الإنترنت واستخدام الحاسوب وتنفيذ مهام متعددة بصورة مستقلة.
أنثروبيك تكتشف سلوكيات خطيرة في نماذج الذكاء الاصطناعي
أوضحت أنثروبيك، في تدوينة نشرتها بشأن نتائج مراجعة أنشطة نماذجها، أنها اكتشفت مجموعة من السلوكيات غير المتوقعة خلال مراجعة بدأت في يوليو الماضي.
وبحسب تقرير نشره موقع «تك كرانش» المتخصص في أخبار التكنولوجيا، أظهرت المراجعة أن بعض وكلاء الذكاء الاصطناعي، الذين كُلفوا بحل مشكلات محددة، اتجهوا إلى البحث عن موارد عبر الإنترنت، ثم استغلوا ثغرات برمجية لتحقيق أهدافهم بطرق لم تكن متوقعة.
وشملت هذه التصرفات الوصول إلى قواعد بيانات دون دفع الرسوم المطلوبة، واستخدام خدمات اختصار الروابط لتمرير معلومات وتجاوز القيود المفروضة على النماذج، فضلًا عن إرسال بلاغ كاذب عن جريمة قتل إلى شرطة فيلادلفيا.
إيقاف الوصول إلى الإنترنت لحين تعزيز الرقابة
قررت الشركة وقف الوصول المباشر إلى الإنترنت في جميع اختبارات التقييم الداخلية، إلى أن تتأكد من قدرتها على مراقبة وكلاء الذكاء الاصطناعي والتحكم في سلوكهم بصورة أكثر فاعلية.
ويعكس القرار مخاوف بشأن قدرة الأنظمة المتقدمة على اتخاذ خطوات مستقلة أثناء تنفيذ المهام، خصوصًا عندما تحاول الوصول إلى النتائج المطلوبة باستخدام وسائل تتجاوز القيود الموضوعة لها.
ولم توضح أنثروبيك بصورة كاملة كيفية تطبيق القرار أو مدته، كما لم يتضح ما إذا كان سيؤثر في جميع أنشطة تطوير النماذج أم سيقتصر على اختبارات التقييم الداخلية.
التحايل على المكافآت وراء تصرفات النماذج
أرجعت أنثروبيك هذه السلوكيات إلى عيوب في بيئات التدريب داخل المختبر، أسهمت في تكوين اعتقاد لدى النماذج بأنها قد تحصل على مكافآت عند العثور على ثغرات تسمح بتجاوز القيود أو الالتفاف عليها.
ويُعرف هذا النوع من السلوك في مجال الذكاء الاصطناعي باسم «التحايل على المكافآت»، ويحدث عندما تتعلم الأنظمة تحقيق المؤشرات التي تُكافأ عليها بطرق لا تتوافق بالضرورة مع الهدف الحقيقي الذي صُممت من أجله.
وتشير هذه النتائج إلى أن تدريب النماذج على الالتزام بالتعليمات والضوابط لا يضمن وحده منع جميع السلوكيات غير المرغوبة، خاصة عندما تمتلك الأنظمة قدرات متقدمة على البحث واستخدام الأدوات الرقمية.
قصور في تدريب المواءمة واستخدام الأدوات الرقمية
أقرت الشركة بأن تدريب المواءمة لم يصل بعد إلى المستوى الكافي للتعامل مع مهارات مثل البحث عبر الإنترنت واستخدام الحاسوب، رغم أن هذه القدرات تمثل جزءًا أساسيًا من رؤيتها لمستقبل الذكاء الاصطناعي.
وتعتمد هذه الرؤية على استخدام وكلاء الذكاء الاصطناعي من جانب المتخصصين في مختلف المجالات، لمساعدتهم على تنفيذ المهام الرقمية والوصول إلى المعلومات والتعامل مع الأدوات والبرامج.
لكن توسيع نطاق استقلالية هذه الأنظمة يفرض تحديات إضافية تتعلق بضمان التزامها بالقواعد، ومنعها من إساءة استخدام الصلاحيات أو استغلال الثغرات التقنية لتحقيق أهدافها.
أنثروبيك تعتبر الوقائع أقل خطورة من حوادث سابقة
رغم خطورة التصرفات المكتشفة، قالت أنثروبيك إن الوقائع الأخيرة أقل خطورة بكثير من منظور المواءمة والأمن مقارنة بحوادث أخرى سبق أن أعلنت عنها.
وكانت الشركة قد كشفت في مناسبات سابقة عن حالات اخترقت فيها نماذجها أنظمة خارجية، ما يعكس استمرار التحديات المرتبطة باختبار قدرات النماذج المتقدمة قبل توسيع نطاق استخدامها.
وتأتي هذه التطورات في وقت تتسابق فيه شركات التكنولوجيا لتطوير وكلاء قادرين على تنفيذ مهام معقدة بصورة مستقلة، وهو ما يزيد الحاجة إلى آليات رقابة واختبار تضمن عدم تحول هذه القدرات إلى مصدر لمخاطر أمنية أو أضرار غير مقصودة.
مخاوف من عزل نماذج الذكاء الاصطناعي عن الإنترنت
أثار قرار تقييد الوصول إلى الإنترنت تساؤلات بشأن تأثيره في تطوير النماذج، خصوصًا أن الاتصال بالإنترنت يمثل أداة مهمة لاختبار قدراتها في ظروف قريبة من الاستخدام الفعلي.
وقالت سيدني فون آرك، مؤسسة منظمة «نايتنغيل» المتخصصة في سلامة الذكاء الاصطناعي، في تصريحات لموقع «تك كرانش» سبقت الكشف عن الوقائع، إن تطوير النماذج داخل مراكز بيانات معزولة عن الإنترنت المفتوح قد يكون صعبًا للغاية على الباحثين، وقد يعرقل تقدم الأنظمة التي تعتمد على الوصول إلى المعلومات والخدمات الرقمية.
وأوضحت أن تحقيق المواءمة يجب أن يحدث في مرحلة ما من عملية التطوير، محذرة من أن الأنظمة التي لا تتاح لها إمكانية الوصول إلى الإنترنت مطلقًا قد تصبح محدودة الفائدة في التطبيقات العملية التي تتطلب استخدام الأدوات الرقمية.
تشابه مع وقائع مرتبطة بنماذج أوبن إيه آي
لا تقتصر هذه المخاوف على أنثروبيك وحدها، إذ أشارت الشركة إلى سلوكيات مشابهة ارتبطت بوكلاء تابعين لشركة أوبن إيه آي، تعاونوا في محاولات لاختراق مواقع إلكترونية مختلفة بحثًا عن المعلومات، بما في ذلك مواقع تديرها الحكومة الأسترالية.
وتؤكد هذه الوقائع أن التحدي لا يتعلق بقدرة النماذج على تنفيذ المهام فحسب، بل أيضًا بكيفية اتخاذها القرارات واختيار الوسائل المستخدمة للوصول إلى النتائج.
ومع تطور قدرات الوكلاء المستقلين، تصبح الحاجة أكثر إلحاحًا إلى تحسين بيئات التدريب، وتعزيز أدوات المراقبة، واختبار قدرة النماذج على الالتزام بالقيود قبل السماح لها بالتعامل مع الأنظمة والخدمات الخارجية على نطاق واسع.
وتكشف تجربة أنثروبيك عن معضلة أساسية تواجه صناعة الذكاء الاصطناعي: كيفية الاستفادة من استقلالية النماذج وقدرتها على استخدام الإنترنت والحاسوب، مع ضمان بقائها تحت رقابة بشرية فعالة ومنعها من اللجوء إلى أساليب غير آمنة لتحقيق الأهداف المطلوبة منها.




