أطلقت شركة جوجل نموذج الذكاء الاصطناعي «جيميناي 4 أرجون» (Gemini 4 Argon)، الذي تقدمه بوصفه أحدث نماذجها الرائدة وأكثرها قدرة حتى الآن، مع تركيز أساسي على تنفيذ المهام المعقدة متعددة الخطوات بدلًا من الاكتفاء بإنتاج إجابات قصيرة أو تنفيذ أوامر منفردة.
ويستهدف النموذج بصورة خاصة مجالات هندسة البرمجيات والعمل المعرفي المتخصص والأمن السيبراني، في خطوة تعكس توجهًا متزايدًا نحو تطوير أنظمة ذكاء اصطناعي قادرة على مواصلة العمل عبر مراحل متعددة للوصول إلى نتيجة نهائية.
مليون رمز لتنفيذ مهام طويلة
ومن أبرز التحسينات التقنية في «جيميناي 4 أرغون» رفع حد الإخراج إلى مليون رمز (Token)، مقارنة بـ64 ألف رمز في النموذج السابق، وفقًا لجوجل.
وتقول الشركة إن زيادة المساحة المتاحة للنموذج تساعده على تنفيذ عمليات استدلال طويلة، والتعامل مع مئات الآلاف من الرموز ضمن مسار واحد، بما يسمح له بمعالجة مشكلات تحتاج إلى تحليل متتابع بدلًا من سلسلة قصيرة من التعليمات.
وتعني هذه الإمكانية أن النموذج يستطيع التعامل مع مشاريع برمجية كبيرة أو مهام بحثية متعددة المراحل ضمن سياق واحد، مع الاحتفاظ بقدر أكبر من المعلومات الضرورية لمواصلة المهمة، بينما تؤكد جوجل أن هذا التوجه يمثل جزءًا أساسيًا من تصميم أرغون وليس مجرد توسيع لنافذة السياق.
«جيميناي 4 أرجون» يدخل عالم هندسة البرمجيات
تضع جوجل البرمجة وهندسة البرمجيات في مقدمة الاستخدامات المستهدفة للنموذج، مشيرة إلى أن مهندسيها يستخدمونه في تصحيح الأخطاء، وتصميم الخوارزميات، وترحيل قواعد شيفرة ضخمة بين لغات البرمجة.
وتوضح الشركة أن وكلاء أرجون يعملون على ترحيل قواعد شيفرة مكتوبة بلغتي C وC++ إلى Rust، ووصل حجم إحدى عمليات الترحيل إلى أكثر من 800 ألف سطر من الشيفرة في نواة نظام Fuchsia Zircon.
كما حقق النموذج نتيجة بلغت 77.9% في اختبار DeepSWE v1.1، المخصص لقياس أداء نماذج الذكاء الاصطناعي في مهام هندسة البرمجيات الواقعية طويلة المدى.
إعادة كتابة آلاف الأسطر من الشيفرة
وفي تجربة أخرى، تقول جوجل إن وكلاء أرغون أعادوا كتابة 32 ألف سطر من شيفرة SIMD في مشروع libgav1، ما أدى إلى تطوير نسخة Rust أسرع بنحو 2.7 مرة من النسخة السابقة، مع الحفاظ على المخرجات نفسها.
وأكدت الشركة أن عمليات إعادة الكتابة واسعة النطاق تخضع لمراجعة واختبارات آلية ويدوية قبل اعتمادها في بيئات الإنتاج، في ظل المخاطر المرتبطة بإسناد مهام برمجية طويلة إلى أنظمة الذكاء الاصطناعي.
قدرات في التمويل والقانون والضرائب
ولا يقتصر «جيميناي 4 أرجون» على البرمجة، إذ صممته جوجل أيضًا لتنفيذ مهام معرفية متخصصة في مجالات مثل التمويل والقانون والضرائب.
وتقول الشركة إن النموذج حقق أداءً متقدمًا في اختبارات تتعلق بالبحث المالي متعدد الخطوات، والبحث والصياغة القانونية، ومهام الأعمال التي تتطلب تنفيذ سلسلة كاملة من الإجراءات.
كما يتمتع النموذج بقدرات متعددة الوسائط، تشمل تحليل الرسوم البيانية وفهم مقاطع الفيديو الطويلة، وسجل 91.7% في اختبار LVBench المخصص لقياس قدرات النماذج على فهم الفيديوهات طويلة المدة.
الذكاء الاصطناعي لاكتشاف الثغرات السيبرانية
ويحتل الأمن السيبراني موقعًا محوريًا في إطلاق «جيميناي 4 أرغون»، إذ تقول جوجل إن النموذج قادر على اكتشاف الثغرات البرمجية والتحقق منها وإعداد إصلاحات لها بصورة ذاتية.
وحقق النموذج 68% في اختبار CWE-bench v1 الخاص بمعالجة الثغرات الأمنية، وهي نتيجة تقول جوجل إنها تعادل أفضل نتيجة مسجلة في هذا الاختبار.
وتستخدم الشركة هذه القدرات ضمن برنامج «Fairwind»، الذي يتيح النموذج لمجموعة مختارة من المدافعين السيبرانيين، مع فرض ضوابط وصول صارمة وقصر الاستخدام على فرق الأمن السيبراني والاستجابة للحوادث واختبارات الاختراق، إلى جانب مهام دفاعية وبحثية محددة.
جوجل تطرح النموذج تدريجيًا بسبب المخاطر
وعلى خلاف طرح نموذج ذكاء اصطناعي جديد أمام المستخدمين مباشرة، اختارت جوجل إتاحة «أرغون» بصورة تدريجية، حيث بدأت بتوفيره لمختبرين موثوقين ومدافعين في مجال الأمن السيبراني ضمن برنامج «Fairwind».
وتعمل الشركة بالتوازي على اختبار إجراءات الحماية قبل توسيع نطاق الوصول إلى المطورين والشركات والمستخدمين.
وتشمل إجراءات الحماية، بحسب جوجل، مقاومة إساءة الاستخدام والهجمات المعروفة باسم «حقن التعليمات غير المباشر» (Indirect Prompt Injection)، إلى جانب أنظمة لمراقبة سلوك النموذج وإيقاف التنفيذ عند رصد انحراف عن حدود المهمة، فضلًا عن استخدام بيئات اختبار معزولة للعمليات عالية الخطورة.
الإتاحة العامة لم تتحدد بعد
وأشارت وكالة رويترز إلى أن جوجل لم تحدد موعدًا لإطلاق عام كامل للنموذج، بينما قالت الشركة إن الإتاحة ستتوسع تدريجيًا، بدءًا من عملاء واجهة برمجة التطبيقات (API) المدفوعة ومشتركي Google AI Ultra.
ويعكس هذا الطرح الحذر مخاوف مرتبطة بقدرة النموذج على تنفيذ مهام طويلة وبدرجة أكبر من الاستقلالية، خاصة في المجالات الحساسة مثل الأمن السيبراني وهندسة البرمجيات.
«جيميناي 4 أرجون».. من الإجابة إلى تنفيذ المهمة
يعكس إطلاق «جيميناي 4 أرجون» توجهًا متزايدًا لدى جوجل نحو نماذج ذكاء اصطناعي لا تركز فقط على جودة الإجابة، وإنما على الاستمرار في العمل عبر مراحل متعددة للوصول إلى نتيجة نهائية.
وتبرز تطبيقات البرمجة والبحث المالي والقانوني والأمن السيبراني هذا الاتجاه بوضوح، إلا أن نتائج الأداء لا تشير إلى تفوق النموذج في جميع الاختبارات.
وبحسب ما نقلته رويترز عن الشركة، يتفوق أرغون على نماذج منافسة في بعض المؤشرات، لكنه يتأخر عنها في مؤشرات أخرى، بينها اثنان من أربعة اختبارات مرتبطة بالبرمجة أوردتها جوجل.
وبالتالي، ترتبط أهمية النموذج بمحاولة نقل الذكاء الاصطناعي من مرحلة تقديم الإجابات إلى أنظمة قادرة على تنفيذ أعمال طويلة ومعقدة بدرجة أكبر من الاستقلالية، وليس فقط بنتائج اختبار معياري منفرد.




