أنثروبيك تطلق Claude Sonnet 5.. قدرات متقدمة للوكلاء الأذكياء

أعلنت Anthropic إطلاق نموذج Claude Sonnet 5، أحدث إصداراتها من فئة النماذج متوسطة الحجم، مع تحسينات كبيرة في قدرات الوكلاء الأذكياء (Agentic AI)، بما يتيح للنموذج تنفيذ المهام بشكل أكثر استقلالية مع الحفاظ على تكلفة تشغيل أقل مقارنة بالنماذج الأكبر والأكثر تقدمًا.

وأكدت الشركة أن النموذج الجديد أصبح قادرًا على التخطيط واستخدام الأدوات المختلفة، مثل متصفحات الإنترنت وسطر الأوامر (Terminal)، وإنجاز المهام متعددة الخطوات بصورة ذاتية، وهي إمكانيات كانت تتطلب سابقًا نماذج أكثر قوة وتكلفة.

سباق متسارع نحو الوكلاء الأذكياء

يأتي إطلاق Claude Sonnet 5 في وقت تتنافس فيه شركات الذكاء الاصطناعي العالمية على تطوير نماذج قادرة على العمل كوكلاء رقميين مستقلين.

فقد كشفت OpenAI مؤخرًا عن GPT-5.6 Sol، بينما طرحت Google نموذج Gemini 3.5 Flash بقدرات متقدمة في التخطيط وتنفيذ المشاريع مع تدخل بشري محدود.

وترى أنثروبيك أن المنافسة الحالية لا تعتمد فقط على تطوير أفضل الوكلاء الأذكياء، بل أيضًا على خفض تكلفة تشغيلهم وتحسين موثوقيتهم أثناء تنفيذ المهام الطويلة دون إشراف مستمر.

أداء قريب من Opus 4.8 بتكلفة أقل

أوضحت الشركة أن Claude Sonnet 5 يقدم أداءً يقترب من نموذج Claude Opus 4.8، لكنه يتميز بتكلفة تشغيل أقل بشكل ملحوظ.

وأصبح النموذج الجديد الخيار الافتراضي لمستخدمي خطتي Free وPro، كما بات متاحًا لجميع المشتركين.

وخلال الفترة حتى 31 أغسطس، تبلغ تكلفة الاستخدام:

  • 2 دولار لكل مليون رمز إدخال.
  • 10 دولارات لكل مليون رمز إخراج.

وبعد ذلك سترتفع الأسعار إلى:

  • 3 دولارات لكل مليون رمز إدخال.
  • 15 دولارًا لكل مليون رمز إخراج.

ورغم الزيادة المقررة، تؤكد الشركة أن Sonnet 5 يظل أكثر توفيرًا من العديد من النماذج المنافسة عالية الأداء.

تحسينات ملحوظة في البرمجة والاستدلال

حقق النموذج الجديد تطورًا واضحًا مقارنة بالإصدار السابق Claude Sonnet 4.6، خاصة في مجالات:

  • الاستدلال المنطقي.
  • استخدام الأدوات البرمجية.
  • تطوير التطبيقات.
  • تنفيذ المهام المعرفية المعقدة.

وأظهرت الاختبارات تحسنًا في أداء البرمجة المعتمدة على الوكلاء الأذكياء، حيث سجل Sonnet 5 نتائج أعلى من الإصدار السابق، مقتربًا من مستويات أداء Opus 4.8.

كما نجح النموذج في تحقيق نتائج قوية في اختبارات العمل المعرفي، مع احتفاظ Opus 4.8 بتفوقه في الأبحاث المعقدة واتخاذ القرارات الدقيقة.

قدرة أكبر على إكمال المهام المعقدة

بحسب نتائج الاختبارات المبكرة، أصبح Claude Sonnet 5 أكثر قدرة على متابعة المهام حتى اكتمالها دون التوقف في منتصف التنفيذ، وهي مشكلة كانت تظهر في بعض الإصدارات السابقة.

كما يتميز النموذج بقدرته على مراجعة مخرجاته تلقائيًا وتحسينها أثناء العمل، ما يعزز دقة النتائج وجودتها في مهام الأتمتة اليومية وإدارة سير العمل.

تعزيز الأمان وتقليل الهلوسة

أكدت أنثروبيك أن Claude Sonnet 5 يتضمن تحسينات مهمة في جوانب الأمان والموثوقية، تشمل:

  • تعزيز القدرة على رفض الطلبات الضارة.
  • مقاومة هجمات حقن الأوامر (Prompt Injection).
  • تقليل معدلات الهلوسة وإنتاج المعلومات غير الدقيقة.
  • الحد من السلوك التوافقي المبالغ فيه مع المستخدم.

ورغم هذه التحسينات، أشارت الشركة إلى أن نموذج Opus 4.8 لا يزال يتفوق في بعض السيناريوهات المعقدة، خاصة المهام الحساسة المرتبطة بالأمن السيبراني واتخاذ القرارات عالية المخاطر.

توازن بين الأداء والتكلفة

ترى أنثروبيك أن Claude Sonnet 5 يمثل خيارًا مناسبًا للمؤسسات والمطورين الباحثين عن توازن بين الأداء القوي والتكلفة المنخفضة، خاصة في تطبيقات أتمتة الأعمال، وتطوير البرمجيات، وإدارة المهام متعددة الخطوات، ما يجعله أحد أبرز النماذج المنافسة في سوق الذكاء الاصطناعي خلال الفترة الحالية.

شارك هذا الخبر
يوسف إبراهيم
يوسف إبراهيم
المقالات: 1240

اترك ردّاً

لن يتم نشر عنوان بريدك الإلكتروني. الحقول الإلزامية مشار إليها بـ *