Anthropic تطلق نموذج Claude Fable 5.1 بسعر أقل وقيود أكثر دقة
أطلقت Anthropic نموذج الذكاء الاصطناعي Claude Fable 5.1 إلى جانب نموذج الذكاء الاصطناعي Claude Mythos 5.1، مع تحسينات تستهدف البرمجة والعمل المعرفي والمهام الطويلة. يركز الإصدار الجديد من Fable بصورة خاصة على تقليل تكلفة تشغيل الوكلاء وتقليل حالات رفض الطلبات الآمنة بالخطأ، بعد انتقادات واجهت الجيل السابق بسبب السعر والقيود الأمنية الصارمة.
- Claude Fable 5.1 يخفض تكلفة بعض مهام الوكلاء بنسبة تصل إلى 45%.
- قراءة الذاكرة المؤقتة أصبحت أرخص بنسبة 75% مقارنة بالإصدار السابق.
- الحواجز البيولوجية تتدخل في الطلبات الآمنة بمعدل أقل بنسبة 85%.
- Claude Mythos 5.1 يظل متاحًا فقط لمؤسسات بحثية خضعت للتحقق.
بحسب Anthropic، يتوفر نموذج Claude Fable 5.1 لمشتركي Pro و Max و Team و Enterprise، إضافة إلى المطورين عبر Claude Platform وعدة منصات سحابية. أبقت الشركة السعر الأساسي عند 10 دولارات لكل مليون رمز إدخال و50 دولارًا لكل مليون رمز إخراج، بينما جاء التخفيض الحقيقي من تكلفة قراءة الذاكرة المؤقتة Cache التي انخفضت إلى 0.25 دولار لكل مليون رمز.
تكلفة أقل للمهام الطويلة
أوضحت Anthropic أن خفض سعر قراءة الذاكرة المؤقتة بنسبة 75% يقلل تكلفة أحمال العمل المعتادة بنحو 25%، بينما قد يصل التوفير إلى قرابة 45% في المهام التي تعتمد بصورة كثيفة على الوكلاء. يشير الوكيل هنا إلى نظام يستطيع تنفيذ سلسلة من الخطوات واستخدام عدة أدوات بصورة مستقلة نسبيًا للوصول إلى نتيجة محددة.
تظهر أهمية التخفيض عندما يعمل النموذج لساعات ويحتاج إلى الرجوع باستمرار إلى سياق أو بيانات سبق معالجتها. تسمح الذاكرة المؤقتة بإعادة استخدام هذه المعلومات بتكلفة أقل، ما يجعل تشغيل مهام البرمجة الطويلة أو العمليات التي تمتد بين عدة تطبيقات أقل تكلفة مقارنة بالإصدار السابق.
تصف Anthropic نموذج Claude Fable 5.1 بأنه أقوى نماذجها المتاحة بصورة عامة للبرمجة والعمل المعرفي. كما تؤكد الشركة أنه يستطيع تنفيذ مهام تمتد لساعات، وتشغيل المتصفح، والعمل عبر تطبيقات مختلفة، واستعادة مسار المهمة بعد فشل إحدى الخطوات دون حاجة إلى متابعة مستمرة.
أظهرت اختبارات داخلية لدى شركات مثل Cognition و Every تحسنًا في تكلفة المهمة والسرعة مقارنة ببعض نماذج Anthropic السابقة. تبقى هذه النتائج مرتبطة باختبارات العملاء والشركة، لذلك تحتاج المقارنة الشاملة إلى تقييمات مستقلة تعمل تحت ظروف موحدة قبل تحويلها إلى حكم نهائي على الأداء.
قدمت Anthropic كذلك نتائج قوية في اختبارات للبرمجة والاستدلال، منها Terminal-Bench 4.0 و Humanity’s Last Exam. تظل الاختبارات المعيارية مؤشرًا على قدرات محددة، بينما قد تختلف تجربة الاستخدام الفعلية حسب المهمة والأدوات وطول السياق.

قيود أقل دون إزالة الحماية
ركزت Anthropic في الإصدار الجديد على جعل أنظمة الحماية أكثر دقة، خصوصًا في مجالي الأمن السيبراني والبيولوجيا. أوضحت الشركة أن حواجز البيولوجيا أصبحت تتدخل في الطلبات الآمنة بمعدل أقل بنسبة 85% مقارنة بالنسخة التي أطلقتها مع نموذج Claude Fable 5.
يسمح نموذج Claude Fable 5.1 الآن بالبحث عن الثغرات الأمنية داخل الشيفرات المصدرية، وهي مهمة كانت القيود السابقة قد تعرقلها في بعض الحالات. تستمر الشركة في حظر مهام أكثر حساسية مثل إنشاء أدوات استغلال الثغرات واختبارات الاختراق وبعض أنواع تحليل الملفات التنفيذية، مع توجيه عدد من الطلبات إلى نماذج أخرى عندما تتدخل أنظمة الحماية.
يقدم نموذج Claude Mythos 5.1 القدرات الأساسية نفسها مع قيود أقل في الأمن السيبراني والبيولوجيا، لكنه متاح فقط لجهات خضعت للتحقق ضمن برامج Anthropic البحثية. ترى الشركة أن قدراته في هذه المجالات يمكن استخدامها لأغراض دفاعية وعلمية، لكنها تحمل أيضًا احتمالات إساءة استخدام تتطلب تقييد الوصول.
تستعد Anthropic كذلك لإطلاق Enterprise Frontier Safeguards للشركات خلال الخريف، ما يسمح للعملاء المؤهلين بالاحتفاظ بالبيانات داخل بنيتهم السحابية والتحكم بصورة أكبر في آليات المراقبة. أكدت الشركة أنها لا تستخدم بيانات المؤسسات في التدريب دون إذن صريح، بينما يظل الاحتفاظ بالبيانات لمدة 30 يومًا هو الإعداد الافتراضي خارج هذه الخيارات.
من وجهة نظري، يمثل تقليل حالات الحظر الخاطئ تحسينًا مهمًا لأن أنظمة الحماية المبالغ فيها قد تجعل النموذج أقل فائدة حتى في الأعمال المشروعة. يبقى التحدي أمام Anthropic في الحفاظ على هذا التوازن مع زيادة قدرات النماذج، لأن تخفيف القيود يصبح مفيدًا للمستخدم عندما يرفع دقة النظام دون فتح مساحة أكبر لإساءة الاستخدام.
?xml>