
إطلاق Claude Fable 5.1 وMythos 5.1: أداء أعلى وتكلفة أقل للوكلاء الذكيين
Fable 5.1 وMythos 5.1 يصلان رسميًا
كشفت شركة «أنثروبيك» الستار رسمياً عن تحديث رئيسي لمنظومتها الذكية بإصدار طرازي «كلود فيبل 5.1″ (Claude Fable 5.1) و»كلود ميثوس 5.1» (Claude Mythos 5.1)، وذلك بعد انقضاء ثلاثة أشهر فقط على طرح الجيل السابق «فيبل 5». وأتى هذا الإعلان لترسيخ حضور الشركة في فضاء تطوير البرمجيات المعقدة، والبحوث الاستقصائية، وإدارة المهام المستقلة ذات المدى الزمني الممتد. وينتمي طراز «فيبل 5.1» إلى فئة «ميثوس» العليا لدى أنثروبيك، وهي الفئة المخصصة لأكثر مهام البرمجة والعمل المعرفي تعقيداً في المنظومة.

أوضحت الشركة في بيانها الصحفي أن الطراز الأحدث يهدف إلى إرساء معايير متقدمة في صياغة الشيفرات البرمجية، وتحليل المعارف التخصصية، والتعامل مع المعضلات الهندسية الشائكة. وأفادت بأن النموذج يبتعد عن المسارات السطحية المختصرة ذات النتائج الرديئة، إذ صُمم لكي يكتشف الجذور العميقة للأعطال البرمجية والعمل على معالجتها جذرياً. ويعتمد الطرازان على النموذج الأساسي نفسه، لكنهما يختلفان في مستوى الضوابط الأمنية وإتاحة الوصول؛ إذ يتوفر «فيبل 5.1» لعموم المستخدمين، في حين يخضع «ميثوس 5.1» لضوابط أمنية مخصصة لدعم العمل الحساس في مجالات الدفاع السيبراني وعلوم الأحياء الجزيئية عبر برامج وصول موثوقة.
خفض التكاليف حتى 45% في المهام الوكيلة
استجابت «أنثروبيك» لطلبات قطاع الأعمال ومطوري التطبيقات بشأن تكاليف الحوسبة السحابية، حيث أقرت تخفيضاً كبيراً في أسعار قراءة السياقات من الذاكرة المؤقتة (Cache Reads) بنسبة بلغت 75 في المئة، ليستقر السعر عند 0.25 دولار لكل مليون رمز، مقارنة بدولار كامل في الإصدار السابق. ونتيجة لذلك، تنخفض التكلفة الإجمالية لتشغيل النموذج بنسبة تقارب 25 في المئة عبر أعباء العمل التقليدية المعتمدة على نظام محاسبة الرموز (Tokens).
من جهة أخرى، ترتفع نسبة التوفير المالي لتصل إلى نحو 45 في المئة عند تشغيل الوكلاء المستقلين في مهام برمجية مكثفة تعتمد على استرجاع السياقات المحفوظة مسبقاً في الذاكرة المؤقتة. وبالمقابل، حافظت الشركة على رسوم المدخلات الأساسية عند 10 دولارات لكل مليون رمز، ورسوم المخرجات عند 50 دولاراً لكل مليون رمز، إلى جانب استقرار رسوم كتابة الذاكرة المؤقتة عند 12.50 دولار لخمس دقائق و20 دولاراً لساعة واحدة. ويحتفظ النموذج بنافذة سياق ضخمة تتسع لمليون رمز، مع قدرة إنتاج مخرجات تصل إلى 128 ألف رمز في الطلب الواحد.
وتتوزع تفاصيل الأسعار المعتمدة للنموذج على النحو التالي:
- رسوم المدخلات الأساسية: 10.00 دولارات لكل مليون رمز، وهو السعر ذاته المعتمد في الإصدار السابق دون تغيير.
- رسوم المخرجات: 50.00 دولاراً لكل مليون رمز، مع سعة قصوى تصل إلى 128 ألف رمز في الاستجابة الواحدة.
- قراءة الذاكرة المؤقتة: 0.25 دولار لكل مليون رمز، وهو خفض يمثل ربع السعر القديم لخدمة الوكلاء المستقلين.
- كتابة الذاكرة المؤقتة لخمس دقائق: 12.50 دولار لكل مليون رمز، مخصصة للجلسات قصيرة الأجل.
- كتابة الذاكرة المؤقتة لساعة واحدة: 20.00 دولاراً لكل مليون رمز، مخصصة للمهام التراكمية الطويلة.
- المعالجة غير الفورية بنظام الدفعات: 5.00 دولارات لمدخلات كل مليون رمز و25.00 دولاراً لمخرجات كل مليون رمز.
أداء Fable 5.1 في أبرز الاختبارات
أظهرت بيانات الاختبارات القياسية التي نشرتها أنثروبيك تفوق طراز «فيبل 5.1» على عدد من النماذج المنافسة في مجموعة واسعة من اختبارات البرمجة والعلوم والاستدلال المنطقي:
- اختبار العلوم الاستقصائية البرمجية (Terminal-Bench-Science 0.1): أحرز النموذج دقة بلغت 52.6 في المئة، مسجلاً نتيجة متقدمة مقارنة بنموذج «فيبل 5» (24.7 في المئة)، ونموذج «أوبوس 5» (29.0 في المئة)، ونموذج «جي بي تي 5.6 سول» (22.4 في المئة).
- اختبار الأوامر الطرفية البرمجية (Terminal-Bench 4.0): نال «فيبل 5.1» نسبة 55.8 في المئة، في حين حقق «ميثوس 5.1» نسبة 60.9 في المئة، ويرتبط الفارق بين النموذجين في هذا الاختبار بتدخلات ضوابط الأمن السيبراني في بعض المهام، متجاوزين «أوبوس 5″ (52.3 في المئة) و»فيبل 5″ (42.0 في المئة) و»جي بي تي 5.6 سول» (37.3 في المئة).
- اختبار امتحان البشرية الأخير (Humanity’s Last Exam): حقق النموذج 60.9 في المئة دون الاستعانة بأدوات مساعدة، وارتفعت النسبة لتصل إلى 65.0 في المئة عند دمج الأدوات الخارجية.
- اختبار البرمجة المعقدة (CursorBench 3.2.0): تصدر النموذج نتائج التقييم بنسبة 73.4 في المئة عند ضبطه على المستوى الأقصى للجهد الاستدلالي، متقدماً على «فيبل 5″ (70.5 في المئة) و»أوبوس 5» (70.0 في المئة).
- اختبار أتمتة العمليات والمهام الإدارية (AutomationBench): سجل النموذج نسبة نجاح بلغت 31.4 في المئة مقارنة بنسبة 17.1 في المئة فقط للإصدار السابق.
- اختبار التحكم في بيئات الحواسيب المكتبية (OSWorld 2.0): بلغت نسبة إنجاز المهام 77.9 في المئة في التقييم الجزئي و41.7 في المئة في التقييم الصارم.
- اختبار الأعمال المعرفية التخصصية (GDPval-AA v2): نال النموذج مجموع 1853 نقطة، مقارنة بنموذج «فيبل 5» (1723 نقطة)، ونموذج «أوبوس 5» (1824 نقطة)، ونموذج «جي بي تي 5.6 سول» (1711 نقطة).
كيف تستخدم الشركات Fable 5.1 في مهام حقيقية؟
عكست التجارب الميدانية لدى الشركات الرائدة كفاءة النموذج في معالجة تحديات تقنية معقدة في بيئات الإنتاج الحقيقية، واستعرضت كبرى المؤسسات نتائج اختباراتها العملية:
Fable 5.1 يعثر على خطأ برمجي ظل غامضًا لسنوات
واجه الفريق الهندسي في صندوق «ميلينيوم» (Millennium) المالي عطلاً برمجياً نادراً يظهر مرة واحدة في كل مليون عملية تشغيل، وهو خلل عجز مهندسو الصندوق وكافة النماذج السابقة عن اكتشافه طوال أربع إلى خمس سنوات. واستطاع «كلود فيبل 5.1» بمفرده فك شفرة مكتبة خارجية ومطابقتها بسجل الانهيار، ثم حدد موضع الخلل بدقة داخل تلك المكتبة، وهو تحليل كان يتطلب وقتاً بشرياً يصعب تبرير كلفته لإنجازه.
Cognition تنقل مهام Devin إلى Fable 5.1
أعلن والدن يان، الشريك المؤسس لمنصة «ديفين» البرمجية التابعة لشركة «كوجنيشن» (Cognition)، بدء نقل العمليات من نموذج أوبوس 5 إلى «فيبل 5.1» فور صدوره، مؤكداً أن خفض أسعار الذاكرة المؤقتة جعل استخدام طرازات فئة فيبل خياراً اقتصادياً ممتازاً لعمليات فحص الشيفرات البرمجية ومراجعتها بصورة مستمرة.
MongoDB تختبر العمل المستقل لساعات
أفاد رون سانزوني، كبير مهندسي البرمجيات في شركة «مونجو دي بي» (MongoDB)، بأن النموذج بنى نموذجاً أولياً معقداً خلال ثلاثة أيام، بعد أن أجرى دراسات شاملة لوثائق الشركة وشيفراتها المصدرية، ثم واصل العمل لساعات دون إشراف مباشر، مع استخدام حلقات تحقق ذاتية قوية أثبتت نجاح البناء البرمجي.
وفي السياق ذاته، كشف جوش بوير، المهندس في شركة «ريد هات» (Red Hat)، أن النموذج شخص بنجاح السبب الجذري لكل خطأ برمجي طرأ على أنظمة البناء في الاختبارات، مضيفاً أن تقارير النموذج أصبحت أكثر تركيزاً وسهولة في الاستيعاب. وصرح داني وو، رئيس قطاع الذكاء الاصطناعي في شركة «كانفا» (Canva)، بأن النموذج صمم لعبة إيقاعية موسيقية متكاملة تتطابق فيها عناصر اللعب مع النغمات الموسيقية بدقة، وهو إنجاز تفوق فيه على بقية النماذج التي خضعت للتجربة.
إضافة إلى ذلك، أشارت مؤسسات مالية وبحثية أخرى، مثل «جين ستريت» و»راكوتن ميديكال» و»بلوك» و»شوبيفاي»، إلى تحسن ملحوظ في كفاءة استهلاك الرموز، ووضوح سلاسل الاستدلال في المهام المالية والبرمجية الطويلة دون فقدان خيوط السياق، والقدرة على صياغة فرضيات سريرية جديدة تدعم استكشاف مجموعات البيانات المعقدة.
من تصميم البروتينات إلى خرائط كوكب الزهرة
امتدت اختبارات الطراز الجديد لتشمل مجالات بحثية واعدة، عكست مؤشرات مبكرة حول دور نماذج الاستدلال في دعم الاستكشاف العلمي والتطبيقي:
تصميم بروتينات واعدة للاختبارات التجريبية
خاض طراز «ميثوس 5.1» تجارب تصميم بروتينات رابطة ذات ألفة كيميائية عالية تستهدف مواقع حيوية في الجسم. وأظهرت الاختبارات المعملية الأولية التي أجرتها جهات مستقلة نجاح تصميمات النموذج بنسبة قاربت 50 في المئة عبر 12 هدفاً حيوياً، مقارنة بنسب تتراوح بين 10 و15 في المئة عادة في هذا المجال. وعلى ثلاثة أهداف حيوية، تجاوزت قوة ارتباط بعض التصاميم أفضل التصاميم المقدمة إلى مسابقات منصة «أدابتيف بايو» (Adaptyv Bio) بنحو عشرة أضعاف.
ذكاء اصطناعي يرسم خريطة أدق لثلث كوكب الزهرة
درّب طراز «فيبل 5.1» شبكة عصبية اصطناعية لإنتاج خريطة تضاريس ثلاثية الأبعاد تمتد عبر ثلث مساحة كوكب الزهرة، اعتماداً على تسجيلات رادارية التقطتها مركبة «ماجلان» التابعة لوكالة ناسا قبل أكثر من ثلاثين سنة. وأصبحت الخريطة تكشف تفاصيل سطحية بدقة تتراوح بين كيلومترين وثلاثة كيلومترات، مقارنة بنحو 10 إلى 20 كيلومتراً في الخرائط السابقة، مع تحسين دقة قياس الارتفاعات بنسبة 25 في المئة. وطرحت أنثروبيك هذه الخريطة تحت رخصة المشاع الإبداعي، وقد تسند هذه البيانات الأبحاث المرتبطة بمهام استكشافية قادمة مثل مهمة «فيريتاس» (VERITAS) ومهمة «إنفيجن» (EnVision) الأوروبية.
تسريع نماذج البيولوجيا الحاسوبية حتى 2.5 مرة
صاغ «ميثوس 5.1» أكواداً برمجية مخصصة لمعالجات الرسوميات (GPU Kernels) مع تخزين النتائج المرحلية مؤقتاً، ليقود ذلك إلى مضاعفة سرعة تشغيل سبعة نماذج تعلم عميق مفتوحة المصدر (بينها Enformer وEvo 2 وFlashzoi) بمقدار وصل إلى 2.5 ضعف سرعتها السابقة مع الحفاظ على تطابق المخرجات بدقة.
أبرز التحديثات للمطورين في Claude API
تضمن التحديث الجديد تغييرات برمجية حاسمة تفرض على المطورين تعديل بعض أساليب التكامل القديمة لضمان استقرار التطبيقات:
- إلغاء الاستدعاء القسري للأدوات الخارجية: يرفض النموذج أي طلب برمجي يتضمن خيار (tool_choice: «any») أو يفرض أداة معينة إجبارياً، فيصدر النظام إشعار خطأ صريح برمز (400). وجاء هذا التعديل لأن آلية التفكير التكيفي (Adaptive Thinking) تظل نشطة دوماً في هذا الطراز، بينما يؤدي الفرض القسري للأداة إلى تجاوز خطوات التفكير والتأثير سلباً على جودة المخرجات.
- انقطاع قراءة كتل التفكير عبر الأجيال القديمة: تسجل كل كتلة استدلالية هوية النموذج الذي أنشأها؛ ويستطيع «فيبل 5.1» قراءة كتل التفكير التابعة للإصدارات السابقة، في حين تعجز النماذج القديمة عن قراءة كتل التفكير الصادرة عن هذا الطراز.
وفي المقابل، وفرت أنثروبيك حزمة من الخصائص التقنية لتبسيط بناء التطبيقات والتحكم في النفقات:
- تعديل الجهد الفكري أثناء المحادثة (Per-message effort): يستطيع المطور تغيير مستوى الجهد الاستدلالي أثناء الجلسة الواحدة عبر ضبط إعدادات المخرجات، لكي يرفع الجهد في الخطوات المعقدة ويخفضه في الخطوات البسيطة دون المساس بسياق الذاكرة المؤقتة.
- رسائل النظام محددة الأجل (Turn-scoped system messages): خاصية تسمح بإرسال تعليمات إرشادية تنتهي فاعليتها فور تسجيل رد المستخدم التالي (clear_at: «next_user_message»). وتكفل هذه الميزة إرسال توجيهات فورية لوكلاء البرمجة دون الحاجة إلى حذفها يدوياً وتخريب الذاكرة المؤقتة.
- إظهار مستجدات التقدم اللحظية (Progress updates): خاصية تسمح بتفعيل خيار (display: «updates») لتلقي تنبيهات نصية موجزة تعرض الإنجازات والخطوة التالية أثناء تنفيذ دورات العمل الطويلة، مع إبقاء نصوص الاستدلال الداخلي مخفية لحماية المنطق البرمجي.
قيود جديدة لمنع استخراج قدرات Claude
تأتي هذه القيود ضمن آليات أنثروبيك للحد من محاولات الاستخلاص غير المصرح به لقدرات النموذج (Anti-Distillation)؛ حيث يمنع النظام تعديل الرسائل أو التعليمات السابقة يدوياً مع الاحتفاظ بسجلات التفكير. ويؤدي تغيير أي نص يسبق كتل التفكير إلى رفض الطلب فوراً برسالة خطأ توضح ارتباط تلك الكتل بسياق محادثة مختلف. وتسري هذه القاعدة في مرحلتها الأولى على الحسابات الجديدة المنشأة عبر واجهة التطبيقات، مع خطة للتطبيق التدريجي لاحقاً دون التأثير الفوري على الحسابات القائمة.
ضوابط أمنية جديدة دون التضحية بالخصوصية
تقدم أنثروبيك ضوابط مؤسسية جديدة تحت اسم «ضوابط الحدود المؤسسية» (Enterprise Frontier Safeguards)، صُممت لتوفير بيئات أكثر تحكماً للجهات التي تحتاج إلى تشغيل النماذج في سياقات حساسة، حيث تضمن للعملاء خصوصية مطابقة لسياسة عدم الاحتفاظ بالبيانات (Zero Data Retention)، مع إبقاء بياناتهم داخل بنية سحابية تقع تحت إشرافهم بالكامل عبر منصات «أمازون وب سيرفيسز»، و»جوجل كلاود»، و»مايكروسوفت آژور»، ومن المقرر بدء إتاحتها تدريجياً خلال فصل الخريف.
وفي هذا الإطار، حسنت الشركة دقة الفلاتر الأمنية لتقليص الاعتراضات الخاطئة في مهام الأمن السيبراني بنسبة 60 في المئة، بما يتيح للمتخصصين الاستعانة بنموذج «فيبل 5.1» في اكتشاف الثغرات البرمجية وسدها، مع استمرار حظر تطوير أدوات الاختراق أو الأكواد الهجومية.
Mythos 5.1: النسخة الأكثر تقييدًا للمهام الحساسة
يتوفر طراز «ميثوس 5.1» عبر برنامجين مخصصين للوصول الموثوق: أحدهما للدفاع السيبراني (Cyber Verification Program)، والآخر للمتخصصين في علوم الحياة (Life Sciences Verification Program)، وقد طورت أنثروبيك برنامج علوم الحياة بالشراكة مع حكومة الولايات المتحدة. ويضمن هذا التخصيص إتاحة أعلى مستويات الاستدلال للباحثين والخبراء المعتمدين، مع الحفاظ على أعلى معايير السلامة والرقابة في المجالات الحيوية.
هل يقود Fable 5.1 مسار التحول نحو الوكلاء المستقلين؟
تبرهن نتائج الاختبارات وتجارب الشركاء الميدانية على أن إطلاق طرازي «فيبل 5.1″ و»ميثوس 5.1» يمثل خطوة متقدمة نحو تمكين الوكلاء البرمجيين من قيادة مشاريع طويلة الأمد باستقلالية وكفاءة عالية. ومع الجمع بين التفكير التكيفي المستمر، وخفض تكاليف الذاكرة المؤقتة بنسبة 75 في المئة، ودقة النتائج في البرمجة والعلوم، تكتسب المؤسسات أدوات قوية لتسريع وتيرة الإنتاج وإنجاز مهام معقدة كانت تستهلك أسابيع من الجهد الهندسي المتواصل.
ويرى المراقبون أن الدمج بين الأداء الرفيع والضوابط الأمنية الدقيقة يمنح «أنثروبيك» موقعاً تنافسياً متميزاً في قيادة الجيل القادم من وكلاء الذكاء الاصطناعي الموجهين لخدمة القطاعات الإنتاجية والبحثية الحيوية.




