الترتيب #3 المنظومة اليومية — مساعدات الذكاء الاصطناعي الرائدة
Anthropic

كلود فابل 5.1

نفس أوزان نموذج Mythos 5.1 الحصري، ولكن مع طبقة الأمان التي يحصل عليها معظم المستخدمين بالفعل. إنه النموذج الذي تنصحك شركة Anthropic باستخدامه عندما يفشل Opus 5 بالجهد العالي في تقييماتك الخاصة — البرمجة طويلة الأمد، والبحث لعدة ساعات، والمستندات التي يجب أن تظل متماسكة.

ReasoningLong-ContextAgentic
الأفضل لـ

نفس أوزان نموذج Mythos 5.1 الحصري، ولكن مع طبقة الأمان التي يحصل عليها معظم المستخدمين بالفعل. إنه النموذج الذي تنصحك شركة Anthropic باستخدامه عندما يفشل Opus 5 بالجهد العالي في تقييماتك الخاصة — البرمجة طويلة الأمد، والبحث لعدة ساعات، والمستندات التي يجب أن تظل متماسكة.

لماذا تفوز

مؤشر ذكاء Artificial Analysis بلغ 66 عند الجهد الأقصى (الأعلى قياساً عند الإطلاق). تفوق في GDPval-AA v2 بـ 1853. خفض تكلفة قراءة الذاكرة المؤقتة (الـ Cache) بنسبة 75% لتصبح 0.25 دولار/مليون رمز — وهذا هو التغيير الحقيقي في السعر. سياق بمليون رمز، مخرجات بـ 128 ألف رمز، وتفكير تكيفي نشط دائمًا.

انتبه إلى

السعر الأساسي لا يزال 10/50 دولارًا — أي ضعف Opus 5. الجهد الأقصى يكلف 3.76 دولار/للمهمة مقابل 2.34 دولار لـ Opus لأنه يكتب رموزًا أكثر بنسبة 1.7×. الجهد الأقصى قد يؤدي إلى تعديل مفرط (Over-Editing). إنه نموذج مغطى (Covered Model) مع احتفاظ بالبيانات لـ 30 يومًا. لا توجد قدرة أصلية على توليد الصور.

01

ما هو في الواقع

إذا كان Opus 5 هو حصان العمل الموثوق الذي تعتمد عليه في 90% من عملك المعرفي اليومي، فإن Fable 5.1 هو المتخصص الذي توظفه للـ 10% المتبقية التي تُبقيك مستيقظًا في الليل حقًا. لا تقدم Anthropic بنية معمارية جديدة تمامًا هنا؛ Fable 5.1 هو إصدار نقطي (Point Release) يعمل على تشديد مصنفات الأمان على نموذج Fable 5 الأصلي، والأهم من ذلك أنه يخفض تكلفة التخزين المؤقت للسياق بشكل جذري. فهو يشارك نفس الأوزان مع نموذج Mythos 5.1 المقيد بشدة، ولكنه يأتي مع طبقة الأمان التي تجعله متاحًا لعامة الناس.

قفزة القدرات حقيقية، لكنها تُقاس بالقدرة على التحمل بدلاً من قمم الأداء الخام. احتل Fable 5.1 المركز الأول في مؤشر ذكاء Artificial Analysis عند الإطلاق بدرجة 66 عند الجهد الأقصى، متفوقًا على Opus 5 (63) و GPT-5.6 Sol (61). كما حقق درجة مهيمنة بلغت 1853 على GDPval-AA v2. لكن التغيير الأهم لا يكمن في الشبكة العصبية، بل في صفحة التسعير. في حين تظل التكاليف الأساسية للرموز عند سعرها المتميز 10/50 دولارًا، فقد تم تخفيض أسعار قراءة الذاكرة المؤقتة بنسبة 75% لتصل إلى 0.25 دولار لكل مليون رمز. بالنسبة لسير العمل الذي يعتمد على نافذة سياق ساخنة بمليون رمز — مثل الاستعلام عن قواعد تعليمات برمجية ضخمة أو تجميع مئات المستندات — فإن هذا يغير بشكل جذري اقتصاديات استخدام نموذج التفكير المتطور.

ومع ذلك، فإن استخدام Fable 5.1 ليس مجانيًا. يتميز النموذج بتفكير تكيفي يعمل دائمًا، مما يعني أنه سيستمر في معالجة المشكلة حتى يشعر بالرضا. النتيجة هي تعطش شديد للرموز؛ يكتب Fable 5.1 حوالي 1.7 ضعف الرموز لكل مهمة مقارنة بسلفه. على Artificial Analysis، يكلف الجهد الأقصى 3.76 دولارًا لكل مهمة مقارنة بـ 2.34 دولار لـ Opus 5. ومن المفارقات أن بذل المزيد من الجهد لا يعني دائمًا نتائج أفضل. تكشف بطاقة النظام أن الجهد الأقصى يمكن أن يؤدي إلى “تعديل مفرط” (Over-editing) — مثل إضافة وثائق غير ضرورية، أو إجراء تعديلات عابرة للملفات، أو وظائف CI معقدة حيث كان من الممكن أن يفي إصلاح بسيط بالغرض.

وهناك أيضًا الحقائق التشغيلية للنموذج المغطى (Covered Model). يحتفظ Fable 5.1 ببياناتك لمدة 30 يومًا ما لم تكن لديك اتفاقيات ضمانات الحدود المؤسسية (EFS) أو الاحتفاظ بالبيانات بصفر (ZDR). علاوة على ذلك، تظل مصنفات الأمان صارمة. فبينما يمكن للنموذج تحديد الثغرات الأمنية في شفرتك البرمجية، إلا أنه سيرفض كتابة عمليات استغلال (Exploits)، والاستعلامات المعقدة لأبحاث علم الأحياء ستؤدي بصمت إلى التوجيه التلقائي لنموذج Opus. وإذا كنت تضغط بشكل متكرر على واجهة برمجة التطبيقات (API) بسياق بارد بمليون رمز، فإن القراءات الباردة بتكلفة 10 دولارات/مليون رمز ستعاقب حدود استخدامك بسرعة.

إن نصيحة التوجيه الخاصة بشركة Anthropic هي أفضل ملخص لمكانة Fable 5.1 في النظام البيئي: ابدأ باستخدام Opus 5. ولكن عندما يفشل Opus في تقييماتك الخاصة — عندما تتعامل مع بحث يستغرق ساعات طويلة، أو مهام برمجة طويلة الأمد، أو مستندات معقدة يجب أن تحافظ على تماسك صارم — فإن Fable 5.1 هو خط الدفاع الأقدر في العالم. إنه النموذج الذي تدفع مقابلًا إضافيًا من أجله عندما يكون إنجاز المهمة بالشكل الصحيح من المرة الأولى هو الشيء الوحيد الذي يهم.

02

نقاط القوة والقيود بصراحة

نقاط القوة الرئيسية

  • مؤشر ذكاء AA بلغ 66: عند الإطلاق، احتل Fable 5.1 المركز الأول في مؤشر ذكاء Artificial Analysis بدرجة 66 عند الجهد الأقصى، متفوقًا على Opus 5 و GPT-5.6 Sol.
  • خصم هائل على قراءة الذاكرة المؤقتة: بينما يظل السعر الأساسي مرتفعًا، تم خفض قراءات الذاكرة المؤقتة بنسبة 75% إلى 0.25 دولار/مليون رمز. بالنسبة لسير العمل الذي يعتمد على سياق ساخن بمليون رمز، هذا الخفض يغير قواعد اللعبة تمامًا.
  • تفكير تكيفي نشط دائمًا: يتميز النموذج بتفكير تكيفي يعمل دائمًا، مما يمنحه الوقت الذي يحتاجه للتفكير في المشكلات المعقدة متعددة الخطوات التي تُسقط نماذج التمرير الواحد.
  • إتقان للمهام طويلة الأمد: مع سياق يبلغ مليون رمز وحدود مخرجات تصل إلى 128 ألف رمز، فإنه يتعامل مع مهام البحث التي تستغرق ساعات طويلة ومعالجة المستندات الضخمة مع الحفاظ على التماسك بشكل أفضل من أي منافس.
  • رائد الذكاء المركب: على الرغم من تقدم Astra في فئات محددة مثل استخدام الكمبيوتر والرياضيات، إلا أن Fable 5.1 يحتفظ بالتاج للذكاء المركب والتقييم على المستوى البشري (HLE).

قيود صادقة

  • التعطش للرموز والتكاليف الأعلى: يكتب Fable 5.1 حوالي 1.7× رموز أكثر من Fable 5. على Artificial Analysis، يكلف الجهد الأقصى 3.76 دولار/للمهمة مقارنة بـ 2.34 دولار لـ Opus 5. خفض تكلفة الذاكرة المؤقتة يساعد، لكنه ليس مجانيًا تمامًا.
  • تعديل مفرط عند الجهد الأقصى: التفكير أكثر لا يعني دائمًا الأفضل. تكشف بطاقة النظام أن الجهد ‘المتوسط’ غالبًا ما يتفوق على الجهد ‘الأقصى’ في هندسة البرمجيات لأن الجهد الأقصى يضيف تعديلات عابرة للملفات ومستندات إضافية ووظائف CI غير ضرورية.
  • قيود النموذج المغطى (Covered Model): يعمل Fable 5.1 كنموذج مغطى مع احتفاظ بالبيانات لمدة 30 يومًا (ما لم يتم استخدام EFS/ZDR). بينما يبقى Mythos 5.1 غير المقيد متاحًا فقط للوصول الموثوق.
  • لا تزال مصنفات الأمان تقيد الاستخدام المزدوج: يمكن للنموذج العثور على الثغرات الأمنية ولكنه لن يكتب عمليات استغلال (Exploits). إذا توغلت في أبحاث علم الأحياء، فسيقوم نظام الأمان بتوجيهك تلقائيًا إلى Opus.
  • عقوبة الذاكرة المؤقتة الباردة: تعاقب حدود استخدام كلود المستخدمين الذين يقومون بشكل متكرر بتحميل سياق بارد بمليون رمز. يُطبق السعر الكامل البالغ 10 دولارات/مليون رمز على القراءات الباردة، مما يستنزف حدود الاستخدام بسرعة.
03

لمحة عن المعايير

مؤشر ذكاء Artificial Analysis — 66 (الحد الأقصى)

الأعلى قياسًا عند الإطلاق، متقدمًا على Opus 5 (63) و GPT-5.6 Sol (61).

GDPval-AA v2 — 1853

يتفوق على Fable 5 (1723) و Opus 5 (1824).

أدوات HLE — 65.0%

يتصدر المجموعة في التقييم على المستوى البشري مع الأدوات، متفوقًا على Opus 5 (63.6%) و Astra (57.2%).

Signal65 PINNACLE — 7,898

أكمل 276/280 مهمة وكيل (Agent)؛ 2.46 دولار لكل مهمة صحيحة.

04

الحكم

كلود فابل 5.1 ليس عائلة جديدة — إنه تحديث دقيق لـ Fable 5 يخفض تكاليف قراءة الذاكرة المؤقتة بشكل كبير ويشدد من مصنفات الأمان. بينما تنص قاعدة Anthropic الخاصة على ‘البدء مع Opus 5’، فإن Fable 5.1 هو المتخصص من العيار الثقيل الذي تستدعيه عندما يفشل Opus. الدرجة 66 في مؤشر ذكاء Artificial Analysis تثبت قدرته الخام، وخصم 75% على قراءة الذاكرة المؤقتة يجعل سير العمل ذو السياق الطويل قابلاً للتطبيق. لكن السعر الأساسي المرتفع وتعطشه للرموز والتوجيه الأمني الصارم يعني أنه ليس للمحادثات اليومية. استخدمه عندما يتطلب العمل بحثًا لعدة ساعات، أو برمجة معقدة، أو توليدًا متماسكًا عبر سياق بمليون رمز، وتكون مستعدًا لدفع القسط الإضافي لأذكى وكيل في الغرفة.