تحديث 25 يوليو: أصبح Claude Opus 5 أعلى من Fable 5 في ترتيبنا. يحافظ Fable على انتصارات قصوى ضيقة في FrontierCode وCursorBench وHLE بلا أدوات واختبار قانوني، لكن Opus 5 يقود اختبارات أوسع للوكلاء والعمل المهني بنصف السعر وقيود أقل. يحفظ النص أدناه أدلة إطلاق Fable في يونيو؛ اقرأ صيغه المطلقة ضمن ذلك السياق التاريخي.
إذا كان Opus 4.8 هو الترقية، فإن Fable 5 هو المكتب الزاوي. تحوّل Anthropic في التسمية من الطبقات الموسيقية (Haiku، Sonnet، Opus) إلى الأدبية (Fable، Mythos) ليس مجرد علامة تجارية — إنه يشير إلى فئة جديدة من النماذج. Fable 5 يعمل على نفس بنية فئة Mythos التي تشغّل Mythos 5 المقيّد، لكن مع مُصنّفات أمان تجعله آمناً للاستخدام العام. تخيّله كسيارة رياضية خارقة مع محدّد سرعة — لا تزال أسرع شيء على الطريق، فقط مع حواجز حماية عند منعطفات معينة.
الأرقام تروي القصة. SWE-Bench Pro 80.3% لا يتفوق فقط على GPT-5.5 (58.6%) — بل يُحرج الميدان بأكمله. FrontierCode Diamond عند 29.3% يعني أن Fable 5 يكتب كوداً بجودة إنتاجية بكفاءة تفوق GPT-5.5 (5.7%) بخمس مرات. على Hebbia Finance Benchmark — استدلال مستندات متقدم، قراءة رسوم بيانية، تحليل أسباب جذرية — هو رقم 1. وعلى CursorBench، فتح “فئة من المشاكل طويلة الأفق كانت بعيدة المنال عن النماذج السابقة.”
لكن العروض الأكثر دلالة ليست معايير. Stripe هاجرت قاعدة أكواد Ruby من 50 مليون سطر في يوم واحد — عمل كان سيستغرق فريقاً كاملاً شهرين. النموذج أتمّ Pokémon FireRed باستخدام لقطات شاشة خام فقط — بدون خرائط، بدون أدوات مساعدة، بدون بيانات حالة اللعبة. وعندما مُنح ذاكرة مستمرة معتمدة على الملفات أثناء لعب Slay the Spire، تحسّن أداؤه بمقدار 3× أكثر من Opus 4.8.
قصة الأمان تستحق الفهم. الاستعلامات التي تمسّ الأمن السيبراني أو البيولوجيا أو الكيمياء أو تقطير النماذج تُحوَّل تلقائياً إلى Opus 4.8 — لا يزال نموذجاً من الطراز الأول، لكنه ليس بنية Mythos الكاملة. يحدث هذا في أقل من 5% من الجلسات، وAnthropic تعترف ببعض الإيجابيات الخاطئة على استعلامات غير ضارة. إنه ثمن إطلاق نموذج بهذه القدرة بسرعة وأمان. Mythos 5 غير المقيّد محجوز للشركاء المعتمدين عبر Project Glasswing — حيث يساعد بالفعل في الدفاع عن البنية التحتية البرمجية الحيوية.
السؤال الحقيقي هو ما إذا كان السعر يستحق. بسعر $10/$50 لكل مليون رمز، يكلّف Fable 5 تقريباً 2× ما يكلّفه Opus 4.8. لكن كفاءة الرموز تعوّض جزئياً — تحقيق نتائج رائدة على FrontierCode بجهد متوسط يعني حوسبة أقل لكل مهمة. للمحترفين الذين وقتهم أثمن من فاتورة API، المعادلة بسيطة. لبقية الناس، Opus 4.8 يظل ممتازاً. لكن إن أردت أفضل نموذج ذكاء اصطناعي متاح للعموم على الكوكب — النموذج الذي يتسع فيه الفارق كلما ازدادت المهمة صعوبة — هذا هو.