يتوّج GPT-6 Astra عرش البرمجة بالطريقة الصادقة نفسها التي تمسك بها GPT-5.6 بالتاج: بإنجاز العمل ذي الطابع الوكيلي — جلسات الطرفية، وخطوط الأنابيب المتعثرة، وتحليل الحوادث، وإعداد بيئة العمل بالكامل — مدعومًا الآن بتصدره الجديد لمنصة Code Arena التابعة لـ Arena.ai (بـ 1797 نقطة في WebDev) مع استهلاك نحو ثلث رموز Sol.
تصدر المركز الأول الجديد في منصة Code Arena التابعة لـ Arena.ai في مسار WebDev بـ 1797 نقطة (بفارق +35 نقطة عن Claude Fable 5.1 Max عند 1762، و+109 عن Opus 5 Max عند 1688، و+180 عن Sol في المركز 13)، متصدرًا فئات تحليل البيانات، والمنتجات الاستهلاكية، وأدوات إنشاء المحتوى. بالإضافة إلى 57.7–57.9% على Terminal-Bench 4.0 (مقابل 55.8% لـ Fable 5.1)، وأفضل نتيجة بالجدول على DeepSWE v1.1 بـ 74.1%، و64.6% على Terminal-Bench Science، و88% pass@1 / 99.2% pass@4 على SRE-Bench، و100% على ExploitBench. ورغم أن منصة Artificial Analysis الخاصة تضع Fable 5.1 متقدمًا قليلًا (70 مقابل 67)، يعيد Astra رسم حدود كفاءة باريتو عند 40 دولارًا لكل مليون رمز مدمج ويستهلك نحو ثلث رموز Sol.
حتى مع تتويجه بالمركز الأول في Code Arena لتطوير الويب وأدوات المنتجات، ما زال Fable 5(.1) يحمل الرقم القياسي في SWE-Bench Pro ويتصدر مؤشر Artificial Analysis الخاص بوكلاء البرمجة (70 مقابل 67). سعر API يعادل 2.5 ضعف Sol عند 10/50 دولارًا، وقراءة الذاكرة المؤقتة تكلف أربعة أضعاف الـ 0.25 دولار لدى Fable 5.1، والإجابات المقتضبة تتخطى خطوات صقل التقارير، والضمانات السيبرانية الأقوى تزيد الاحتكاك في العمل القريب من اختبار الثغرات. جداول الإطلاق تحركت بعد النشر: تعامل مع أي رقم منفرد بهامش ±1–2 نقطة.