Devordagi nam dog‘ni ko‘rgan ikki ustani tasavvur qiling. Biri dog‘ ustidan tezda bo‘yoq surtadi va ishni yopadi. Ikkinchisi esa suv sizayotgan quvurni topadi, uni tuzatadi va namlik qo‘shni xonaga o‘tmaganini ham tekshiradi. Claude Opus 5 kod yozishda ikkinchi usta kabi ishlashga intiladi.
Shu sababli relizning asosiy soni — Frontier-Bench v0.1’dagi 43,3%. Baholash agentdan terminal va vositalar orqali notanish muhandislik ishlarini hal qilishni so‘raydi. Anthropic taqqoslashida GPT-5.6 Sol 34,4%, Fable 5 33,7%, Opus 4.8 21,1% olgan. Opus 5 shunchaki 4.8 o‘rnini bosmaydi; uning natijasini deyarli ikki baravar qiladi.
Bir misol uning xarakterini ko‘rsatadi. Ko‘ra olmaydigan chizma asosida mexanik detalni tiklash so‘ralganda, Opus 5 o‘z vision pipeline’ini yozdi, piksellardan geometriyani chiqardi va detalni FreeCAD’da qurdi. Boshqa vazifada bug’ning ildiz sababini va hamjamiyat patch’i o‘tkazib yuborgan chekka holatni topdi. Bular vendor misollari, tabiat qonuni emas, ammo sozlash maqsadi aniq: dalillar bir-biriga mos kelguncha tekshirish.
Nega Fable 5 dan yuqori
Fable ayrim foto-finishlarni yutadi: FrontierCode’da 53,5% ga 53,4% va maksimal CursorBench’da yarim punktga yaqin ustunlik. Lekin reyting o‘nli kasrlar muzeyi emas, xarid qarori. Opus 5 million token uchun $5/$25, Fable’dan aynan ikki baravar arzon; umumiy data retention talab qilmaydi va kamroq cheklovchi klassifikatorlarga ega.
Artificial Analysis ilk mustaqil signalni berdi: max’da 61 va birinchi o‘rin. High 59, xhigh 60. Ogohlantirish ham muhim: max juda ko‘p token chiqardi. Tugmani tuzatish uchun roman yozsa, yarim narxli model ham to‘liq hisob chiqaradi.
Nega baribir #1 emas
GPT-5.6 Sol DeepSWE v1.1’da 72,7% bilan yetakchi; Fable 69,7%, Opus 5 esa 68,8% olgan. Ammo Artificial Analysis’ning bevosita taqqoslashida Opus 5 bilan ishlaydigan Claude Code va GPT-5.6 Sol bilan ishlaydigan Codex umumiy Coding Agent Index’da bir xil — 67 ball oladi. Durang ichidagi farq muhimroq: GPT DeepSWE va Terminal-Bench’da yutadi, vazifalarni tezroq va arzonroq tugatadi; Opus esa repozitoriyni tushunish testida kuchliroq. Shuning uchun biz GPT-5.6 ga birinchi o‘rinni tezlik, xarajat va terminal vazifalari bo‘yicha tor qo‘shimcha mezon bilan berdik — u Opus 5 dan hamma kodlash ishida aniq ustun bo‘lgani uchun emas.
Amaliy taqsimot oddiy: noaniq xato, ildiz sababni topish, katta ko‘p faylli o‘zgarish va interfeysni ko‘z bilan tekshirish uchun Opus 5; tezlik va yakunlangan vazifa narxi muhim bo‘lgan terminal ishlari uchun Sol; tor sohadagi kichik ustunligi ikki baravar narxga arzigandagina Fable.
Migratsiya 1M kontekst, 128k chiqish, vision, PDF, caching, batch va Claude vositalarini saqlaydi. Adaptiv fikrlash standart yoqilgan. Faqat web fetch va Priority Tier yo‘q. Opus 5 Opus 4.8’ni to‘liq almashtiradi va kundalik hajmda Fable’ni oqlashni qiyinlashtiradi.