Devordagi nam dog’ga duch kelgan ikki dasturchini tasavvur qiling. Biri ustidan bo’yab, ticketni yopadi. Ikkinchisi dog’ni kuzatib, suv sizayotgan quvurni topadi, quvurni tuzatadi va keyin qo’shni xonani ham tekshiradi. Claude Opus 5 ikkinchi dasturchi bo’lish uchun yaratilgan.
Relizdagi ushbu baholash endi Terminal-Bench 3.0 deb ataladi. Anthropic dastlab 43.3% ni e’lon qilgan; hozirgi ochiq jadval Opus 5 uchun taxminan 42.7%, keltirilgan GPT-5.6 Sol konfiguratsiyasi uchun 34.6% ko’rsatadi. Suratlar bir oz farq qiladi, ammo ikkalasi ham bitta saboqni beradi: Opus notanish terminal ishlarida g’ayrioddiy darajada kuchli.
Bir misol bu son ortidagi xarakterni tushuntiradi. Bevosita ko’ra olmaydigan chizma asosida mashina detalini qayta qurish so’ralganda, Opus 5 o’z vision pipeline ini yozdi, piksellardan geometriyani ajratdi va detalni FreeCAD da yaratdi. Boshqa vazifada paket menejeri xatosining ildiz sababini topib, hamjamiyat yamog’i o’tkazib yuborgan chekka holatni ham tuzatdi. Bular vendor misollari, tabiatning mustaqil qonunlari emas, lekin Anthropic nimani sozlaganini ko’rsatadi: dalillar mos kelguncha tekshirishni davom ettirish.
Nega u Fable 5 dan yuqoriga ko’tariladi
Fable ayrim finish suratlarida hanuz g’olib. FrontierCode da u 53.5%, Opus 5 esa 53.4%; maksimal CursorBench 3.2 bali ham qariyb yarim ball yuqori. Ammo reyting o’nli kasrlar muzeyi emas, xarid qaroridir. Opus 5 million kirish/chiqish tokeniga $5/$25 turadi — Fable ning $10/$50 narxidan aynan ikki baravar arzon — Fable dagi umumiy ma’lumot saqlash talabini qo’ymaydi va kamroq cheklovchi klassifikatorlarga ega. Natija deyarli teng bo’lsa, narx va deploy qulayligi ham unumdorlikning bir qismidir.
Mustaqil signal kuchaydi. Artificial Analysis v4.1.1 Opus 5 ga Intelligence Index da qariyb 63 va birinchi o’rin, Coding Agent Index da esa taxminan 78.0 beradi. O’sha sinov muhim ogohlantirishni ham saqlaydi: max effort juda ko’p token yaratishi mumkin.
Nega u #1 o’ringa ozgina yetmaydi
GPT-6 Astra DeepSWE v1.1 da 74.1% bilan Opus 5 ning 73.7% natijasidan sentabr jadvallarida oldinda, ustiga Terminal-Bench 4.0 da 57.9% va bozordagi eng yaxshi kompyuter foydalanishi. Artificial Analysis Astra ishga tushirilishi bilan dasturlash agentlari jadvalini qayta masshtabladi (Fable 5.1 taxminan 70, Astra 67), demak Opus davrining eski raqamlari qiyoslanadigan kataklar emas. Bizning #1 baribir Astra ga Codex, samaradorlik va bajarish qiymati bo’yicha qo’shimcha mezon bilan beriladi — u Opus dan aniq yaxshiroq kod yozgani uchun emas.
Vazifani shunday yo’naltiring:
| Vazifa | Eng yaxshi boshlanish nuqtasi |
|---|---|
| Noaniq xato, ildiz sabab izlash, ko’p faylli o’zgarish, frontendni vizual tekshirish | Opus 5 |
| Tezlik, yakunlangan vazifa narxi va bajarish eng muhim bo’lgan terminal ishi | GPT-6 Astra |
| Budjet ikkinchi o’rinda turadigan eng yuqori CursorBench/FrontierCode vazifasi | Fable 5 |
| Narx chegarasi qat’iy bo’lgan oddiy ticketlar | Avval past effort, keyin zarur bo’lsa oshiring |
Yangilash yo’li g’ayrioddiy darajada qulay. Opus 5 1M kontekst oynasi, 128k maksimal chiqish, vision, PDF, prompt caching, batch processing va Claude vositalarini saqlaydi. Fikrlash adaptiv va standart yoqilgan; effort low dan max gacha boradi. Mavjud Opus 4.8 promptlari asosan ko’chishi kerak, ammo API web fetch va Priority Tier reliz paytida mavjud emasligini unutmaslik kerak.
Xulosa oddiy: Opus 5 Opus 4.8 ni to’liq almashtiradi va kundalik production hajmida Fable 5 ni oqlashni qiyinlashtiradi. Fable ayrim tor yo’nalishlarda ustun qimmat mutaxassis bo’lib qoladi. Opus 5 ni esa ko’proq muhandisga, ko’proq vazifada va uzoqroq muddatga bera olasiz — uning mulohazasini qimmatli qiladigan tekshiruv sikliga ham pulingiz yetadi.