GPT-5.6 занимает первое место в кодинге, потому что Sol выигрывает широкую гонку кодовых агентов, а не каждый отдельный экзамен. Sol закрывает сложную проблему, Terra — ежедневный инженер за половину цены Sol за токен, Luna — работник для пакетов. Max, параллельные агенты Ultra, Programmatic Tool Calling и более сильная поверхность Codex дают OpenAI команду, а не одну футболку.
Sol с максимальным уровнем рассуждений получает 80 в сравнении OpenAI по Artificial Analysis Coding Agent Index, опережая Claude Fable 5; Sol набирает 88,8% на Terminal-Bench 2.1, Sol Ultra — 91,9%, а Sol — 72,7% на DeepSWE. Programmatic Tool Calling уменьшает накладные расходы оркестрации, а Sol, Terra и Luna дают понятную лестницу API: $5/$30, $2/$12, $0,20/$1,20.
Это лидерство в агентном кодинге, а не монополия: Claude Fable 5 всё ещё получает 80,3% против 64,6% Sol в опубликованном сравнении SWE-Bench Pro. Ultra повышает расход токенов и зависит от тарифа. Киберзащита может создавать трение для оборонительных и exploit-подобных запросов; каждый график всё равно надо проверить на вашем репозитории, тестах и правилах развёртывания.