GPT-5.6 prend la tête du code parce que Sol gagne la course large des agents de programmation, pas parce qu'il gagne chaque examen. Sol clôt les problèmes difficiles; Terra est l'ingénieur quotidien à la moitié du prix par token de Sol; Luna traite les lots. Avec max, les agents Ultra parallèles, Programmatic Tool Calling et une surface Codex plus forte, OpenAI livre une équipe de code, pas un seul maillot.
Sol avec raisonnement max obtient 80 dans la comparaison OpenAI de l'Artificial Analysis Coding Agent Index, devant Claude Fable 5; Sol atteint 88,8% à Terminal-Bench 2.1 et Sol Ultra 91,9%; Sol affiche 72,7% à DeepSWE. Programmatic Tool Calling réduit l'orchestration, et Sol, Terra et Luna offrent une échelle API nette : $5/$30, $2,50/$15 et $1/$6.
C'est une avance en code agentique, pas un monopole : Claude Fable 5 conserve 80,3% contre 64,6% pour Sol dans la comparaison SWE-Bench Pro publiée. Ultra augmente les tokens et dépend du forfait. Les protections cyber peuvent ajouter de la friction aux prompts défensifs ou proches de l'exploit; chaque graphique doit encore être testé sur votre dépôt, vos tests et vos règles de déploiement.