Le nouveau leader de l'intelligence quotidienne : Opus 5 apporte un jugement proche de Fable dans un modèle réellement exploitable à grande échelle. Il mène les premiers tests indépendants, coûte moitié moins que Fable 5 et reste largement disponible.
GDPval-AA v2 Elo 1861, ARC-AGI-3 30,2 %, BrowseComp 90,8 %, OSWorld 2.0 70,6 %, AutomationBench 26,0 % et HLE avec outils 64,7 %. Artificial Analysis donne 61 et #1 à max. Contexte 1M, sortie 128k, 5/25 $, sans rétention générale.
Couronne provisoire : moins de 48 heures de données indépendantes. Fable gagne des tests spécialistes, GPT-5.6 garde le plus grand écosystème grand public, Claude ne génère pas d'images. Max est lent et verbeux ; les quotas des offres comptent.