Le nouveau leader de l'intelligence quotidienne : Opus 5 apporte un jugement proche de Fable dans un modèle que particuliers et entreprises peuvent réellement utiliser à grande échelle. Il mène les premiers tests indépendants d'intelligence, domine les comparaisons d'Anthropic sur le travail intellectuel et l'usage de l'ordinateur, coûte moitié moins que Fable 5 et reste largement disponible dans Claude, les plateformes cloud et l'API.
GDPval-AA v2 à 1861 Elo au lancement, ARC-AGI-3 à 30,2%, OSWorld 2.0 à 70,6% et Humanity's Last Exam avec outils à 64,7%. Artificial Analysis v4.1.1 attribue désormais à l'effort max environ 63 et la première place générale. Opus offre aussi 1M de contexte, 128k de sortie et un tarif de 5 $/25 $.
Fable 5 gagne toujours certaines évaluations spécialisées, GPT-5.6 conserve le plus vaste écosystème grand public et Opus 5 ne génère pas nativement d'images. L'effort max est lent et verbeux, les valeurs Elo en direct évoluent et les limites d'usage des offres gratuites et payantes de Claude restent importantes.