El nuevo líder cotidiano en inteligencia: Opus 5 lleva criterio cercano a Fable a un modelo que personas y empresas pueden usar a escala. Lidera pruebas independientes iniciales, cuesta la mitad que Fable 5 y está ampliamente disponible.
GDPval-AA v2 Elo 1861, ARC-AGI-3 30,2%, BrowseComp 90,8%, OSWorld 2.0 70,6%, AutomationBench 26,0% y HLE con herramientas 64,7%. Artificial Analysis puntúa max con 61 y #1. Contexto 1M, salida 128k, $5/$25 y sin requisito general de retención.
La corona es provisional: hay menos de 48 horas de datos independientes. Fable gana pruebas especializadas, GPT-5.6 conserva el mayor ecosistema de consumo y Claude no genera imágenes. Max es lento y verboso; los límites de los planes siguen importando.