GPT-6 Astra übernimmt die Coding-Krone auf die gleiche ehrliche Art, wie GPT-5.6 sie hielt: indem es agentenförmige Arbeit fertigstellt — Terminal-Sitzungen, scheiternde Pipelines, Incident-Forensik, ganze Desktop-Setups — nun untermauert durch den neuen 1. Platz auf Arena.ais Code Arena (WebDev mit 1.797 Pkt.) und bei rund einem Drittel von Sols Tokens.
Neuer 1. Platz auf Arena.ais Code Arena: WebDev mit 1.797 Punkten (+35 Punkte Vorsprung vor Claude Fable 5.1 Max bei 1.762, +109 vor Opus 5 Max bei 1.688 und +180 vor Sol auf Rang 13), führend in Data & Analytics, Consumer Product und Content Creation Tools. Gepaart mit Terminal-Bench 4.0 bei 57,7–57,9% (Fable 5.1: 55,8%), tabellenbesten 74,1% auf DeepSWE v1.1, 64,6% auf Terminal-Bench Science, SRE-Bench bei 88% pass@1 / 99,2% pass@4 und 100% auf ExploitBench. Auch wenn Artificial Analysis' eigener Agenten-Harness Fable 5.1 noch knapp vorn sieht (70 gegen 67), definiert Astra die Pareto-Grenze bei gemischten $40/Mtoken neu und verbraucht rund ein Drittel von Sols Tokens.
Selbst mit dem 1. Platz in der Code Arena für WebDev und Produktwerkzeuge hält Fable 5(.1) weiterhin den SWE-Bench-Pro-Rekord und führt im Agenten-Index von Artificial Analysis (70 gegen 67). Der API-Sticker liegt beim 2,5-Fachen von Sol bei $10/$50, Cache-Lesezugriffe kosten das Vierfache von Fable 5.1s $0,25, knappe Antworten überspringen Report-Politur-Schritte, und stärkere Cyber-Schutzvorkehrungen erschweren exploit-nahe Arbeit. Die Launch-Tabellen wanderten nach Veröffentlichung — behandeln Sie jede einzelne Zahl als ±1–2 Punkte.