Update vom 25. Juli: Claude Opus 5 steht hier nun vor Fable 5. Fable behält knappe Spitzenwerte bei FrontierCode, CursorBench, HLE ohne Werkzeuge und einem juristischen Test; Opus 5 führt jedoch breiter relevante Agenten- und Wissensarbeitstests zum halben Tokenpreis und mit weniger Einsatzhürden an. Der folgende Text bewahrt Fables Startbelege vom Juni; lesen Sie seine Superlative in diesem historischen Kontext.
Wenn Opus 4.8 die Beförderung war, ist Fable 5 das Eckbüro. Anthropics Namenswechsel von musikalischen Stufen (Haiku, Sonnet, Opus) zu literarischen (Fable, Mythos) ist nicht nur Branding — er signalisiert eine neue Modellklasse. Fable 5 läuft auf derselben Mythos-Klasse- Architektur wie das eingeschränkte Mythos 5, aber mit Sicherheitsklassifikatoren, die es für die allgemeine Nutzung sicher machen. Stellen Sie sich einen Supersportwagen mit aktiviertem Geschwindigkeitsbegrenzer vor — immer noch das Schnellste auf der Straße, nur mit Leitplanken in bestimmten Kurven.
Die Zahlen sprechen für sich. SWE-Bench Pro 80,3% schlägt nicht einfach GPT-5.5 (58,6%) — es blamiert das gesamte Feld. FrontierCode Diamond bei 29,3% bedeutet, dass Fable 5 produktionsreifen Code fünfmal effizienter schreibt als GPT-5.5 (5,7%). Auf Hebbias Finance Benchmark — Dokumentenanalyse auf Senior-Level, Diagramminterpretation, Ursachenanalyse — ist es die Nummer 1. Auf CursorBench eröffnete es „eine Klasse von Langzeit-Problemen, die für frühere Modelle unerreichbar waren."
Aber die aussagekräftigsten Demonstrationen sind keine Benchmarks. Stripe migrierte eine 50-Millionen-Zeilen-Ruby-Codebasis an einem Tag — Arbeit, für die ein ganzes Team zwei Monate gebraucht hätte. Das Modell spielte Pokémon FireRed nur mit rohen Screenshots durch — keine Karten, keine Hilfstools, keine Spielstanddaten. Und als es beim Spielen von Slay the Spire persistenten dateibasierten Speicher erhielt, verbesserte sich seine Leistung um 3× mehr als die von Opus 4.8.
Die Sicherheitsgeschichte ist es wert, verstanden zu werden. Anfragen zu Cybersicherheit, Biologie, Chemie oder Modelldestillation werden automatisch an Opus 4.8 weitergeleitet — immer noch ein Spitzenmodell, aber nicht die volle Mythos-Architektur. Das passiert in weniger als 5% der Sitzungen, und Anthropic räumt einige Fehlalarme bei harmlosen Anfragen ein. Es ist der Preis dafür, ein so leistungsfähiges Modell schnell und sicher zu veröffentlichen. Das uneingeschränkte Mythos 5 ist geprüften Partnern über Project Glasswing vorbehalten — wo es bereits dabei hilft, kritische Software-Infrastruktur zu verteidigen.
Die eigentliche Frage ist, ob der Preis es wert ist. Bei $10/$50 pro Million Token kostet Fable 5 ungefähr das Doppelte von Opus 4.8. Aber die Token-Effizienz gleicht dies teilweise aus — FrontierCode-führende Ergebnisse bei mittlerem Aufwand bedeuten weniger Rechenleistung pro Aufgabe. Für Profis, deren Zeit mehr wert ist als ihre API-Rechnung, ist die Rechnung einfach. Für alle anderen bleibt Opus 4.8 exzellent. Aber wenn Sie das beste allgemein verfügbare KI-Modell auf dem Planeten wollen — dasjenige, bei dem der Vorsprung mit der Schwierigkeit der Aufgabe wächst — dann ist es dieses.