Rang #4 Alltags-Ökosystem — Die führenden KI-Assistenten
Anthropic

Claude Sonnet 5.5

Claude Sonnet 5.5 ist der Assistent für die ganz normale Arbeitswoche: Dokumente zusammenfassen, Tabellen und Folien bauen, Berichte entwerfen. In unabhängigen Tests zur Büroarbeit liegt es nur ein, zwei Punkte hinter Opus 5.5, es ist im kostenlosen Claude-Tarif verfügbar, und seine API-Token kosten die Hälfte. Opus kennt allerdings mehr Fakten und löst die wirklich verzwickten Probleme besser.

Aktualisiert 29. September 2026 Knowledge WorkFreemium1M Context
Am besten für

Claude Sonnet 5.5 ist der Assistent für die ganz normale Arbeitswoche: Dokumente zusammenfassen, Tabellen und Folien bauen, Berichte entwerfen. In unabhängigen Tests zur Büroarbeit liegt es nur ein, zwei Punkte hinter Opus 5.5, es ist im kostenlosen Claude-Tarif verfügbar, und seine API-Token kosten die Hälfte. Opus kennt allerdings mehr Fakten und löst die wirklich verzwickten Probleme besser.

Warum es gewinnt

Erreicht 56 Punkte im unabhängigen Intelligence Index von Artificial Analysis auf der Stufe max, zwei Punkte hinter Opus 5.5 (58). Artificial Analysis maß außerdem 1844 Elo bei GDPval-AA v2.1 (Opus 5.5: 1846) und 1811 bei AA-Briefcase (Opus 5.5: 1822). Wenn es eine Antwort nicht weiß, erfindet es seltener etwas als Opus 5.5. API-Token kosten 2/10 US-Dollar, und die Ausgabe kommt über 30 % schneller als bei Sonnet 5.

Zu beachten

Es kennt weniger Fakten als Opus 5.5 (54 % gegenüber 66 % Treffern im Wissenstest von Artificial Analysis) – Details abseits des Mainstreams sollte man also prüfen. Auf der Stufe max erzeugt es mehr Text als jedes Modell, das Artificial Analysis je gemessen hat, was max teuer und langsam macht. Es erzeugt weder Bilder noch Audio oder Video, und riskantere Sicherheitsanfragen fallen auf das ältere Sonnet 5 zurück.

01

Was es wirklich ist

Stellen Sie sich ein Büro mit zwei erfahrenen Leuten vor. Die eine ist die Partnerin, die man in die Besprechung holt, wenn der Fall ungewöhnlich ist und viel auf dem Spiel steht. Der andere ist der Kollege, der den Stapel der Woche abarbeitet – vierzig E-Mails, drei Tabellen, eine Präsentation für Donnerstag – schnell und sauber.

Die meisten von uns brauchen die zweite Person viel öfter als die erste. Claude Sonnet 5.5 ist dieser Kollege.

Anthropic hat es am 28. September 2026 veröffentlicht, eine Woche nach Claude Opus 5.5, als zweites Modell der Claude-5.5-Familie. Es ist als alltägliche Ergänzung zu Opus gedacht. In Anthropics Worten: Opus ist für komplexe Arbeit gebaut, die sorgfältiges Urteilsvermögen verlangt, während Sonnet 5.5 bei klar umrissenen Alltagsaufgaben, beim Beheben von Fehlern und beim Erstellen ausgefeilter Dokumente, Folien und Tabellen am stärksten ist.

Wie nah ist es an Opus?

Näher, als man erwarten würde – zumindest in den unabhängigen Tests.

Artificial Analysis betreibt zwei Tests, die sich um fertige berufliche Arbeit drehen statt um Quizfragen. Bei GDPval-AA v2.1 liefern Modelle echte Arbeitsergebnisse, etwa ein Finanzmodell, ein juristisches Memo oder ein Briefing, und die Ergebnisse werden direkt gegeneinander verglichen, wie Schachpartien. Sonnet 5.5 erreichte 1844 Elo. Opus 5.5 kam auf 1846 – ein Abstand, der keine Rolle spielt. Beim neueren AA-Briefcase, der längere, mehrstufige Wissensarbeit prüft, erreichte es 1811 gegenüber 1822 für Opus.

Das breiteste unabhängige Maß ist der Intelligence Index von Artificial Analysis, ein Gesamtwert aus anspruchsvollen Tests. Auf der Stufe max erreichte Sonnet 5.5 56 Punkte, nur Opus 5.5 lag mit 58 davor.

Für ein Sonnet-Modell ist das ein gewaltiger Schritt. Sein Vorgänger Sonnet 5 kam bei GDPval-AA auf 1449. Praktisch heißt das: Büroarbeit, für die man bisher das Spitzenmodell brauchte, kann jetzt an das günstigere, schnellere Modell gehen.

Wo Opus weiterhin vorn liegt

An zwei Stellen ist der Abstand echt.

Fakten. Der Test AA-Omniscience von Artificial Analysis stellt Tausende Faktenfragen. Sonnet 5.5 beantwortete 54 % richtig, Opus 5.5 66 %. Ein kleineres Modell hat schlicht weniger Wissen gespeichert. Es gibt aber einen Lichtblick: Wenn Sonnet 5.5 eine Antwort nicht wusste, erfand es in 47 % der Fälle eine, Opus 5.5 in 59 %. Es weiß weniger, gibt das aber eher zu. Für ein entlegenes Datum, einen Namen oder eine Statistik sollten Sie es trotzdem bitten, im Web zu suchen oder eine Quelle zu nennen.

Urteilsvermögen. Hier ist Anthropic ungewöhnlich direkt. In mehreren Tests schneidet Sonnet 5.5 auf der Stufe max vergleichbar mit Opus 5.5 ab. Doch in Anthropics eigenen Tests und denen externer Tester bleibt Opus 5.5 bei komplexer, offener Arbeit klar stärker, wenn anhaltendes Urteilsvermögen gefragt ist. Hat eine Frage keinen offensichtlichen Rahmen – eine Strategieentscheidung, ein Vertrag mit ungewöhnlichen Klauseln –, ist das weiterhin ein Fall für Opus.

Was es gut kann

Anthropic hebt Dokumente, Zusammenfassungen, Tabellen und Folien hervor und bescheinigt dem Modell ein gutes Auge für Design: Es kann einer Folienvorlage so genau folgen, dass kaum Nacharbeit nötig ist. Beim Lesen von Diagrammen hat es sich enorm verbessert. In Anthropics Test Chartography, bei dem Modelle ohne Hilfsmittel Werte aus Diagrammen ablesen, erreichte es 61,6 % – Sonnet 5 kam auf 15,6 %.

Es ist außerdem schnell. Laut Anthropic kommt die Ausgabe über 30 % schneller als bei Sonnet 5, und frühe Tester haben das bemerkt: Zendesk berichtet, dass Support-Tickets 20 % schneller bearbeitet wurden, und Box maß die 2,4-fache Geschwindigkeit der Vorgängerversion.

Auch einen Computer kann es bedienen. Bei OSWorld 2.1, wo sich ein Modell per Klicken und Tippen durch echte Desktop-Programme arbeitet, meldet Anthropic 80,1 % mit Teilpunktewertung – nah an den 81,8 % von Opus 5.5.

Den Regler in der Mitte lassen

Sonnet 5.5 hat fünf Aufwandsstufen: low, medium, high, xhigh und max. Die Claude-Apps verwenden standardmäßig medium. Das hat Artificial Analysis auf jeder Stufe gemessen:

Aufwand Intelligence Index Kosten pro Aufgabe
Low 36 0,41 $
Medium 41 0,59 $
High 47 1,08 $
Xhigh 52 2,74 $
Max 56 7,60 $

Der letzte Schritt ist der teure. Auf max schrieb Sonnet 5.5 etwa 193.000 Ausgabe-Token pro Aufgabe – der höchste Wert, den Artificial Analysis je gemessen hat, und rund 60 % mehr als Opus 5.5 auf max. Für die meisten Menschen in der Claude-App bedeutet das schlicht längeres Warten. Für Entwickler, die pro Token bezahlen, heißt es: Ein voll aufgedrehtes Sonnet ist nicht mehr die günstige Option. Braucht eine Aufgabe so viel Nachdenken, verdient sie meist Opus.

Der ehrliche Haken

Keine Bilder. Claude liest Screenshots, Diagramme und eingescannte PDFs gut, erzeugt aber weder Bilder noch Audio oder Video. Wer eine App möchte, die auch zeichnet und spricht, ist mit ChatGPT oder Gemini breiter aufgestellt.

Preis pro Token ist nicht Preis pro Aufgabe. Die Token kosten so viel wie bei Sonnet 5: 2 US-Dollar pro Million Eingabe- und 10 US-Dollar pro Million Ausgabe-Token. Laut Anthropic kosten typische Aufgaben bis zu 30 % weniger, weil das Modell mit weniger Schritten auskommt. Das gilt bei normalen Einstellungen; auf max steigt die Rechnung, wie die Tabelle zeigt, schnell an.

Manche Anfragen sind abgesichert. Sonnet 5.5 ist das erste Sonnet-Modell mit den strengeren Cybersicherheits-Schutzmechanismen, die Anthropic bei seinen Spitzenmodellen einsetzt. Riskantere Sicherheitsanfragen fallen sichtbar auf Sonnet 5 zurück. Für fast alle spielt das nie eine Rolle.

Für wen es sich eignet

Wenn Ihr Tag so aussieht … Nehmen Sie Warum
E-Mails, Zusammenfassungen, Tabellen, Präsentationen Claude Sonnet 5.5 Büroarbeit fast auf Opus-Niveau, schnell, im kostenlosen Tarif
Folgenreiche Urteile, entlegene Fakten, verzwickte Recherche Claude Opus 5.5 Mehr Wissen und klar stärkeres Urteilsvermögen
„Bediene diese Software auf meinem Computer und erledige die Aufgabe“ GPT-6 Astra Stärkerer, sparsamerer Agent für die Computerbedienung
Eine App für Chat, Bilder und Sprache ChatGPT oder Gemini Breiterer kreativer Werkzeugkasten

Das Fazit für den Alltag

Claude Sonnet 5.5 wird Opus bei den schwierigsten Fragen nicht ersetzen, und Anthropic behauptet das auch nicht. Aber die schwierigsten Fragen machen nur einen kleinen Teil der meisten Wochen aus. Für alles andere ist es schnell, fähig, im kostenlosen Claude-Tarif verfügbar und so bepreist, dass man nicht darüber nachdenken muss. Lassen Sie es auf der Standardeinstellung, prüfen Sie entlegene Fakten – und holen Sie Opus dazu, wenn viel auf dem Spiel steht.

02

Stärken und ehrliche Grenzen

Zentrale Stärken

  • Nah am Spitzenmodell bei echter Arbeit: Artificial Analysis betreibt zwei Tests mit fertigen beruflichen Arbeitsergebnissen. Sonnet 5.5 erreichte 1844 Elo bei GDPval-AA v2.1 gegenüber 1846 für Opus 5.5 und 1811 beim langfristig angelegten AA-Briefcase gegenüber 1822. Für die alltägliche Büroarbeit liegen die beiden praktisch gleichauf.
  • Zweiter im breitesten unabhängigen Index: Auf der Stufe max erreicht es 56 Punkte im Intelligence Index von Artificial Analysis, nur Opus 5.5 liegt mit 58 davor. Schon auf der alltagstauglichen Stufe High kommt es auf 47 Punkte – für etwa einen Dollar pro Aufgabe.
  • Sagt öfter „Ich weiß es nicht“: Im Wissenstest AA-Omniscience erfand Sonnet 5.5 bei 47 % der Fragen, die es nicht richtig beantworten konnte, eine Antwort – Opus 5.5 bei 59 %. Es gibt Unsicherheit also eher zu.
  • Gemacht für Dokumente, Folien und Tabellen: Laut Anthropic ist es bei klar umrissenen Alltagsaufgaben und ausgefeilten Dokumenten am stärksten und hat ein gutes Auge für Design. Diagramme liest es weit besser als Sonnet 5: 61,6 % in Anthropics Chartography-Test gegenüber 15,6 %.
  • Schnell, breit verfügbar und günstiger für Entwickler: Die Ausgabe kommt über 30 % schneller als bei Sonnet 5. Jeder kann es in den Web- und Mobil-Apps von Claude nutzen, auch im kostenlosen Tarif, und Entwickler zahlen 2/10 US-Dollar pro Million Token – die Hälfte von Opus 5.5 – über Anthropics API, AWS, Google Cloud und Microsoft Azure.

Ehrliche Einschränkungen

  • Weniger Wissen im Kopf: Bei AA-Omniscience beantwortete es 54 % der Wissensfragen richtig, Opus 5.5 dagegen 66 %. Bei entlegenen Namen, Daten oder Zahlen sollten Sie es bitten, im Web zu suchen oder eine Quelle zu nennen.
  • Die Stufe max lohnt sich nicht: Artificial Analysis maß auf max etwa 193.000 Ausgabe-Token pro Aufgabe, der höchste je erfasste Wert, und die Kosten pro Aufgabe verdreifachen sich von xhigh auf max fast. Alltagsarbeit gehört auf die Standardeinstellungen.
  • Bei den harten Fällen gewinnt weiterhin Opus: Laut Anthropic bleibt Opus 5.5 bei komplexer, offener Arbeit, die anhaltendes Urteilsvermögen verlangt, klar stärker – beim mehrdeutigen Vertrag oder bei der Strategiefrage ohne klaren Rahmen.
  • Kein Bild- oder Tonstudio: Claude liest Bilder und Diagramme, erzeugt aber weder Bilder noch Audio oder Video. ChatGPT und Gemini bleiben die breiteren Alleskönner.
  • Manche Sicherheitsanfragen werden umgeleitet: Sonnet 5.5 wird mit Anthropics strengeren Cyber-Schutzmechanismen ausgeliefert, und riskantere Sicherheitsaufgaben fallen sichtbar auf Sonnet 5 zurück. Die meisten Menschen werden das nie bemerken.
03

Benchmark-Übersicht

Artificial Analysis Intelligence Index — 56 (Stufe max)

Unabhängiger Gesamtwert aus anspruchsvollen Tests, gemessen im September 2026. Zum Start nur hinter Opus 5.5 (58). Nach Aufwand: low 36, medium 41, high 47, xhigh 52, max 56.

GDPval-AA v2.1 — 1844 Elo

Echte berufliche Arbeitsergebnisse aus vielen Berufen, durchgeführt von Artificial Analysis. Opus 5.5 erreicht 1846, Sonnet 5 1449.

AA-Briefcase v1.1 — 1811 Elo

Der neuere Test von Artificial Analysis für lange, mehrstufige Wissensarbeit. Opus 5.5 erreicht 1822, Sonnet 5 1359.

AA-Omniscience — 54 % Treffer, 47 % Halluzinationsrate

Unabhängiger Wissenstest. Opus 5.5 beantwortet mehr Fragen richtig (66 %), erfindet aber öfter etwas, wenn es falsch liegt (59 %). Eine niedrigere Halluzinationsrate ist besser.

OSWorld 2.1 — 80,1 % (Teilpunkte)

Anthropics Wert für die Bedienung eines echten Desktops. Opus 5.5 erreicht 81,8 %, Sonnet 5 57,0 %, jeweils mit derselben Teilpunktewertung.

Preis — 2 / 10 US-Dollar pro 1 Mio. Token

Unverändert gegenüber Sonnet 5 und die Hälfte von Opus 5.5. Artificial Analysis maß Kosten pro Aufgabe von 0,41 US-Dollar auf low bis 7,60 US-Dollar auf max.

04

Das Fazit

Claude Sonnet 5.5 ist der Assistent, den die meisten Menschen jeden Tag nutzen können, ohne über Kosten nachzudenken: in unabhängigen Tests zur Büroarbeit nah an Opus 5.5, im kostenlosen Claude-Tarif verfügbar und zum halben API-Preis. Es steht unter Opus 5.5, weil es spürbar weniger Fakten kennt und nach Anthropics eigener Aussage offene Urteilsfragen schwächer löst; hinter GPT-6 Astra und Fable 5.1 liegt es, weil diese bei der Computerbedienung und bei langer Recherche führen. Für Zusammenfassungen, Tabellen, Folien und Berichte ist es die vernünftige Standardwahl.

05

Häufig gestellte Fragen