Rang #2 Alltags-Ökosystem — Die führenden KI-Assistenten
OpenAI

GPT-5.6

GPT-5.6 ist nicht einfach ein lauterer einzelner Chatbot. Es ist ein dreiköpfiges Arbeitsteam im erweiterten ChatGPT: Sol für Aufgaben, die das teure Gehirn verdienen, Terra für den Alltag und Luna für die Flut. ChatGPT Work und die zusammengeführte Desktop-App machen aus dieser Aufstellung einen ernstzunehmenden digitalen Kollegen.

Aktualisiert 10. Juli 2026 AgenticChatGPT WorkSol / Terra / Luna
Am besten für

GPT-5.6 ist nicht einfach ein lauterer einzelner Chatbot. Es ist ein dreiköpfiges Arbeitsteam im erweiterten ChatGPT: Sol für Aufgaben, die das teure Gehirn verdienen, Terra für den Alltag und Luna für die Flut. ChatGPT Work und die zusammengeführte Desktop-App machen aus dieser Aufstellung einen ernstzunehmenden digitalen Kollegen.

Warum es gewinnt

Allgemein verfügbar in ChatGPT, Codex und der API. Sol trägt OpenAIs Geschichte zu Coding-Agenten und Computer Use; Terra liefert GPT-5.5-kompetente Alltagsarbeit zum halben Sol-Tokenpreis; Luna ist die schnelle Volumenstufe. ChatGPT Work kann Projekte über verbundene Apps, Dateien, Browser und Desktop hinweg begleiten. Ultra fügt parallele Agenten für die schweren Aufgaben hinzu.

Zu beachten

Die Familie ist breit verfügbar, aber nicht jede nützliche Einstellung steht auf jedem Tarif gleich bereit: Sol, max und ultra haben in ChatGPT Work und Codex unterschiedliche Zugriffsregeln. Lange Work-Aufgaben verbrauchen mehr Plan-Kontingent, verbundene Apps brauchen bewusst vergebene Rechte, und Sols stärkere Cyber-Schutzmaßnahmen können auch legitime Grenzfälle bremsen. Die Benchmarks zeigen eine starke Führung bei agentischem Coding, keinen sauberen Sieg in jedem Coding-Test.

01

Was es wirklich ist

Wenn GPT-5.5 ein sehr guter Kollege war, ist GPT-5.6 eine kleine Abteilung mit Verkehrsleitung. Sol übernimmt das schwierige, teure Denken. Terra erledigt die normale Arbeit. Luna räumt die Warteschlange auf. Der wichtige Start sind nicht nur diese drei Namen, sondern der Ort, an den OpenAI sie gesetzt hat.

ChatGPT Work ist jetzt der Agent für Aufgaben, die zu groß für eine höfliche kleine Chatblase sind. Gib ihm ein Projekt, Quelldateien und verbundene Apps; es kann Kontext sammeln, Arbeit in Schritte zerlegen, im Hintergrund weitermachen und editierbare Dokumente, Folien, Tabellen, Sites oder Web-Apps erzeugen. Scheduled Tasks halten wiederkehrende Arbeit in Bewegung. Du bleibst Redakteur, Freigeber und die Person, die am Montag die Tabelle erklären muss.

Auf dem Desktop wird die frühere Codex-App in die neue ChatGPT-Desktop-App integriert. Codex bleibt der Coding-Agent—nun neben Chat und Work—mit Inline-Änderungen in Diffs, Pull-Request-Review, schnellerem Computer Use und Projekten mit mehreren Repositories. Die App besitzt außerdem einen integrierten Browser; Computer Use kann mit deiner Freigabe in lokalen Apps klicken, tippen und Dateien bewegen. Das ist weit mehr als ein neues Modell-Label: OpenAI verbindet Chat, Arbeit, Code und Desktop-Aktionen in einer Oberfläche.

Wähle das Gehirn, nicht eine Religion

Aufgabe Route zu Warum
Komplexe Untersuchung, ernsthafte Codebase-Arbeit, Research mit vielen beweglichen Teilen Sol Höchste Fähigkeit und beste agentische Coding-Ergebnisse der Familie
Analyse, Schreiben, normale Produktarbeit, gewöhnliche mehrstufige Agenten Terra GPT-5.5-kompetente Arbeit zum halben API-Listenpreis von Sol
Klassifikation, Extraktion, Entwürfe und Routine-Automatisierung mit hohem Volumen Luna Schnellste und günstigste GPT-5.6-Stufe
Eine riesige, parallelisierbare Mission Sol + ultra Mehrere Agenten arbeiten parallel; nur nutzen, wenn sich der Mehraufwand lohnt

Warum dieses Routing zählt, ist Effizienz. OpenAI meldet für Sol 53,6% bei Agents’ Last Exam, 80 im Artificial Analysis Coding Agent Index mit max Reasoning und 62,6% bei OSWorld 2.0. Das sind beeindruckende Startwerte; das Unternehmen berichtet auf ausgewählten Tests auch deutlich weniger Zeit, Tokens oder geschätzte Kosten als bei mehreren Konkurrenten. Es sind keine Zauberbohnen. Benchmark-Aufbau, Effort-Einstellung, Tool-Harness und die Aufgabe selbst zählen alle.

Die wichtigste Nutzbarkeitsänderung ist die Verfügbarkeit: GPT-5.6 startete in ChatGPT, Codex und der API. Die dreistufige Familie ist aber kein Buffet mit identischem Zugang. Chat-Nutzer ab Plus können Sol ab mittlerem Aufwand verwenden; Work und Codex zeigen je nach Tarif andere Optionen; ultra ist stärker eingeschränkt. Prüfe zuerst Modell- und Effort-Einstellungen, die du tatsächlich siehst, statt einen Tarif für ein Feature zu kaufen, das dein Konto noch nicht erreicht hat.

Der ehrliche Haken

Mehr Eigenständigkeit bedeutet mehr Verantwortung. Eine lange Work-Aufgabe kann deutlich mehr Kontingent verbrauchen als eine Chat-Antwort. Verbundene Apps und Computer Use sind gerade deshalb wertvoll, weil sie echten Unternehmenskontext erreichen können—Berechtigungen und Freigabepunkte sind deshalb nicht verhandelbar. Und Sols stärkere Schutzmaßnahmen können legitime sicherheitsnahe Arbeit langsamer oder mühsamer machen.

Die gute Gewohnheit lautet also nicht „immer Sol“. Sie lautet: Sol für den Berg, Terra für den Arbeitsweg, Luna für das Fließband—mit ChatGPT Work als Projektpult, das verhindert, dass sich die drei gegenseitig auf die Füße treten.

02

Stärken und ehrliche Grenzen

Zentrale Stärken

  • ChatGPT Work ist der eigentliche Produktwechsel: Es kann ambitionierte Projekte in Schritte zerlegen, stundenlang weiterarbeiten und Kontext aus verbundenen Apps in editierbare Dokumente, Folien, Tabellen, Sites und Web-Apps verwandeln. Das ist nicht nur ein neuer Modellwähler, sondern eine neue Art, ChatGPT einen Workflow zu übergeben.
  • Eine sinnvolle Drei-Gehirne-Aufstellung: Sol ist das Flaggschiff für schwierige Langzeitaufgaben; Terra ist das günstigere Alltagsmodell mit GPT-5.5-kompetenter Leistung; Luna ist die schnellste und günstigste Stufe. Auch die API-Preise sind klar: Sol $5/$30, Terra $2,50/$15, Luna $1/$6 pro Mio. Eingabe-/Ausgabe-Token.
  • Mehr Kraft nur, wenn sie sich lohnt: max gibt GPT-5.6 mehr Raum zum Denken, Prüfen und Überarbeiten. ultra koordiniert mehrere Agenten parallel—standardmäßig vier—damit ein großes Projekt an mehreren Fronten vorankommt, statt einen Agenten im Kreis laufen zu lassen.
  • Computer Use und Artefaktqualität zählen endlich: Sol erreichte in OpenAIs Release-Tabelle 62,6% auf OSWorld 2.0; zugleich soll die Familie Dokument-, Tabellen- und Präsentationsvorlagen deutlich zuverlässiger befolgen. Für normale Büroarbeit kann diese praktische Treue wichtiger sein als ein weiterer abstrakter IQ-Punkt.
  • Weniger Orchestrierungs-Klebstoff für Entwickler: In der Responses API lässt Programmatic Tool Calling GPT-5.6 kleine Programme im Speicher schreiben und ausführen, um Tools zu koordinieren und Zwischenergebnisse zu filtern. Das bedeutet bei tool-lastiger Arbeit weniger Modellrunden, nicht bloß ein größeres Kontextfenster für das Chaos.

Ehrliche Einschränkungen

  • Breite Verfügbarkeit, aber gestufte Fähigkeiten: Sol im Chat ist für Plus-, Pro-, Business- und Enterprise-Nutzer ab mittlerem Reasoning-Aufwand verfügbar. Free- und Go-Nutzer erhalten Terra in ChatGPT Work und Codex. Ultra ist in Work auf Pro und Enterprise, in Codex auf Plus und höhere Tarife beschränkt.
  • Lange Arbeit verbraucht echtes Kontingent: ChatGPT Work nutzt dieselbe Nutzungslogik wie Codex. Eine kurze Anfrage kann günstig sein; eine Aufgabe, die recherchiert, browsed, Dateien überarbeitet und Freigaben abwartet, kann einen spürbaren Teil des enthaltenen Agenten-Kontingents verbrauchen.
  • Sol ist in sensiblen Bereichen absichtlich vorsichtiger: Laut OpenAI blockieren die Cyber-Schutzmaßnahmen von Sol deutlich mehr potenziell schädliche Aktivitäten als frühere Modelle. Das ist sinnvoll, kann aber defensive Security-, System- und Bio-nahe Arbeit mit mehr Prüfung, Verzögerung oder Ablehnung treffen.
  • Ein Diagramm ist keine universelle Krone: Sol führt mehrere agentische und Coding-Evaluierungen an, doch Claude Fable 5 hat in diesem Leaderboard weiterhin das stärkere veröffentlichte SWE-Bench-Pro-Ergebnis. Ordne das Modell deiner echten Aufgabe zu, statt jeden Benchmark für denselben Sport zu halten.
  • Verbundene Arbeit braucht erwachsene Aufsicht: ChatGPT Work kann wertvollen Kontext aus Plugins, Browser-Tabs, lokalen Dateien und Desktop-Apps berühren. Vergib enge Rechte, prüfe wichtige Aktionen und kontrolliere die fertige Tabelle, Folie oder Site, bevor sie hinausgeht.
03

Benchmark-Übersicht

Agents' Last Exam — Sol 53,6%

OpenAI meldet einen neuen Höchstwert in dieser Evaluation langfristiger professioneller Workflows über 55 Bereiche. Vergleiche und Kostenschätzungen sind Launch-Ergebnisse, kein Ersatz für einen Test deines Workflows.

Artificial Analysis Coding Agent Index — Sol 80

Sol mit max Reasoning führt OpenAIs Release-Vergleich auf diesem unabhängigen Coding-Agent-Index mit 2,8 Punkten vor Claude Fable 5 an.

OSWorld 2.0 — Sol 62,6%

OpenAIs Computer-Use-Ergebnis. Es ist ein nützliches Signal für Desktop- und Web-Aufgaben, aber kein Beweis, dass jeder App-Workflow unbeaufsichtigt zuverlässig läuft.

API-Preisstufen — $5/$30 · $2,50/$15 · $1/$6

Offizieller Eingabe-/Ausgabepreis pro 1 Mio. Token für Sol, Terra und Luna. Cache-Lesevorgänge erhalten 90% Eingaberabatt; die Kosten einer erledigten Aufgabe hängen weiter von Routing und Agenten-Fan-out ab.

04

Das Fazit

GPT-5.6 steht im Alltag nun auf #2: Opus 5 bietet zum Start die stärkere Mischung aus unabhängiger Intelligenz, Wissensarbeit, Computerbedienung und Preis, während ChatGPT das breiteste Rundum-Arbeitssystem bleibt. Work, Plugins, Browser, Computer Use, Sites und Desktop-Codex tragen Sol von der Recherche bis zu Artefakt und Code. Wählen Sie GPT-5.6 für eine integrierte Plattform, Opus 5 für Urteil pro Dollar.

05

Häufig gestellte Fragen