Wenn GPT-5.5 ein sehr guter Kollege war, ist GPT-5.6 eine kleine Abteilung mit Verkehrsleitung. Sol übernimmt das schwierige, teure Denken. Terra erledigt die normale Arbeit. Luna räumt die Warteschlange auf. Der wichtige Start sind nicht nur diese drei Namen, sondern der Ort, an den OpenAI sie gesetzt hat.
ChatGPT Work ist jetzt der Agent für Aufgaben, die zu groß für eine höfliche kleine Chatblase sind. Gib ihm ein Projekt, Quelldateien und verbundene Apps; es kann Kontext sammeln, Arbeit in Schritte zerlegen, im Hintergrund weitermachen und editierbare Dokumente, Folien, Tabellen, Sites oder Web-Apps erzeugen. Scheduled Tasks halten wiederkehrende Arbeit in Bewegung. Du bleibst Redakteur, Freigeber und die Person, die am Montag die Tabelle erklären muss.
Auf dem Desktop wird die frühere Codex-App in die neue ChatGPT-Desktop-App integriert. Codex bleibt der Coding-Agent—nun neben Chat und Work—mit Inline-Änderungen in Diffs, Pull-Request-Review, schnellerem Computer Use und Projekten mit mehreren Repositories. Die App besitzt außerdem einen integrierten Browser; Computer Use kann mit deiner Freigabe in lokalen Apps klicken, tippen und Dateien bewegen. Das ist weit mehr als ein neues Modell-Label: OpenAI verbindet Chat, Arbeit, Code und Desktop-Aktionen in einer Oberfläche.
Wähle das Gehirn, nicht eine Religion
| Aufgabe | Route zu | Warum |
|---|---|---|
| Komplexe Untersuchung, ernsthafte Codebase-Arbeit, Research mit vielen beweglichen Teilen | Sol | Höchste Fähigkeit und beste agentische Coding-Ergebnisse der Familie |
| Analyse, Schreiben, normale Produktarbeit, gewöhnliche mehrstufige Agenten | Terra | GPT-5.5-kompetente Arbeit zum halben API-Listenpreis von Sol |
| Klassifikation, Extraktion, Entwürfe und Routine-Automatisierung mit hohem Volumen | Luna | Schnellste und günstigste GPT-5.6-Stufe |
| Eine riesige, parallelisierbare Mission | Sol + ultra | Mehrere Agenten arbeiten parallel; nur nutzen, wenn sich der Mehraufwand lohnt |
Warum dieses Routing zählt, ist Effizienz. OpenAI meldet für Sol 53,6% bei Agents’ Last Exam, 80 im Artificial Analysis Coding Agent Index mit max Reasoning und 62,6% bei OSWorld 2.0. Das sind beeindruckende Startwerte; das Unternehmen berichtet auf ausgewählten Tests auch deutlich weniger Zeit, Tokens oder geschätzte Kosten als bei mehreren Konkurrenten. Es sind keine Zauberbohnen. Benchmark-Aufbau, Effort-Einstellung, Tool-Harness und die Aufgabe selbst zählen alle.
Die wichtigste Nutzbarkeitsänderung ist die Verfügbarkeit: GPT-5.6 startete in ChatGPT, Codex und der API. Die dreistufige Familie ist aber kein Buffet mit identischem Zugang. Chat-Nutzer ab Plus können Sol ab mittlerem Aufwand verwenden; Work und Codex zeigen je nach Tarif andere Optionen; ultra ist stärker eingeschränkt. Prüfe zuerst Modell- und Effort-Einstellungen, die du tatsächlich siehst, statt einen Tarif für ein Feature zu kaufen, das dein Konto noch nicht erreicht hat.
Der ehrliche Haken
Mehr Eigenständigkeit bedeutet mehr Verantwortung. Eine lange Work-Aufgabe kann deutlich mehr Kontingent verbrauchen als eine Chat-Antwort. Verbundene Apps und Computer Use sind gerade deshalb wertvoll, weil sie echten Unternehmenskontext erreichen können—Berechtigungen und Freigabepunkte sind deshalb nicht verhandelbar. Und Sols stärkere Schutzmaßnahmen können legitime sicherheitsnahe Arbeit langsamer oder mühsamer machen.
Die gute Gewohnheit lautet also nicht „immer Sol“. Sie lautet: Sol für den Berg, Terra für den Arbeitsweg, Luna für das Fließband—mit ChatGPT Work als Projektpult, das verhindert, dass sich die drei gegenseitig auf die Füße treten.