Rang #5 Alltags-Ökosystem — Die führenden KI-Assistenten
OpenAI

GPT-6.1 Sol

GPT-6.1 Sol ist das Alltags-Arbeitsmodell von OpenAI: jenes, dem Sie in ChatGPT Work die Berichte, PDFs und mehrstufigen Aufgaben übergeben. In unabhängigen Tests liegt es nur einen Punkt hinter GPT-6 Astra, dem Flaggschiff von OpenAI, kostet aber für eine typische Aufgabe weniger als ein Viertel. Es liest lange Dokumente zuverlässig und macht weniger inhaltliche Fehler als sein Vorgänger. Laut OpenAI kann es Desktop-Apps fast genauso gut bedienen wie Astra.

Aktualisiert 30. September 2026 Near-Astra ValueChatGPT WorkDocument Work
Am besten für

GPT-6.1 Sol ist das Alltags-Arbeitsmodell von OpenAI: jenes, dem Sie in ChatGPT Work die Berichte, PDFs und mehrstufigen Aufgaben übergeben. In unabhängigen Tests liegt es nur einen Punkt hinter GPT-6 Astra, dem Flaggschiff von OpenAI, kostet aber für eine typische Aufgabe weniger als ein Viertel. Es liest lange Dokumente zuverlässig und macht weniger inhaltliche Fehler als sein Vorgänger. Laut OpenAI kann es Desktop-Apps fast genauso gut bedienen wie Astra.

Warum es gewinnt

Artificial Analysis (29. September 2026) bewertete es mit 52 Punkten auf dem Intelligence Index, einen Punkt unter GPT-6 Astra (53), bei 0,72 $ pro Aufgabe im Vergleich zu 3,26 $. Laut OpenAI schlägt es Claude Opus 5.5 beim Test GDP.pdf – Fragen zu komplexen professionellen PDFs – zu weniger als der Hälfte der Kosten und liegt bei OSWorld 2.0 (Bedienung eines Desktops) nur 2,1 Punkte hinter Astra, bei etwa einem Siebtel der Kosten.

Zu beachten

Es ist noch nicht im regulären ChatGPT Chat verfügbar. Sie benötigen einen kostenpflichtigen Tarif und ChatGPT Work oder Codex. Beim Wissenstest von Artificial Analysis erfindet das Modell immer noch in 54 % der Fälle eine Antwort, wenn es die Lösung nicht kennt. Claude Opus 5.5 und Sonnet 5.5 schneiden auf demselben unabhängigen Index besser ab, und das Modell kann Bilder zwar lesen, aber nicht selbst erstellen.

01

Was es wirklich ist

Stellen Sie sich eine gute Anwaltskanzlei vor. Der Senior Partner ist brillant und stellt seine Rechnung entsprechend aus. Sie würden ihn niemals bitten, zweihundert Seiten Lieferantenverträge auf der Suche nach der Kündigungsklausel durchzusehen. Sie geben das einem vertrauenswürdigen Senior Associate, jemandem, der fast genauso scharfsinnig und viel günstiger ist.

GPT-6.1 Sol ist dieser Senior Associate. Es ist nicht das leistungsstärkste Modell von OpenAI, aber es ist nah dran, und es ist dasjenige, dessen Einsatz Sie sich für den Großteil der wöchentlichen Arbeit leisten können.

Was es ist und wo Sie es finden

OpenAI veröffentlichte GPT-6.1 Sol am 29. September 2026 auf seinem DevDay-Event, eine Woche nach GPT-6 Sol. OpenAI beschreibt es als eine Intelligenz nahe an Astra für Programmierung, Computernutzung und professionelle Arbeit, zu einem Fünftel des Preises seines Flaggschiffs GPT-6 Astra.

Wo Sie es nutzen können, ist für die meisten Leser entscheidend. In ChatGPT befindet sich GPT-6.1 Sol in ChatGPT Work und Codex, den Teilen der App, die für längere Aufgaben, Dateien und Agenten entwickelt wurden. Es ist in den Tarifen Plus, Pro, Business, Enterprise und Edu verfügbar. Es ist noch nicht im regulären Chat zu finden und auch nicht im kostenlosen Tarif enthalten. Entwickler können es über die API als gpt-6.1-sol nutzen, und Programmiertools wie Devin von Cognition haben es am Tag der Veröffentlichung integriert.

Wie nah am Flaggschiff?

Artificial Analysis, ein unabhängiges Testunternehmen, führte seine Benchmarks am Tag der Veröffentlichung durch. Sein Intelligence Index kombiniert zehn anspruchsvolle Auswertungen, von Büroarbeit und Geschäftsautomatisierung bis hin zu wissenschaftlicher Programmierung und Faktenwissen. GPT-6.1 Sol erreichte 52 Punkte. GPT-6 Astra erzielte 53, und das GPT-6 Sol der Vorwoche kam auf 48. Damit belegt GPT-6.1 Sol Platz 10 der 222 Modelle auf der Rangliste.

Betrachten wir nun den Preis. Artificial Analysis berechnete etwa 0,72 $, um eine Aufgabe seines Index mit GPT-6.1 Sol auszuführen, im Vergleich zu 3,26 $ für Astra. Das ist ein Punkt weniger Leistungsfähigkeit für weniger als ein Viertel der Kosten.

Der Fairness halber führt Anthropic diesen Index weiterhin an. Claude Opus 5.5 erreichte 58 Punkte und Claude Sonnet 5.5 erzielte 56. Diese Ergebnisse kosten jedoch deutlich mehr: 5,98 $ und 7,60 $ pro Aufgabe.

Worin es im Arbeitsalltag gut ist

Die Einführungstests von OpenAI konzentrieren sich auf die Art von Arbeit, die eine Bürowoche füllt. Denken Sie daran, dass dies die eigenen Zahlen von OpenAI sind.

  • Lesen schwieriger PDFs. Bei GDP.pdf beantwortet das Modell Fragen zu echten Dokumenten aus den Bereichen Finanzen, Recht, Gesundheitswesen und sieben weiteren Bereichen, mit dichten Tabellen, Diagrammen und Kleingedrucktem. Die OpenAI-Tabelle zeigt 32,0 % bei hohem Aufwand (High Effort) für 0,35 $ pro Aufgabe. Der Bestwert von Claude Opus 5.5 liegt bei 28,8 % für 0,83 $ und der von GPT-6 Astra bei 32,2 % für 1,91 $. Sol erreicht also fast das Flaggschiff zu einem Fünftel des Preises.
  • Mehrstufige Routineaufgaben. Bei AutomationBench schließt ein Agent End-to-End-Workflows über 47 Business-Tools ab, wie z. B. die Aktualisierung eines CRM, das Einreichen eines Tickets und das Senden einer Follow-up-E-Mail. Bei mittlerem Aufwand erzielt GPT-6.1 Sol 31,7 % für 0,19 $ pro Aufgabe, 2,2 Punkte vor Claude Opus 5.5 bei derselben Einstellung. Lesen Sie jedoch die gesamte Tabelle: Bei maximalem Aufwand erreicht Opus 5.5 42,5 % und Astra 41,4 %, während Sol bei 36,1 % seinen Höhepunkt erreicht. Sol gewinnt bei Routineaufgaben pro Dollar; die teureren Modelle erledigen bei den schwierigsten Aufgaben immer noch mehr.
  • Einen Computer bedienen. Bei OSWorld 2.0 klickt und tippt sich das Modell durch echte Desktop-Apps. OpenAI meldet 71,4 % für 1,27 $ pro Aufgabe, gegenüber 73,5 % für Astra zu 9,44 $.

Weniger erfundene Fakten, aber nicht null

OpenAI testete die sachliche Genauigkeit anhand bewusst schwerer Fragen aus echten Gesprächen, in denen Nutzer den Fehler eines früheren Modells markiert hatten. Bei niedrigem Aufwand sank der Anteil der Antworten mit einem sachlichen Fehler von 11,4 % auf 7,7 % im Vergleich zu GPT-6 Sol, was etwa einem Drittel weniger entspricht.

Der unabhängige Wissenstest von Artificial Analysis liefert ein nüchterneres Bild. Wenn GPT-6.1 Sol eine Antwort nicht kennt, erfindet es sie immer noch in 54 % der Fälle. Das ist besser als die 60 % von GPT-6 Sol, aber schlechter als die 47 % von Claude Sonnet 5.5. Der praktische Ratschlag ändert sich nicht: Bitten Sie das Modell bei einem obskuren Namen, einem Datum oder einer Zahl, das Web zu durchsuchen oder eine Quelle zu zitieren.

Ein Wort zum Astra, das nicht ausgeliefert wurde

GPT-6.1 Sol war nicht das einzige Modell, das OpenAI für den DevDay geplant hatte. Am Tag zuvor sagte das Unternehmen GPT-6.1 Astra ab, nachdem interne Tests ergeben hatten, dass das Modell nicht zuverlässig innerhalb des Umfangs und der Berechtigungen seiner Aufgaben blieb. GPT-6.1 Sol ist ein separates Modell mit seinem eigenen Sicherheitsbericht. In einem der OpenAI-Tests ist das Suchwerkzeug eines Agenten unbemerkt defekt, und das Modell sollte dies mitteilen, anstatt zu raten. GPT-6.1 Sol versäumte es in 2,1 % der Fälle, das Problem offenzulegen, gegenüber 4,9 % bei GPT-6 Sol und 1,5 % bei GPT-6 Astra. Das ist eine echte Verbesserung, wenn auch keine Garantie für jede Situation.

Der ehrliche Haken

Es befindet sich hinter einer Bezahlschranke und einem eigenen Tab. Für ein Modell, das auf den Arbeitsalltag ausgerichtet ist, ist die größte Einschränkung schlichtweg der Zugang: Es gibt keinen kostenlosen Tarif und keinen regulären Chat, nur ChatGPT Work und Codex in kostenpflichtigen Tarifen.

Es liest Bilder, aber zeichnet nicht. GPT-6.1 Sol nimmt Text und Bilder als Eingabe an und schreibt Text zurück. Es generiert selbst keine Bilder, Audios oder Videos.

Claude liegt auf dem breiten Index weiterhin vorn. Wenn Sie unabhängig von den Kosten die höchsten unabhängigen Bewertungen wünschen, liegen Claude Opus 5.5 und Sonnet 5.5 vorn. Der Vorteil von GPT-6.1 Sol besteht darin, dass es für viel weniger Geld fast genauso gut abschneidet.

Wer sollte es nutzen

Wenn Ihr Tag so aussieht… Greifen Sie zu Warum
Verträge, Berichte und PDFs in ChatGPT Work GPT-6.1 Sol Dokumentenarbeit auf nahezu Astra-Niveau zu einem Bruchteil der Kosten
Die anspruchsvollsten Recherche- und Computeraufgaben GPT-6 Astra OpenAIs stärkstes Modell, ein oder zwei Punkte voraus
Hochriskante Urteilsfindung, obskure Fakten Claude Opus 5.5 Spitzenreiter auf dem breiten unabhängigen Index
Arbeitsalltag mit einem kostenlosen Tarif Claude Sonnet 5.5 oder Gemini Starke Modelle ohne Abonnement

Das Alltags-Fazit

GPT-6.1 Sol wird Sie nicht dadurch beeindrucken, das intelligenteste Modell auf der Rangliste zu sein. Es beeindruckt dadurch, fast genauso intelligent wie das Flaggschiff von OpenAI zu sein, jedoch zu einem Bruchteil der Kosten. Wenn Sie bereits für ChatGPT bezahlen und Ihren Tag in Work verbringen, ist die Festlegung als Standardmodell die einfache Wahl. Überprüfen Sie obskure Fakten und wechseln Sie nur zu Astra, wenn eine Aufgabe diese letzten paar Punkte wirklich benötigt.

02

Stärken und ehrliche Grenzen

Zentrale Stärken

  • Nahezu Flaggschiff-Leistung zum Mittelklasse-Preis: Auf dem Intelligence Index von Artificial Analysis, gemessen am 29. September 2026, erzielt GPT-6.1 Sol 52 Punkte gegenüber 53 für GPT-6 Astra. Die Ausführung einer Aufgabe kostet etwa 0,72 $ im Vergleich zu 3,26 $ für Astra, womit es Platz 10 der 222 getesteten Modelle belegt.
  • Liest schwierige Dokumente gut: Bei GDP.pdf, wo Fragen zu echten Finanz-, Rechts- und Gesundheits-PDFs voller Tabellen, Diagramme und Kleingedrucktem gestellt werden, zeigt die OpenAI-Tabelle 32,0 % bei hohem Aufwand (High Effort) für 0,35 $ pro Aufgabe, im Vergleich zum Bestwert von Claude Opus 5.5 von 28,8 % (0,83 $) und GPT-6 Astras Bestwert von 32,2 % (1,91 $).
  • Gut bei Routinebüroaufgaben für wenig Geld: Bei AutomationBench – geschäftliche Workflows über 47 Tools in den Bereichen Vertrieb, Finanzen, Support und HR – zeigt OpenAI 31,7 % bei mittlerem Aufwand für 0,19 $ pro Aufgabe, 2,2 Punkte vor Claude Opus 5.5 bei derselben Einstellung (0,65 $).
  • Bedient einen Computer fast so gut wie Astra: Bei OSWorld 2.0, wo ein Agent durch echte Desktop-Apps klickt und tippt, meldet OpenAI 71,4 % bei maximalem Aufwand für 1,27 $ pro Aufgabe, gegenüber 73,5 % für GPT-6 Astra zu 9,44 $.
  • Weniger selbstbewusste Fehler: Bei OpenAIs strengstem Faktentest sank der Anteil der Antworten mit einem sachlichen Fehler bei niedrigem Aufwand von 11,4 % auf 7,7 % im Vergleich zu GPT-6 Sol. Artificial Analysis maß unabhängig, dass die Halluzinationsrate von 60 % auf 54 % gesunken ist.

Ehrliche Einschränkungen

  • Nicht im Haupt-Chat-Fenster: In ChatGPT läuft GPT-6.1 Sol nur in ChatGPT Work und Codex, in den Tarifen Plus, Pro, Business, Enterprise und Edu. Kostenlose Nutzer können es nicht auswählen, und es ist noch nicht im regulären Chat.
  • Rät immer noch, wenn es unsicher ist: Beim AA-Omniscience-Test von Artificial Analysis dachte es sich in 54 % der Fälle eine Antwort aus, wenn es sie nicht wusste. Das ist besser als die 60 % von GPT-6 Sol, aber schlechter als die 47 % von Claude Sonnet 5.5. Überprüfen Sie obskure Fakten.
  • Claude punktet auf dem breiten Index immer noch höher: Claude Opus 5.5 (58) und Claude Sonnet 5.5 (56) schlagen GPT-6.1 Sol (52) beide auf dem Intelligence Index von Artificial Analysis. Sol ist pro Aufgabe günstiger, aber nicht intelligenter.
  • Schlägt Opus bei mittlerem, nicht bei maximalem Aufwand: OpenAIs AutomationBench-Sieg über Claude Opus 5.5 gilt bei mittlerem Aufwand. Bei maximalem Aufwand (Max Effort) zeigt ihre eigene Tabelle Opus 5.5 bei 42,5 % und GPT-6 Astra bei 41,4 %, deutlich über den 36,1 % von GPT-6.1 Sol. Bei den schwierigsten mehrstufigen Workflows erledigen die teureren Modelle immer noch mehr von der Arbeit.
  • Liest Bilder, erstellt sie nicht: Das Modell akzeptiert Text und Bilder und produziert Text. Die Bilderzeugung in ChatGPT stammt von einem separaten Tool, und das Modell verarbeitet weder Audio noch Video.
  • Viele Vergleiche stammen von OpenAI: GDP.pdf, AutomationBench, OSWorld und der Faktentest stammen aus dem Einführungsbeitrag von OpenAI. Die Ergebnisse des Artificial Analysis Index sind unabhängig und deuten in dieselbe Richtung.
03

Benchmark-Übersicht

Artificial Analysis Intelligence Index — 52 (Maximaler Aufwand)

Unabhängiger Index aus 10 Evaluierungen, gemessen am 29. September 2026. Ein Punkt unter GPT-6 Astra (53) und gegenüber 48 bei GPT-6 Sol. Claude Opus 5.5 erzielt 58 und Claude Sonnet 5.5 erreicht 56 Punkte.

Kosten pro Index-Aufgabe — 0,72 $

Kosten bei Artificial Analysis zur Ausführung einer Aufgabe ihres Index: GPT-6 Astra 3,26 $, Claude Opus 5.5 5,98 $, Claude Sonnet 5.5 7,60 $, alle bei maximalem Aufwand (Max Effort).

GDP.pdf — 32,0 % (Hoher Aufwand, 0,35 $ pro Aufgabe)

Fragen zu komplexen professionellen PDFs in den Bereichen Finanzen, Recht, Gesundheit und sieben weiteren, laut OpenAIs Tabelle. Claude Opus 5.5 erreicht maximal 28,8 % (0,83 $ pro Aufgabe) und GPT-6 Astra 32,2 % (1,91 $).

OSWorld 2.0 offline — 71,4 % (Maximaler Aufwand)

Bedienung echter Desktop-Apps, Teilpunktbewertung, laut OpenAI. GPT-6 Astra erreicht 73,5 % bei 9,44 $ pro Aufgabe und GPT-6 Sol 64,4 % bei 3,37 $; GPT-6.1 Sol kostet 1,27 $.

AA-Omniscience Halluzinationsrate — 54 %

Unabhängig. Wie oft sich das Modell eine Antwort ausdenkt, wenn es eine Frage falsch beantwortet; niedriger ist besser. GPT-6 Sol: 60 %. Claude Sonnet 5.5: 47 %.

Preis — 2 $ / 10 $ pro 1 Mio. Token, 0,10 $ im Cache

Ein Fünftel des API-Preises von GPT-6 Astra. Im Cache gespeicherte Eingaben sind 95 % günstiger, und Batch- sowie Flex-Verarbeitung erhalten 50 % Rabatt.

04

Das Fazit

GPT-6.1 Sol ist für alle, die bereits für ChatGPT bezahlen und möchten, dass ihr Work-Agent Dokumente, Tabellenkalkulationen und mehrstufige Büroaufgaben übernimmt, ohne die Kosten des Flaggschiffs zu tragen. In unabhängigen Tests liegt es einen Punkt unter GPT-6 Astra. Es rangiert hinter GPT-6 Astra und den Claude-Modellen, weil Opus 5.5 und Sonnet 5.5 auf demselben unabhängigen Index besser abschneiden und Sonnet im kostenlosen Claude-Tarif verfügbar ist, während Sol weder im regulären Chat noch in einem kostenlosen Tarif zu finden ist. Vor Gemini 3.1 Pro und Grok 4.7 liegt es aufgrund aktueller unabhängiger Ergebnisse, auch wenn Gemini weiterhin kostenlos nutzbar ist. Wenn Sie ChatGPT Work jeden Tag nutzen, ist dies das vernünftige Standardmodell.

05

Häufig gestellte Fragen