Rang #6 Alltags-Ökosystem — Die führenden KI-Assistenten
xAI

Grok 4.5

Grok ist zurück im Frontier-Gespräch—nicht weil es jeden Pokal gewinnt, sondern weil es frontiernahe Agentenarbeit günstig genug für den ganzen Tag macht. Grok 4.5 verbindet einen ernsthaften Intelligenzsprung mit $2/$6-API-Preisen, hohem Tempo, Grok Build, Cursor und Office. Das ist die praktische Wahl: das gute Modell öfter einsetzen.

Aktualisiert 10. Juli 2026 AgenticKnowledge WorkOffice
Am besten für

Grok ist zurück im Frontier-Gespräch—nicht weil es jeden Pokal gewinnt, sondern weil es frontiernahe Agentenarbeit günstig genug für den ganzen Tag macht. Grok 4.5 verbindet einen ernsthaften Intelligenzsprung mit $2/$6-API-Preisen, hohem Tempo, Grok Build, Cursor und Office. Das ist die praktische Wahl: das gute Modell öfter einsetzen.

Warum es gewinnt

Artificial Analysis bewertet Grok 4.5 mit 54 und Platz vier im Intelligence Index; in Grok Build liegt es als Coding-Agent auf Platz drei und auf GPT-5.5-Codex-Niveau. $2/$6 pro 1M Eingabe-/Ausgabe-Token, $0,50 Cache-Input, rund 91 Token/s und $2,49 pro Coding-Agent-Index-Aufgabe machen das Preis-Leistungs-Argument stark. Grok Build ist das Standard-Zuhause, ergänzt durch Cursor- und Microsoft-Office-Integrationen.

Zu beachten

Das ist ein kostenbereinigtes Comeback, keine bedingungslose Frontier-Krone. Grok 4.5 liegt in mehreren Coding-Tests hinter den Spitzenreitern, ist in der EU noch nicht verfügbar, und Artificial Analysis fand gegenüber Grok 4.3 eine höhere Halluzinationsrate trotz besserer Genauigkeit. Nutze den Preisvorteil zum Prüfen—nicht zum Weglassen der Prüfung.

01

Was es wirklich ist

Eine Zeit lang war Groks Platz in der Modellordnung leicht zu beschreiben: interessant, schnell, gelegentlich frech—aber selten das Werkzeug, das man wählte, wenn die Arbeit wirklich Zähne hatte. Grok 4.5 ändert diesen Satz. Es kehrt nicht mit jedem Pokal zurück, sondern mit einem Taschenrechner.

Artificial Analysis setzt das Modell auf 54 im Intelligence Index, vierter Platz hinter Fable 5, GPT-5.5 und Opus 4.8. Das ist frontiernah im nützlichen Sinne: stark genug für seriöse agentische Arbeit, aber nicht so stark, dass man behaupten müsste, der Gipfel sei schon erreicht. Der Clou ist das Preis-Leistungs-Verhältnis. Die API kostet $2 pro Million Eingabe-Token und $6 pro Million Ausgabe-Token, mit einem Cache-Hit-Preis von $0,50. Artificial Analysis schätzt $0,31 pro Intelligence-Index-Aufgabe und misst 91,3 Token pro Sekunde. Das ist ein seltener Release, bei dem „günstiger“ nicht bedeutet, dass man es nur für einfache Support-Tickets nutzt.

Das Ökosystem gibt dem Modell zudem einen festen Platz. Grok 4.5 ist Standard in Grok Build, läuft in Cursor auf jedem Plan und ist über die xAI-API erreichbar. xAI bringt es zudem in Office-Arbeiten ein: recherchierte Excel-Modelle, PowerPoint-Diagramme und Word-Entwürfe. Das macht Grok 4.5 zu einem idealen Daily Driver für das breite Mittelfeld der Wissensarbeit—Recherche, Tabellen-Iterationen, Analysen, Folien, Produktentwürfe und Agentenschleifen, die auf einem Premium-Flaggschiff zu teuer würden.

API- und Consumer-Preisrechnung sind unterschiedlich. SuperGrok beginnt bei $30 pro Monat: teurer als der übliche individuelle KI-Plan um $20, aber weiterhin ein voll nutzbares Tagesprodukt für Menschen, die Grok Build, höhere Limits und die Consumer-Erfahrung statt einer API-Rechnung möchten. SuperGrok Heavy kostet regulär $300 pro Monat, was für normale tägliche Arbeit ein schlechtes Preis-Leistungs-Verhältnis ist. Zeigt der Checkout die temporäre Heavy-Promotion für $99/Monat, ist das der interessantere Consumer-Sweet-Spot für Menschen, die die größere Nutzung und schwerere Agenten-Workflows wirklich täglich ausschöpfen. Es ist eine Aktion, kein dauerhafter Listenpreis—prüfe vor dem Kauf die aktuelle Planseite.

Der Wert von Grok 4.5 ist einfach: Es macht wiederholte anspruchsvolle Arbeit bezahlbar. Recherche, Tabellen-Iterationen, Analysen, Folien, Produktentwürfe, Cursor-Aufgaben und längere Agentenschleifen profitieren davon, dass ein fähiges Modell einen weiteren Durchgang machen kann. Das ist kein Spezialmodus und kein enger Anwendungsfall, sondern der praktische Vorteil frontiernaher Arbeit, ohne jede Iteration wie einen Premium-Kauf behandeln zu müssen.

Darin steckt eine typische Falle: Eine gute Kostenkurve als Beweis zu nehmen, dass man nicht mehr prüfen muss. Tue genau das Gegenteil. Nutze die Ersparnis, um einen zusätzlichen Testlauf, einen zweiten Quellencheck oder einen weiteren Agentendurchgang zu bezahlen. Für eine einmalige Entscheidung mit hohem Einsatz bleibt der Fall für die Rohfähigkeits-Spitzenreiter stärker—doch die Intelligenz pro Dollar von Grok 4.5 macht genau diese Disziplin bezahlbar.

Der ehrliche Haken betrifft Verfügbarkeit und Kalibrierung. In der EU ist es zum Start noch nicht verfügbar, und Artificial Analysis sah zwar die Genauigkeit steigen, aber eben auch die Halluzinationen. Grok 4.5 ist also nicht der universelle Champion. Es ist die kluge, schnelle Zweitmeinung, die man sich immer wieder leisten kann—was im Arbeitsalltag eine verdammt starke Position ist.

02

Stärken und ehrliche Grenzen

Zentrale Stärken

  • Eine echte Rückkehr an die Frontier: Artificial Analysis gibt Grok 4.5 im Intelligence Index 54 Punkte und Platz vier hinter Fable 5, GPT-5.5 und Opus 4.8 in der Analyse vom 8. Juli. Der Sprung um 16 Punkte gegenüber Grok 4.3 ist kein kosmetisches Versionsnummern-Update.
  • Die Daily-Driver-Ökonomie ist ausgezeichnet: Die API kostet $2 Input / $6 Output pro 1M Token, gecachter Input $0,50. Artificial Analysis berechnet $0,31 pro Intelligence-Index-Aufgabe und platziert das Modell auf der Kosten-Leistungs-Pareto-Front.
  • Schnell genug, um sich wie ein Assistent anzufühlen: Artificial Analysis maß 91,3 Output-Token pro Sekunde auf der First-Party-API. xAI berichtet zudem ungefähr halb so viele Schritte auf vergleichbaren Aufgaben. Tempo ersetzt keine Intelligenz, entscheidet aber darüber, ob du eine zehnte Iteration startest.
  • Ein brauchbares Arbeits-Ökosystem statt nur eines Chat-Tabs: Grok 4.5 ist Standard in Grok Build, läuft in Cursor auf allen Plänen und ist über die API verfügbar. xAI hebt zudem Microsoft Word-, PowerPoint- und Excel-Integrationen für recherchierte Tabellen, Präsentationen und Dokumente hervor.
  • Agentische Wissensarbeit hat unabhängige Signale: Artificial Analysis meldet Platz vier bei GDPval-AA v2 mit 1543 Elo und ein 33%-Spitzenergebnis bei τ³-Banking. Mit 500K Kontext, Bildeingabe und konfigurierbarem Reasoning ist das weit mehr als ein schneller Code-Completer.

Ehrliche Einschränkungen

  • Frontiernah, nicht König der Rohfähigkeit: Im selben unabhängigen Index folgt Grok 4.5 auf Fable 5, GPT-5.5 und Opus 4.8. Das rechtfertigt hier eine starke Value-Position, keine erfundene Behauptung, jedes Flaggschiff zu schlagen.
  • Genauigkeit braucht weiter einen Sicherheitsgurt: Artificial Analysis sah die AA-Omniscience-Genauigkeit von 35% auf 52% steigen, aber auch die Halluzinationsrate von 25% auf 54%. Research-, Finanz- und Office-Ergebnisse brauchen Quellenprüfung.
  • EU-Zugang fehlt zum Start: Laut xAI ist Grok 4.5 noch nicht in EU-Produkten oder der API-Konsole verfügbar; Mitte Juli ist eine Erwartung, keine heutige Verfügbarkeit. Ein guter Preis hilft wenig, wenn man das Modell noch nicht buchen kann.
  • Die Office-Geschichte ist vielversprechend, nicht magisch: Grok Build kann komplexe Excel-Modelle und Office-Artefakte erzeugen, aber Formellogik, Folienfakten und Berechtigungen bleiben deine Verantwortung. Betrachte einen ersten Entwurf als Arbeit eines fähigen Analysten, nicht als signierten Bericht.
  • Effizienzversprechen brauchen einen Aufgabentest: xAI meldet rund 2× Token-Effizienz und weniger Schritte auf vergleichbaren Aufgaben. Das sind wertvolle Signale, doch deine Prompts, Tools, Cache-Treffer und Review-Schleifen bestimmen die echte Rechnung.
03

Benchmark-Übersicht

Artificial Analysis Intelligence Index — 54 (#4)

Unabhängiges Kompositergebnis: Grok 4.5 folgt in der Analyse vom 8. Juli Fable 5, GPT-5.5 und Opus 4.8.

GDPval-AA v2 — 1543 Elo (#4)

Agentische professionelle Arbeit: Grok 4.5 liegt im zitierten Artificial-Analysis-Vergleich zwischen Opus 4.8 und GLM-5.2.

τ³-Banking — 33%

Artificial Analysis meldet hier das Spitzenergebnis, vor GPT-5.5 mit 31% in seiner Release-Analyse.

Intelligence-Index-Kosten — $0,31 pro Aufgabe

Kalkulation von Artificial Analysis aus Token-Nutzung und API-Preisen; sie stützt den Value-Fall, prognostiziert aber nicht jede Rechnung.

04

Das Fazit

Grok 4.5 ist der Comeback-Daily-Driver: nicht das universell stärkste Modell auf jedem Diagramm, aber eine der klügsten Arten, ein Agentenbudget auszugeben. Es hat genügend unabhängige Intelligenz- und Agenten-Signale für die Frontier-Nähe und gewinnt den praktischen Vergleich mit Tempo, $2/$6-Preisen sowie echten Häusern in Grok Build, Cursor und Office. Nutze es für iterative Recherche, Business-Artefakte und normale Agentenarbeit, bei der du das Ergebnis prüfst. Eskaliere zu den Roh-Leadern für die seltene Aufgabe, die wirklich deren Spitzenleistung braucht.

05

Häufig gestellte Fragen