AIO APEX

xAI bringt Grok 4.5 heraus – das stärkste Modell mit einem Kontextfenster von 500.000 Token

xAI
Teilen:
xAI bringt Grok 4.5 heraus – das stärkste Modell mit einem Kontextfenster von 500.000 Token

xAI hat Grok 4.5 am 8. Juli veröffentlicht und bezeichnet es als das bisher stärkste Modell des Unternehmens. Trainiert auf Zehntausenden von Nvidia GB300 GPUs und aufbauend auf einem neuen 1,5-Billionen-Parameter-Basismodell namens V9, ist das Modell jetzt in Grok Build, allen Cursor-Plänen und über die xAI-API-Konsole verfügbar.

Was das Modell kann

Grok 4.5 unterstützt ein Kontextfenster von 500.000 Token sowie Text- und Bildeingabe, Funktionsaufrufe, strukturierte Ausgaben, Web- und X-Suche, Codeausführung und konfigurierbare Reasoning-Tiefe. xAI liefert es mit etwa 80 Token pro Sekunde aus, und das Unternehmen gibt an, dass es bei vergleichbaren Aufgaben die doppelte Token-Effizienz im Vergleich zu konkurrierenden Frontier-Modellen bietet – das bedeutet, dass es gleichwertige Ergebnisse bei geringerem Token-Verbrauch erzielen kann, was die effektiven Kosten einer bestimmten Aufgabe selbst vor Berücksichtigung des Listenpreises senkt.

Die Preisgestaltung liegt bei 2 US-Dollar pro Million Input-Token und 6 US-Dollar pro Million Output-Token, mit einem ermäßigten Satz von 0,50 US-Dollar pro Million für gecachten Input und höheren Sätzen, sobald eine Anfrage 200.000 Token überschreitet.

Benchmark-Ergebnisse mit einigen Einschränkungen

xAI positioniert Grok 4.5 in erster Linie als Modell für Codierung und agentische Arbeit. Im SWE Marathon Benchmark – einem Test für anhaltende, mehrstufige Softwareentwicklungsaufgaben – erzielte Grok 4.5 eine Lösungsrate (Pass@1) von 29,0 %, vor Anthropics Opus 4.8 mit 26,0 % und xAIs eigenem früheren Modell Fable mit 24,0 %. Das Modell führt auch bei DeepSWE 1.0 (62,0 %) und Terminal-Bench 2.1 (83,3 %).

Diese Führungsposition ist jedoch nicht universell. Von den vier Benchmarks, die xAI zusammen mit der Veröffentlichung veröffentlicht hat, gewinnt Grok 4.5 zwei und verliert zwei gegen Opus 4.8 – eine Aufteilung, die darauf hindeutet, dass das Modell einen echten Fortschritt in bestimmten Codierungsworkflows darstellt, aber keine flächendeckende Verbesserung gegenüber allen Konkurrenten bei jeder Aufgabe.

Verfügbarkeitslücke in der EU

Grok 4.5 ist für europäische Nutzer weder über xAIs eigene Produkte noch über die API-Konsole verfügbar. xAI gibt an, dass der Zugang in der EU für Mitte Juli erwartet wird, ohne ein festes Datum zu nennen. Diese Verzögerung reiht Grok 4.5 in ein Muster von KI-Modellveröffentlichungen im Jahr 2026 ein, bei dem regulatorische Prüfungen – sei es die Einhaltung des EU AI Act oder ähnliche Prozesse – das ursprüngliche Veröffentlichungsdatum eines Modells um Tage bis Wochen von seiner Verfügbarkeit in Europa getrennt haben.

Wettbewerbskontext

Die Veröffentlichung erfolgt in derselben Woche, in der OpenAI die schrittweise Einführung seiner GPT-5.6-Familie (Sol, Terra und Luna) abschließt, und setzt Anthropic unter Druck, dessen Opus 4.8 in zwei der vier von xAI ausgewählten Benchmarks weiterhin wettbewerbsfähig ist. Für Entwickler, die zwischen den führenden Codierungsmodellen wählen, lautet die praktische Erkenntnis, dass derzeit kein einziges Modell in allen Bereichen führend ist – die Ergebnisse von Grok 4.5 in SWE Marathon und Terminal-Bench machen es zu einer starken Wahl für bestimmte agentische Codierungsaufgaben, während Opus 4.8 bei den Benchmarks, die xAI nicht gewonnen hat, weiterhin vorn liegt.

Originally reported by xAI. Read the original article for additional details.

View original source
Teilen: