Grok 4.7 veröffentlicht: Größeres Modell, gleicher Listenpreis
xAI/SpaceXAI veröffentlicht Grok 4.7 mit größerem Basismodell, unverändertem Preis und 500k Token Kontextfenster – unabhängige Benchmarks zeigen Fortschritte, aber auch höhere Kosten pro Aufgabe.
Mit KI erstelltInhalt
◆ Fakten auf einen Blick
- Grok 4.7 wurde am 21. September 2026 veröffentlicht.
- Der Listenpreis beträgt $2 pro Million Input-Tokens und $6 pro Million Output-Tokens.
- Grok 4.7 ist der Nachfolger von Grok 4.6 und basiert auf einem größeren Basismodell.
- Grok 4.7 wurde mit längerem Reinforcement Learning auf schwierigeren, langlaufenden Aufgaben trainiert.
- Grok 4.7 versteht nativ die Grok Bot Umgebung.
- Grok 4.7 ist verfügbar über Grok API, grok.com, iOS/Android Apps, Cursor, GitHub Copilot, Grok Build und OpenRouter.
Grok 4.7 veröffentlicht: Größeres Modell, gleicher Listenpreis
Am 21. September 2026 hat xAI beziehungsweise SpaceXAI das Sprachmodell Grok 4.7 veröffentlicht. Es ist der Nachfolger von Grok 4.6 und basiert nach Angaben des Unternehmens auf einem größeren Basismodell. Der Listenpreis bleibt unverändert bei 2 US-Dollar pro Million Input-Tokens und 6 US-Dollar pro Million Output-Tokens. Verfügbar ist Grok 4.7 über die Grok API, grok.com, die iOS- und Android-Apps sowie über Cursor, GitHub Copilot, Grok Build und OpenRouter. Das Kontextfenster umfasst weiterhin 500.000 Token. Für das Training setzte das Unternehmen auf längeres Reinforcement Learning mit schwierigeren, langlaufenden Aufgaben; zudem versteht das Modell die hauseigene Agentenumgebung Grok Bot nativ. Im Artificial Analysis Intelligence Index erreicht Grok 4.7 mit der höchsten Reasoning-Stufe xhigh 46 Punkte; das sind zwei Punkte mehr als der Vorgänger Grok 4.6. Laut Unternehmen ist dieser Zuwachs auf das größere Basismodell und das längere Reinforcement-Learning zurückzuführen, das auf schwierigere, langlaufende Aufgaben ausgelegt ist; zusätzlich verbessert das native Verständnis von Grok Bot die Leistung bei Wissensarbeit.
Benchmarks verbessert, aber Kosten pro Aufgabe verdoppelt
Bei unabhängigen Benchmarks verbessert sich Grok 4.7 gegenüber dem Vorgänger teils deutlich. Auf AA-Briefcase, einem Benchmark für langlaufende Wissensarbeit mit Dokumenten, Tabellen und Präsentationen, erreicht das Modell 1657 Elo – ein Plus von 111 Punkten gegenüber Grok 4.6. Der Coding Agent Index steigt von 47 auf 56, Terminal-Bench verbessert sich von 18 auf 33 Prozent. Auf CursorBench 4.0 erreicht Grok 4.7 46,3 Prozent, auf DeepSWE v1.1 bei hoher Reasoning-Stufe 71,0 Prozent und auf EEBench 64,0 Prozent. Allerdings verbraucht das Modell nach Daten von Artificial Analysis pro Aufgabe im Intelligence Index etwa 81.000 Output-Tokens – doppelt so viele wie Grok 4.6. Dadurch steigen die effektiven Kosten pro Task mit xhigh-Reasoning von rund 4,40 auf etwa 8 US-Dollar, obwohl der Preis pro Token unverändert bleibt.
Widerspruch: Schlägt Grok 4.7 Claude wirklich?
Der Hersteller bewirbt Grok 4.7 als das stärkste Modell für Programmierung und Wissensarbeit. Unabhängige Messungen stützen diese Spitzenposition jedoch nicht: Auf AA-Briefcase liegt Grok 4.7 mit 1657 Elo knapp hinter Claude Opus 5 und Claude Fable 5.1. Damit besteht ein Widerspruch zwischen der Herstellerangabe und den Benchmark-Daten. Der Abstand zu den führenden Anthropic-Modellen ist zwar deutlich kleiner als beim Vorgänger, aber die Spitze erreicht Grok 4.7 auf diesem für Enterprise-Analysen relevanten Benchmark nicht.


