Live Grok 4.6 jetzt auf Amazon Bedrock – zweites xAI-Modell im AWS-Katalog

Grok 4.6 jetzt auf Amazon Bedrock – zweites xAI-Modell im AWS-Katalog

Preisaufschläge für Regionen, Widerspruch bei Verfügbarkeit und Benchmark-Streit: Was der Launch für AWS-Kunden bedeutet

· Veröffentlicht: 21.09.2026 ·6 Min Lesezeit
Grok 4.6 jetzt auf Amazon Bedrock – zweites xAI-Modell im AWS-KatalogMit KI erstellt
Inhalt
◆ Fakten auf einen Blick
  • Grok 4.6 ist auf Amazon Bedrock verfügbar; der Launch auf Bedrock erfolgte am 18. August 2026.
  • Grok 4.6 bietet ein Kontextfenster von 500.000 Token.
  • Grok 4.6 unterstützt vier konfigurierbare Reasoning-Stufen: low, medium, high und xhigh.
  • Grok 4.6 ist das zweite xAI-Modell auf Amazon Bedrock; das erste war Grok 4.3, das über den Bedrock Mantle Endpoint (OpenAI-kompatible Inference Engine) erreichbar war.
  • Grok 4.6 ist auf beiden Bedrock-Endpoints verfügbar: bedrock-mantle und bedrock-runtime, und unterstützt die APIs Converse, Chat Completions und Responses.
  • Der Standardpreis für Grok 4.6 beträgt 2 US-Dollar pro Million Input-Token und 6 US-Dollar pro Million Output-Token.

Grok 4.6 jetzt auf Amazon Bedrock – zweites xAI-Modell im AWS-Katalog

Seit dem 18. August 2026 ist Grok 4.6, das aktuelle Sprachmodell von xAI, auf Amazon Bedrock verfügbar. Es ist das zweite xAI-Modell im AWS-Katalog: Das erste, Grok 4.3, war ausschließlich über den Bedrock-Mantle-Endpoint erreichbar, eine OpenAI-kompatible Inference-Engine. Grok 4.6 erweitert diese Fläche deutlich: Es läuft sowohl auf bedrock-mantle als auch auf bedrock-runtime und unterstützt neben Chat Completions und Responses nun auch die Converse API. Zusätzlich ist das Modell in AWS GovCloud (US) verfügbar, sowohl über bedrock-runtime mit Cross-Region Inference als auch über bedrock-mantle in GovCloud (US-East). Die Modell-ID auf Bedrock lautet xai.grok-4.6; für bedrock-runtime werden die Profile us.xai.grok-4.6 (US Geo) und global.xai.grok-4.6 (Global) verwendet. Das Modell bietet ein Kontextfenster von 500.000 Token und vier konfigurierbare Reasoning-Stufen: low, medium, high und xhigh. Grok 4.6 selbst war bereits am 12. August 2026 veröffentlicht worden und kam am 18. August 2026 auf Amazon Bedrock. xAI beschreibt das Modell als Weiterentwicklung von Grok 4.5 mit Fokus auf langlaufende Agenten und ambitioniertere interaktive und visuelle Arbeit. Laut Hersteller wurde es mit einem längeren ergänzenden Trainingslauf trainiert, mit kuratierten modellgenerierten Daten für Reasoning und fortgeschrittene technische Konzepte, hochwertigen Engineering-Daten und einem verbesserten Optimierer.

Preisstruktur: 2/6 Dollar als Basis, aber Aufschläge für Regionen und Service-Tiers

Der Listenpreis für Grok 4.6 beträgt 2 US-Dollar pro Million Input-Token und 6 US-Dollar pro Million Output-Token. Auf Amazon Bedrock ist die Preisstruktur differenzierter: Für In-Region- und Geo-Cross-Region-Inference gelten 2,20 US-Dollar pro Million Input-Token und 6,60 US-Dollar pro Million Output-Token; für Global Cross-Region Inference bleiben es 2,00 beziehungsweise 6,00 US-Dollar. Diese Preise beziehen sich auf den Standard-Service-Tier. Zusätzlich unterstützt Grok 4.6 auf Bedrock die Service-Tiers Priority und Flex: Priority wird mit dem 1,75-fachen des Standardpreises abgerechnet, Flex mit dem 0,5-fachen. Das bedeutet, Kunden können zwischen höherer Priorität und niedrigeren Kosten wählen. Der Priority-Tier eignet sich für latenzkritische Workloads, bei denen Anfragen bevorzugt behandelt werden müssen – etwa interaktive Chat-Anwendungen oder zeitkritische Agentenprozesse. Der Flex-Tier hingegen ist für Batch-Verarbeitung, Hintergrundjobs oder unkritische Inferenz gedacht, bei denen eine längere Wartezeit akzeptabel ist und dafür die Kosten halbiert werden. Die Preisangaben stammen aus der AWS-Modellkarte und der Bedrock-Ankündigung; xAI selbst nennt auf seiner eigenen Seite den Basispreis von 2/6 US-Dollar. Die Abweichung bei In-Region/Geo erklärt sich durch den Aufschlag für die regionale Datenverarbeitung: Wer Daten in einer bestimmten Region verarbeiten lässt, zahlt mehr als bei globaler Verteilung. Der Global-Preis entspricht dem direkten xAI-Preis, da hier keine regionale Bindung besteht. Für Cache-Reads fallen zusätzlich 0,55 US-Dollar pro Million Token bei In-Region/Geo und 0,50 US-Dollar bei Global an. Alle Preise gelten pro eine Million Token. Der Standardpreis von 2/6 US-Dollar ist identisch mit dem von Grok 4.5, wie unabhängige Analysen feststellen. Die Bedrock-spezifischen Aufschläge für In-Region/Geo sind eine Besonderheit der AWS-Plattform: Sie reflektieren die Kosten für die Bereitstellung in dedizierten Regionen.

Widerspruch bei regionaler Verfügbarkeit: Überall oder nur USA?

Bei der Frage, wo Grok 4.6 auf Bedrock verfügbar ist, widersprechen sich die Angaben. AWS selbst erklärt, das Modell sei in jeder AWS-Region verfügbar, in der Amazon Bedrock angeboten wird – das sind über 30 Regionen. Eine unabhängige Analyse kommt dagegen zu dem Schluss, Grok 4.6 sei nur in us-east-1 und us-west-2 verfügbar, weiterhin ohne EU-Region. Der Widerspruch löst sich auf, wenn man zwischen In-Region- und Cross-Region-Inference unterscheidet. Auf dem bedrock-runtime-Endpoint wird Grok 4.6 nicht als In-Region-Inference angeboten. Stattdessen stehen zwei Cross-Region-Profile zur Verfügung: das US-Geo-Profil us.xai.grok-4.6, das Anfragen nur innerhalb der USA verarbeitet, und das Global-Profil global.xai.grok-4.6, das Anfragen aus jeder kommerziellen AWS-Region bedienen kann, in der das Modell verfügbar ist. Das bedeutet: Über bedrock-runtime kann das Modell zwar aus vielen Regionen heraus aufgerufen werden, die Verarbeitung selbst erfolgt jedoch nicht zwingend in der Region des Aufrufers. Für Kunden mit Datenresidenzanforderungen in der EU gibt es keine dedizierte In-Region-Bereitstellung. Der mantle-Endpoint hingegen dient das Modell In-Region aus us-west-2 (Oregon). Die Aussage 'nur us-east-1/us-west-2' aus der unabhängigen Analyse bezieht sich vermutlich auf diese mantle-In-Region-Verfügbarkeit. Die Diskrepanz entsteht also durch die unterschiedlichen Endpoints und Inferenzmodi. Für europäische Kunden bedeutet das: Wer Grok 4.6 über bedrock-runtime nutzt, kann zwar das Global-Profil wählen, hat aber keine Garantie, dass die Daten in der EU verarbeitet werden. Das US-Geo-Profil hält die Verarbeitung in den USA, was für manche Compliance-Anforderungen relevant sein kann.

Benchmark-Streit: SWE-bench 95,6% oder DeepSWE 65,9?

Auch bei den Benchmark-Ergebnissen gibt es auf den ersten Blick widersprüchliche Zahlen. Eine unabhängige Messung von Vals AI attestiert Grok 4.6 einen SWE-bench-Wert von 95,6 Prozent – rund neun Punkte über Grok 4.5. xAI selbst berichtet in seiner offiziellen Tabelle jedoch einen DeepSWE-Anstieg von 54,0 auf 65,9 und einen CursorBench-Anstieg von 66,7 auf 69,9. Der scheinbare Widerspruch löst sich auf, weil es sich um unterschiedliche Benchmarks handelt: SWE-bench misst die Fähigkeit, Software-Engineering-Aufgaben zu lösen, während DeepSWE und CursorBench andere Schwerpunkte setzen, etwa tiefere agentische Softwareentwicklung. Die 95,6 Prozent stammen von Vals AI und sind nicht durch eine Primärquelle von xAI bestätigt; xAIs eigene Angaben beziehen sich auf andere Metriken. Beide Quellen zeigen jedoch, dass Grok 4.6 gegenüber dem Vorgänger in Coding-Benchmarks zulegt, wenn auch in unterschiedlichem Ausmaß. Die Diskrepanz ist also kein Widerspruch in den Fakten, sondern eine Folge verschiedener Messmethoden und Benchmark-Definitionen. Für die Praxis bedeutet das: Wer die Leistung von Grok 4.6 bewerten will, muss genau prüfen, welcher Benchmark gemeint ist und wie er gemessen wurde.

Was der Bedrock-Launch für AWS-Kunden und den KI-Markt bedeutet

Der Bedrock-Launch von Grok 4.6 ist strategisch bedeutsam für beide Seiten. Für AWS erweitert sich der Modellkatalog um ein weiteres Frontier-Modell, das sich nach Herstellerangaben besonders für langlaufende Agenten, Coding und Wissensarbeit eignet. Diese Erweiterung ist nicht nur ein weiterer Eintrag in einer Liste: Grok 4.6 ist das erste xAI-Modell, das auf beiden Bedrock-Endpoints – bedrock-mantle und bedrock-runtime – sowie über die Converse API verfügbar ist. Dadurch können AWS-Kunden das Modell in ihre bestehenden Bedrock-Workflows integrieren, ohne auf einen separaten Endpoint ausweichen zu müssen. Zusätzlich eröffnet die Verfügbarkeit in AWS GovCloud (US) den Zugang für Behörden und regulierte Branchen, die auf diese isolierte Infrastruktur angewiesen sind. Für xAI bedeutet die Integration den Zugang zu AWS-Unternehmenskunden, die bereits über Bedrock Inferenz beziehen, ohne separate Verträge mit xAI abschließen zu müssen. Besonders die GovCloud-Präsenz ist ein Signal: Behörden und regulierte Branchen in den USA können Grok 4.6 nun über die für sie zugelassene Infrastruktur nutzen. Der Launch dürfte den Wettbewerb unter den Modellanbietern auf der AWS-Plattform verschärfen: Mit Grok 4.6 steht nun ein weiteres Frontier-Modell im Bedrock-Katalog, das mit den bereits vorhandenen Angeboten anderer Anbieter konkurriert. Kunden erhalten dadurch mehr Auswahl und können das Modell wählen, das für ihren Anwendungsfall – etwa langlaufende Agenten, Code-Analyse oder Wissensarbeit – am besten geeignet ist. Allerdings bleibt eine Lücke: In der EU gibt es keine In-Region-Inference für Grok 4.6 auf Bedrock. Kunden mit strikten Datenresidenzanforderungen müssen entweder das US-Geo-Profil akzeptieren oder auf andere Modelle ausweichen. Das könnte die Adoption in Europa bremsen. Technisch bleibt Grok 4.6 mit 500.000 Token Kontextfenster und 2/6 US-Dollar Listenpreis auf dem Niveau des Vorgängers; die Verbesserungen liegen vor allem im agentischen Verhalten. xAI beschreibt das Modell als eines, das bei komplexen Aufgaben über viele Schritte hinweg dranbleibt, ob Recherche, Informationsanalyse, Arbeit in einer Codebasis oder Umsetzung einer Idee in eine fertige Anwendung.

A
Andreas Rüdiger
Herausgeber & Redaktionsleitung · KI-Modelle, Technik & Business

Andreas Rüdiger ist Gründer der Agentur INREMA und verantwortet KI Spotlight redaktionell. Sein Schwerpunkt liegt auf KI-Modellen, Recheninfrastruktur, technischen Entwicklungen und der wirtschaftlichen Einordnung. Er sorgt dafür, dass komplexe KI-Themen verständlich und nachvollziehbar aufbereitet werden. Mehr zu ihm auf inrema.de und andiger.de.

Ähnliche Artikel