innFactory AI Consulting aus Rosenheim berät Unternehmen im DACH-Raum zur DSGVO-konformen Integration von Grok. Mit dem neuen Flaggschiff Grok 4.6 (12. August 2026), dem Vorgänger Grok 4.5 (8. Juli 2026), der General Availability von Grok 4.3 (Mai 2026) und dem Coding-Modell Grok Build 0.1 hat der Anbieter sein Portfolio 2026 deutlich erweitert – und sich zugleich neu aufgestellt: xAI ist mit SpaceX zusammengeführt und firmiert laut eigenen Angaben und Medienberichten inzwischen als SpaceXAI; die Coding-Firma Cursor wurde übernommen. Stand dieser Übersicht: 22. August 2026.
Neu im August 2026: Grok 4.6
Am 12. August 2026 hat SpaceXAI Grok 4.6 vorgestellt – das aktuelle Frontier-Modell für Coding, agentische Aufgaben und Wissensarbeit. Der Schwerpunkt liegt laut Anbieter auf lang laufenden Agenten und mehrstufigen, interaktiven Aufgaben: vom Recherchieren und Analysieren über Arbeit an einer ganzen Codebase bis zur Umsetzung einer Produktidee in eine lauffähige Anwendung.
Die wichtigsten Eckdaten laut xAI-Doku:
- Kontextfenster: 500.000 Token, Text- und Bild-Input, Textausgabe ohne dokumentiertes Ausgabelimit
- Reasoning-Effort: vier Stufen –
low,medium,high(Default) undxhigh - API-Preis: $2 Input / $0,50 Cache-Read / $6 Output pro 1M Tokens bei Prompts unter 200k Tokens; ab 200k Tokens $4 / $1 / $12
- Wissensstand: 1. Februar 2026
- Benchmarks (Herstellerangaben): laut xAI 61 Punkte im Artificial Analysis Intelligence Index, dazu CursorBench 3.2 69,9 %, DeepSWE 1.1 65,9 % und FrontierCode 1.1 61,3 %
Verfügbar ist Grok 4.6 über die SpaceXAI-API und -Konsole, in Cursor und Grok Build sowie über Partner wie OpenRouter, Vercel und Cloudflare. Ebenfalls neu im August: Grok Bot, laut Release Notes dauerhaft laufende Agenten auf Cloud-Infrastruktur mit Messaging, Freigaben und Connectors, ist allgemein verfügbar.
Grok 4.6 auf Amazon Bedrock – mit wichtiger Einschränkung
Seit dem 19. August 2026 ist Grok 4.6 allgemein auf Amazon Bedrock verfügbar (Modell-Launch-Datum laut Model Card: 18. August 2026). Das ist eine spürbare Öffnung, denn bis dahin war Grok für Bedrock-Kunden praktisch nicht nutzbar. Für die DSGVO-Bewertung ist allerdings entscheidend, wie Bedrock das Modell anbietet:
- Es gibt zwei Cross-Region-Inferenzprofile:
us.xai.grok-4.6(US Geo, Routing ausschließlich innerhalb der USA) undglobal.xai.grok-4.6(weltweites Routing). - Ein EU-Geo-Profil existiert laut AWS-Dokumentation nicht. In den EU-Regionen (u. a. Frankfurt, Irland, Stockholm, Zürich, Paris, Mailand, Madrid, London) ist ausschließlich das Global-Profil freigeschaltet.
- In-Region-Inferenz über
bedrock-runtimewird nicht unterstützt; nur über denbedrock-mantle-Endpunkt in us-west-2.
Für EU-Unternehmen heißt das: Man kann Grok 4.6 aus einem europäischen AWS-Konto heraus aufrufen – die Verarbeitung ist dabei aber nicht auf die EU begrenzt. Wer Datenresidenz in der EU braucht, erreicht sie über Bedrock bei Grok derzeit nicht.
Bedrock-Preise (Standard-Tier, pro 1M Token): Global CRIS 2,00 USD Input / 6,00 USD Output / 0,50 USD Cache-Read; US Geo 2,20 / 6,60 / 0,55 USD. Die Tiers Priority (2x) und Flex (0,5x) werden unterstützt, ein Reserved-Tier nicht.
Grok 4.5: Vorgänger-Flaggschiff (Juli 2026)
Am 8. Juli 2026 hat SpaceXAI Grok 4.5 veröffentlicht – nach einer privaten Beta bei SpaceX und Tesla seit Ende Juni. Das Modell basiert auf der V9-Foundation-Architektur mit rund 1,5 Billionen Parametern und war als „Workhorse“ für Coding, agentische Aufgaben und Wissensarbeit positioniert; Elon Musk beschrieb es als „Opus-class model, but faster, more token-efficient and lower cost“.
Die wichtigsten Eckdaten:
- Kontextfenster: 500.000 Token
- API-Preis: $2 Input / $0,30 Cache-Read / $6 Output pro 1M Tokens unter 200k Tokens; darüber $4 / $0,60 / $12
- Features: Reasoning-Level (low/medium/high), Prompt Caching, Context Compaction für lange Agent-Loops, Function Calling, Web-/X-Suche, Code Execution
- Benchmarks (Herstellerangaben): u. a. 83,3 % auf Terminal-Bench 2.1 und 62,0 % auf DeepSWE 1.0; eine unabhängige Snorkel-Auswertung (GDPVal+) sah Grok 4.5 mit 29 % Pass-Rate vor GPT-5.5 (22 %) und Opus 4.8 (21 %). Klassische Benchmarks wie MMLU oder GPQA wurden zum Launch nicht publiziert.
- Token-Effizienz: laut Anbieter ca. 4x weniger Output-Tokens pro SWE-Bench-Pro-Aufgabe als Opus 4.8 (max)
Update zur EU-Verfügbarkeit: Zum Launch war Grok 4.5 laut offizieller Doku nicht für EU-Nutzer in der API-Konsole verfügbar. Laut den xAI-Release-Notes wurde der Zugang für EU-Nutzer noch im Juli 2026 freigeschaltet. Auf Microsoft Foundry ist Grok 4.5 weiterhin nicht gelistet.
Neu im Mai/Juni 2026
Grok 4.3 ist jetzt General Availability
Nach dem Beta-Start im April 2026 hat xAI Grok 4.3 Anfang Mai 2026 in den allgemeinen Rollout überführt. Zusätzlich zur multimodalen Video-Verarbeitung und dem 1M Token Context-Fenster bringt die GA-Version:
- Custom Skills: persistente Expertise (Formatierungsregeln, Workflow-Schritte, Dokumentstile), die Grok über alle Konversationen hinweg automatisch anwendet
- Integrierte Code-Execution-Umgebung: Grok kann Code schreiben, ausführen, Abhängigkeiten installieren und echte Dateien produzieren
Grok Build 0.1: Dediziertes Coding-Modell
Am 29. Mai 2026 hat xAI Grok Build 0.1 in Public Beta auf der xAI API veröffentlicht. Das Modell ist speziell für agentisches Coding trainiert:
- 256K Token Context-Fenster
- Text- und Bild-Input (z. B. UI-Mockups, Architekturdiagramme, Fehler-Screenshots)
- Native MCP-Unterstützung und Integration mit Cursor, Kilo Code, OpenCode u. a.
- Inferenzgeschwindigkeit > 100 Tokens/Sekunde
- Preis: $1 pro 1M Input-Tokens, $2 pro 1M Output-Tokens, Cache-Read $0,20 pro 1M Tokens
Technische Stärken von Grok 4.3
Erweiterte Kontextverarbeitung
Mit einem Context-Fenster von 1 Million Tokens gehört Grok 4.3 zu den leistungsfähigsten Modellen für die Verarbeitung umfangreicher Dokumente. Für Unternehmen bedeutet dies:
- Vollständige Analyse kompletter Codebases ohne Aufteilung
- Verarbeitung umfangreicher Verträge und technischer Dokumentationen in einem Durchgang
- Konsistente Analyse langer Gesprächsverläufe und Protokolle
Benchmark-Ergebnisse
Die aktuellen Leistungstests zeigen starke Ergebnisse:
- MMLU (Multitask Understanding): 89,5% - auf Augenhöhe mit führenden Modellen
- LiveCodeBench: 79,4% mit Tool-Use - übertrifft viele etablierte Konkurrenten
- SWE-Bench (Software Engineering): 75% - führend bei realen Coding-Aufgaben
- GPQA (Graduate Science): 88% - herausragend bei wissenschaftlichen Fragestellungen
Agentic Capabilities
Grok 4.3 bietet erweiterte Fähigkeiten für autonome Multi-Step-Aufgaben:
- Reduzierte Halluzinationsrate um 65% gegenüber Vorgängern
- Verbesserte Generalisierung von Programmierlogik über Sprachgrenzen hinweg
- Native Integration von Web- und X-Suche für aktuelle Informationen
EU-Verfügbarkeit und DSGVO-Konformität
Microsoft Foundry (vormals Azure AI Foundry)
Laut Microsoft-Dokumentation (Stand 20. August 2026) stehen im Foundry-Katalog folgende Grok-Modelle als „sold by Azure" bereit: grok-4.3 (Preview), grok-4-20-reasoning und grok-4-20-non-reasoning (Preview), grok-4.1-fast-reasoning und -non-reasoning, grok-4 sowie grok-code-fast-1. Für grok-4 und grok-code-fast-1 ist eine Registrierung erforderlich.
Die aktuellen Modelle Grok 4.5 und Grok 4.6 sind dort nicht gelistet. Wer Grok mit Microsoft-Governance einsetzen will, arbeitet also mit einer älteren Generation. Die konkrete Regionsverfügbarkeit unterscheidet sich je Modell und Deployment-Kategorie und sollte vor der Entscheidung in der Microsoft-Doku geprüft werden.
AWS Bedrock: verfügbar, aber ohne EU-Geo-Inferenz
Seit Juni 2026 ist Grok 4.3 auf Amazon Bedrock gelistet, seit dem 19. August 2026 auch Grok 4.6. Für DSGVO-Zwecke ist das Bild allerdings differenziert:
| Modell | Bedrock-Verfügbarkeit | EU-Datenresidenz |
|---|---|---|
| Grok 4.6 | US-Geo-Profil (us.xai.grok-4.6) und Global-Profil (global.xai.grok-4.6); aus EU-Regionen nur Global | Nein – kein EU-Geo-Profil |
| Grok 4.3 | In-Region nur in us-west-2, us-east-1, us-east-2 | Nein – keine EU-Region |
Zum Vergleich: Für Anthropic-Modelle bietet Bedrock ein EU-Geo-Inferenzprofil, das Anfragen ausschließlich innerhalb der EU-Geografie routet. Für Grok existiert ein solches Profil bislang nicht.
Google Cloud
Grok-Modelle sind auf der Gemini Enterprise Agent Platform (vormals Vertex AI) weiterhin nicht verfügbar – auch nicht in Frankfurt (europe-west3).
Fazit für die Praxis: Wer Grok mit strikter EU-Datenresidenz betreiben will, hat derzeit keinen sauberen Weg. Über Microsoft Foundry sind nur ältere Generationen verfügbar, über Bedrock nur ohne EU-Routing, über Google Cloud gar nicht. Für DSGVO-sensible Verarbeitungen empfehlen wir daher weiterhin die Alternativen im nächsten Abschnitt.
Preisgestaltung
Preise laut SpaceXAI-Modelldokumentation (Stand 22. August 2026), jeweils Input / Cache-Read / Output pro 1M Tokens. Ab 200.000 Tokens Prompt-Länge gilt bei allen Modellen der jeweils doppelte Tarif.
| Modell | < 200k Tokens | ab 200k Tokens | Kontext |
|---|---|---|---|
| Grok 4.6 | $2,00 / $0,50 / $6,00 | $4,00 / $1,00 / $12,00 | 500k |
| Grok 4.5 | $2,00 / $0,30 / $6,00 | $4,00 / $0,60 / $12,00 | 500k |
| Grok 4.3 | $1,25 / $0,20 / $2,50 | $2,50 / $0,40 / $5,00 | 1M |
| Grok 4.20 (Reasoning / Non-Reasoning / Multi-Agent) | $1,25 / $0,20 / $2,50 | $2,50 / $0,40 / $5,00 | 1M |
| Grok Build 0.1 | $1,00 / $0,20 / $2,00 | $2,00 / $0,40 / $4,00 | 256k |
Zusätzliche Modalitäten laut Preisliste: Grok Imagine Image 2.0 ($0,04 pro Bild), Grok Imagine Video 1.5 ($0,080 pro Sekunde) und die Grok Voice API ($0,08 pro Audiominute).
Auf Amazon Bedrock (Standard-Tier, pro 1M Token): Grok 4.6 kostet über das Global-Profil 2,00 USD Input / 6,00 USD Output / 0,50 USD Cache-Read, über das US-Geo-Profil 2,20 / 6,60 / 0,55 USD. Der Priority-Tier wird mit dem 2-Fachen, der Flex-Tier mit dem 0,5-Fachen abgerechnet.
Tool-Aufrufe:
- Web/X-Suche, Code Execution: $5 per 1.000 Aufrufe
- Batch-API: 50% Rabatt für asynchrone Verarbeitung
Einsatzbereiche für DACH-Unternehmen
Technische Analysen
- Software-Engineering-Aufgaben mit vollständigem Codebase-Verständnis
- Automatisierte Code-Reviews und Refactoring-Vorschläge
- Technische Dokumentationsanalyse
Wissenschaftliche Anwendungen
- Verarbeitung umfangreicher Forschungsdokumente
- MINT-bezogene Fragestellungen und Berechnungen
- Graduate-Level wissenschaftliche Analysen
Social Media und Trend-Monitoring
- Integration mit X/Twitter für Echtzeit-Datenanalysen
- Content-Erstellung mit aktuellem Kontext
- Trend-Identifikation und Marktbeobachtung
Kritische Betrachtung
Ethische und praktische Bedenken
Trotz technischer Stärken bestehen bei Grok weiterhin Bedenken:
- Kontroversen: Verbindung zu Elon Musk und politischen Positionen
- Minimale Sicherheitsfilter: Kann für regulierte Branchen problematisch sein
- Keine EU-Datenresidenz: Microsoft Foundry führt nur ältere Generationen, Bedrock bietet für Grok kein EU-Geo-Profil, Google Cloud gar keine Grok-Modelle
- Wissensstand: Training bis 1. Februar 2026 (Grok 4.6), danach nur via Web-Suche aktuell
Bessere Alternativen für Unternehmenseinsatz
Für professionelle Anwendungen im DACH-Raum empfehlen wir häufig:
| Anwendung | Alternative |
|---|---|
| Allgemeine LLM-Aufgaben | Anthropic Claude |
| Code-Generierung | OpenAI GPT-4 |
| Open Source & Flexibilität | Meta Llama oder Qwen |
| DSGVO-konforme Lösung | CompanyGPT |
Integration mit CompanyGPT
Unsere CompanyGPT-Lösung bietet eine DSGVO-konforme Alternative, die verschiedene Modelle kombiniert und dabei höchste Datenschutzstandards gewährleistet. Für Unternehmen, die auf der sicheren Seite bleiben möchten, ist dies oft die bessere Wahl.
Ausblick
Das im Frühjahr angekündigte Foundation-Modell „Grok V9-Medium“ (1,5 Billionen Parameter) ist als Grok 4.5 erschienen, der Nachfolger Grok 4.6 folgte gut fünf Wochen später. Grok 5 ist zum Stand 22. August 2026 weiterhin nicht veröffentlicht; das Modell befindet sich laut Medienberichten im Training, ein bestätigter Termin liegt nicht vor. Ebenfalls aus Sekundärquellen stammt die Angabe, ein größeres Grok 4.7 sei in Vorbereitung. Wir behandeln beides als unbestätigt.
Der Takt ist bemerkenswert: Zwischen Grok 4.3 (Mai), 4.5 (Juli) und 4.6 (August) lagen jeweils nur wenige Wochen. Für produktive Integrationen heißt das, Modell-IDs zentral zu konfigurieren statt sie im Anwendungscode zu verteilen – sonst wird jeder Generationswechsel zum Release.
Unsere Empfehlung
Grok 4.6 ist seit dem 12. August 2026 der neue Standard im Grok-Portfolio für Coding- und Agent-Aufgaben – mit 500k Kontext, vier Reasoning-Stufen und einem attraktiven Preis. Seit dem 19. August 2026 ist es zudem auf Amazon Bedrock verfügbar, was Governance und Abrechnung für AWS-Kunden vereinfacht. Grok 4.3 bleibt mit 1M-Token-Context, Custom Skills und Code-Execution das bewährte Allround-Modell; für reines Coding ist das günstigere Grok Build 0.1 eine Alternative.
Allerdings: Die ethischen Bedenken, die minimalen Sicherheitsfilter und vor allem die fehlende EU-Datenresidenz machen Grok für viele Unternehmen im regulierten Umfeld zu einer riskanten Wahl. Die Bedrock-Verfügbarkeit ändert daran nichts, solange es kein EU-Geo-Inferenzprofil gibt. Für geschäftskritische und personenbezogene Verarbeitungen empfehlen wir etablierte Alternativen mit strengeren Governance-Standards und belegbarer EU-Datenhaltung.
Für eine individuelle Beratung zur passenden KI-Strategie und DSGVO-konformen Implementierung kontaktieren Sie innFactory AI Consulting.
