Von Grok 4.5 zu 4.6 und 4.7: Wie schnell ist xAI diesen Sommer?
Musk kündigte am 28. Juli in einer Antwort an Rauch Grok 4.6 mit 1,5 Billionen Parametern um den 7. August an, wenige Wochen später Grok 4.7 mit 2,1 Billionen. Nur einen Monat nach Grok 4.5 — xAI plant drei Frontier-Modelle in Folge. Offizielle Benchmarks und Preise fehlen; die folgende Übersicht basiert auf Musks Aussagen und Branchenberichten.
| Datum | Meilenstein | Kerninhalt |
|---|---|---|
| 2026-07-08 | Grok 4.5 veröffentlicht | Coding- und Agent-Fokus, Co-Training mit Cursor, echte Entwicklersitzungen, 500K Token Kontext, $2/$6 pro 1M Token |
| 2026-07-16 | Kimi K3 gehostet | Moonshot AI Kimi K3 als gehosteter Dienst online |
| 2026-07-26 | Kimi K3 vollständig Open Weight | 2,8 Billionen Parameter, 1M Token Kontext — Rekord für Open-Weight-Modelle |
| 2026-07-28 | Musk veröffentlicht Roadmap | Antwort an Rauch — erste öffentliche Grok 4.6/4.7-Timeline, Hauptquelle dieses Artikels |
| ~2026-08-07 | Grok 4.6 (Ziel) | 1,5 Billionen Parameter, Fokus SFT/RL — kein reines Skalieren |
| ~Ende Aug.–Anfang Sep. | Grok 4.7 (geschätzt) | 2,1 Billionen Parameter, laut Musk besser als 4.6, etwas langsamer, höhere Token-Effizienz |
Musks Zeitpläne sind berüchtigt flexibel — „Musk time“ bedeutet oft Verzögerungen von Tagen bis zwei Wochen. Vor dem Release xAI-Offizialkanäle und x.ai als Referenz nutzen.
Tweet als offizielle Ankündigung behandeln: Bislang nur eine X-Antwort — kein xAI-Blog, keine Produktseite.
1,5 Billionen = Capability-Sprung annehmen: Musk betonte ausdrücklich SFT & RL, nicht allein die Parameterzahl.
Kimi-K3-Druck ignorieren: Grok 4.6-Ziel liegt ~10 Tage nach K3s vollständigem Open-Weight-Release — Wettbewerbsbeschleunigung.
Grok 4.6 und 4.7 vermischen: 4.6 = Post-Training-Verfeinerung; 4.7 = größer, langsamer, token-effizienter — unterschiedliche SKUs.
xAI-Sicherheitskontroversen übersehen: Im Juli erste Klage wegen KI-generierter Deepfakes — Compliance-Risiko bei Enterprise-Auswahl.
Kernzahlen: Grok vs. zeitgleiche Wettbewerber
| Modell | Release/Ziel | Parameter | Kontext | Preis (Ein/Aus pro 1M) | Status |
|---|---|---|---|---|---|
| Grok 4.5 | 2026-07-08 | Nicht offengelegt | 500K | $2 / $6 | Veröffentlicht |
| Grok 4.6 (angekündigt) | ~2026-08-07 | 1,5T | Nicht offengelegt | Nicht offengelegt | Nur Ankündigung |
| Grok 4.7 (angekündigt) | ~Ende Aug.–Sep. | 2,1T | Nicht offengelegt | Nicht offengelegt | Nur Ankündigung |
| Kimi K3 | 2026-07-26 OSS | 2,8T (MoE) | 1M | $0,30–3 Ein / $15 Aus | Veröffentlicht |
| Claude Fable 5.1 (Gerücht) | Gerücht Aug. | Nicht offengelegt | Nicht offengelegt | Gerücht $10/$50 | Anthropic unbestätigt |
| GPT-5.6 Sol | 2026-06 | Nicht offengelegt | Nicht offengelegt | Nicht offengelegt | Veröffentlicht |
Hinweis: Grok 4.6/4.7-Zahlen stammen aus Musk/xAI-Aussagen ohne unabhängige Verifikation — erst nach offiziellem Release verbindlich.
Kimi K3 führt die Frontend Code Arena mit 1679 Punkten an — erstes Open-Weight-Modell vor allen Closed-Modellen. Musk kommentierte K3-Benchmarks mit „beeindruckend“.
Deep Dive: Fokus auf Post-Training, nicht nur Skalierung
Fazit: Grok 4.6 erzählt die Geschichte von Post-Training (SFT + RL), nicht eines reinen Parameter-Sprungs.
Supervised Fine-Tuning (SFT) formt Verhalten anhand kuratierter Beispiele; Reinforcement Learning (RL) lehrt über Belohnungssignale korrekte Aktionssequenzen — entscheidend für agentische Mehrschritt-Aufgaben. Musks Betonung von „significantly improved SFT & RL“ setzt Grok 4.5 fort: Terminal-Bench 2.1 83,3 %, SWE-Bench Pro 64,7 %, dabei ~19.000 vs. Opus 4.8 ~67.000 Output-Token pro SWE-Bench-Pro-Task.
1,5T ist ein realer Skalensprung, doch Grok 4.7 (2,1T) soll „in jeder Hinsicht besser, außer etwas langsamer beim Serving“ sein — xAI baut bewusst zwei SKUs mit unterschiedlichen Trade-offs.
Am 28. Juli unterzeichneten über 1200 Mitarbeiter von OpenAI, Anthropic u. a. den offenen Brief „Pacing the Frontier“ und forderten eine Verlangsamung automatisierter Frontier-AI-Entwicklung. xAI fehlt auf der Unterzeichnerliste.
Sechs Schritte vor dem Release: Grok 4.6 verfolgen und vorbereiten
Offizielle xAI-Kanäle beobachten: x.ai/Blog, @xai, @elonmusk — offizielle Ankündigungen vor Sekundärberichten.
„Musk time“-Puffer einplanen: Verzögerungen von Tagen bis Wochen sind üblich — keine harte Ein-Tages-Planung.
Baseline Grok 4.5 dokumentieren: Aktuelle API-Preise ($2/$6 pro 1M) und SWE-Bench Pro 64,7 % als Vergleichsmaßstab.
Kimi K3 und Claude Fable 5.1 parallel bewerten: August könnte Release-Cluster werden — keine Langzeitverträge vor mehreren Launches.
Token-Effizienz an echten Tasks testen: Eigene Codebasis durch SWE/Agent-Workloads — Gesamtkosten, nicht nur Listenpreis.
Sicherheits- und DSGVO-Compliance prüfen: xAIs CSAM-Klage im Juli und Cloud-Verarbeitung personenbezogener Prompts erfordern Datenschutz- und Audit-Bewertung vor Enterprise-Integration.
Kontroversen, drei Hard Facts und Augusts Release-Dichte
Hält Musks Timeline, treffen Grok 4.6, Grok 4.7 und das Gerücht Claude Fable 5.1 im selben Monat auf Kimi K3s Open-Weight-Schock — August 2026 könnte einer der dichtesten Release-Monate werden. Für Teams zählen Token-Effizienz und realer Task-Cost mehr als Parameter oder Leaderboard-Rang allein.
1,5T / Grok 4.6: Musks X-Post vom 28. Juli — keine Drittverifikation, kein Model Card.
4,2× / Token-Effizienz: Grok 4.5 ~19.000 Output-Token vs. Opus 4.8 ~67.000 pro SWE-Bench Pro — in 4.5 verifizierter Post-Training-Vorteil.
1679 Pkt. / Kimi K3 Frontend Code Arena: Erstes Open-Weight-Modell vor allen Closed-Modellen; Artificial Analysis Intelligence Index Platz 3.
Hinweis: Grok 4.6-Benchmarks und Preise fehlen; CSAM-Klage im Juli — Vendor-Risiko in Enterprise-Entscheidungen berücksichtigen.
Alternativen im Vergleich: Agent-Evals auf dem privaten Mac leiden unter Sleep und Netzwerkausfällen; reine Cloud-API-Abhängigkeit bedeutet im August-Migrationsaufwand; Enterprise-GPU-Genehmigung hält selten mit Frontier-Cadence mit. Für produktives iOS-CI/CD, lokale Inferenz und 24/7-AI-Agent-Automatisierung ist KVMNODE dedizierte Mac-Mini-M4-Cloud-Miete meist die bessere Wahl: Apple-Silicon-Unified-Memory, voller sudo-Zugriff, flexible Tages-/Wochen-/Monatsabrechnung. Siehe Preisseite, Hilfezentrum oder direkt bestellen.
Datenstand: 30. Juli 2026 · Quellen: xAI Grok 4.5-Ankündigung, Musks X-Post 28.07.2026, Moonshot AI Kimi K3, Chain Tech Daily / Tron Weekly, The Verge / TechTimes „Pacing the Frontier“, Ars Technica / TechCrunch zu xAI-Sicherheit