Für Entwickler und technische Entscheider, die Grok 4.6 Release-Timing, xAIs Modell-Roadmap und das August-2026-Release-Cluster verfolgen: Elon Musk sagte am 28. Juli 2026 in einer Antwort an Vercel-CEO Guillermo Rauch, xAI plane Grok 4.6 mit 1,5 Billionen Parametern um den 7. August, wenige Wochen später Grok 4.7 mit 2,1 Billionen. Dieser Artikel deckt die Timeline Grok 4.5→4.7, Vergleichstabellen vs. Kimi K3 und Claude Fable 5.1, SFT/RL-Post-Training-Logik, Bestätigt vs. unverifiziert und eine Sechs-Schritte-Checkliste ab. Siehe auch Kimi K3 Open Weight und GPT-6-Vorlauf.
01

Von Grok 4.5 zu 4.6 und 4.7: Wie schnell ist xAI diesen Sommer?

Musk kündigte am 28. Juli in einer Antwort an Rauch Grok 4.6 mit 1,5 Billionen Parametern um den 7. August an, wenige Wochen später Grok 4.7 mit 2,1 Billionen. Nur einen Monat nach Grok 4.5 — xAI plant drei Frontier-Modelle in Folge. Offizielle Benchmarks und Preise fehlen; die folgende Übersicht basiert auf Musks Aussagen und Branchenberichten.

DatumMeilensteinKerninhalt
2026-07-08Grok 4.5 veröffentlichtCoding- und Agent-Fokus, Co-Training mit Cursor, echte Entwicklersitzungen, 500K Token Kontext, $2/$6 pro 1M Token
2026-07-16Kimi K3 gehostetMoonshot AI Kimi K3 als gehosteter Dienst online
2026-07-26Kimi K3 vollständig Open Weight2,8 Billionen Parameter, 1M Token Kontext — Rekord für Open-Weight-Modelle
2026-07-28Musk veröffentlicht RoadmapAntwort an Rauch — erste öffentliche Grok 4.6/4.7-Timeline, Hauptquelle dieses Artikels
~2026-08-07Grok 4.6 (Ziel)1,5 Billionen Parameter, Fokus SFT/RL — kein reines Skalieren
~Ende Aug.–Anfang Sep.Grok 4.7 (geschätzt)2,1 Billionen Parameter, laut Musk besser als 4.6, etwas langsamer, höhere Token-Effizienz

Musks Zeitpläne sind berüchtigt flexibel — „Musk time“ bedeutet oft Verzögerungen von Tagen bis zwei Wochen. Vor dem Release xAI-Offizialkanäle und x.ai als Referenz nutzen.

01

Tweet als offizielle Ankündigung behandeln: Bislang nur eine X-Antwort — kein xAI-Blog, keine Produktseite.

02

1,5 Billionen = Capability-Sprung annehmen: Musk betonte ausdrücklich SFT & RL, nicht allein die Parameterzahl.

03

Kimi-K3-Druck ignorieren: Grok 4.6-Ziel liegt ~10 Tage nach K3s vollständigem Open-Weight-Release — Wettbewerbsbeschleunigung.

04

Grok 4.6 und 4.7 vermischen: 4.6 = Post-Training-Verfeinerung; 4.7 = größer, langsamer, token-effizienter — unterschiedliche SKUs.

05

xAI-Sicherheitskontroversen übersehen: Im Juli erste Klage wegen KI-generierter Deepfakes — Compliance-Risiko bei Enterprise-Auswahl.

02

Kernzahlen: Grok vs. zeitgleiche Wettbewerber

ModellRelease/ZielParameterKontextPreis (Ein/Aus pro 1M)Status
Grok 4.52026-07-08Nicht offengelegt500K$2 / $6Veröffentlicht
Grok 4.6 (angekündigt)~2026-08-071,5TNicht offengelegtNicht offengelegtNur Ankündigung
Grok 4.7 (angekündigt)~Ende Aug.–Sep.2,1TNicht offengelegtNicht offengelegtNur Ankündigung
Kimi K32026-07-26 OSS2,8T (MoE)1M$0,30–3 Ein / $15 AusVeröffentlicht
Claude Fable 5.1 (Gerücht)Gerücht Aug.Nicht offengelegtNicht offengelegtGerücht $10/$50Anthropic unbestätigt
GPT-5.6 Sol2026-06Nicht offengelegtNicht offengelegtNicht offengelegtVeröffentlicht

Hinweis: Grok 4.6/4.7-Zahlen stammen aus Musk/xAI-Aussagen ohne unabhängige Verifikation — erst nach offiziellem Release verbindlich.

Kimi K3 führt die Frontend Code Arena mit 1679 Punkten an — erstes Open-Weight-Modell vor allen Closed-Modellen. Musk kommentierte K3-Benchmarks mit „beeindruckend“.

03

Deep Dive: Fokus auf Post-Training, nicht nur Skalierung

Fazit: Grok 4.6 erzählt die Geschichte von Post-Training (SFT + RL), nicht eines reinen Parameter-Sprungs.

Supervised Fine-Tuning (SFT) formt Verhalten anhand kuratierter Beispiele; Reinforcement Learning (RL) lehrt über Belohnungssignale korrekte Aktionssequenzen — entscheidend für agentische Mehrschritt-Aufgaben. Musks Betonung von „significantly improved SFT & RL“ setzt Grok 4.5 fort: Terminal-Bench 2.1 83,3 %, SWE-Bench Pro 64,7 %, dabei ~19.000 vs. Opus 4.8 ~67.000 Output-Token pro SWE-Bench-Pro-Task.

1,5T ist ein realer Skalensprung, doch Grok 4.7 (2,1T) soll „in jeder Hinsicht besser, außer etwas langsamer beim Serving“ sein — xAI baut bewusst zwei SKUs mit unterschiedlichen Trade-offs.

Am 28. Juli unterzeichneten über 1200 Mitarbeiter von OpenAI, Anthropic u. a. den offenen Brief „Pacing the Frontier“ und forderten eine Verlangsamung automatisierter Frontier-AI-Entwicklung. xAI fehlt auf der Unterzeichnerliste.

04

Sechs Schritte vor dem Release: Grok 4.6 verfolgen und vorbereiten

01

Offizielle xAI-Kanäle beobachten: x.ai/Blog, @xai, @elonmusk — offizielle Ankündigungen vor Sekundärberichten.

02

„Musk time“-Puffer einplanen: Verzögerungen von Tagen bis Wochen sind üblich — keine harte Ein-Tages-Planung.

03

Baseline Grok 4.5 dokumentieren: Aktuelle API-Preise ($2/$6 pro 1M) und SWE-Bench Pro 64,7 % als Vergleichsmaßstab.

04

Kimi K3 und Claude Fable 5.1 parallel bewerten: August könnte Release-Cluster werden — keine Langzeitverträge vor mehreren Launches.

05

Token-Effizienz an echten Tasks testen: Eigene Codebasis durch SWE/Agent-Workloads — Gesamtkosten, nicht nur Listenpreis.

06

Sicherheits- und DSGVO-Compliance prüfen: xAIs CSAM-Klage im Juli und Cloud-Verarbeitung personenbezogener Prompts erfordern Datenschutz- und Audit-Bewertung vor Enterprise-Integration.

05

Kontroversen, drei Hard Facts und Augusts Release-Dichte

Hält Musks Timeline, treffen Grok 4.6, Grok 4.7 und das Gerücht Claude Fable 5.1 im selben Monat auf Kimi K3s Open-Weight-Schock — August 2026 könnte einer der dichtesten Release-Monate werden. Für Teams zählen Token-Effizienz und realer Task-Cost mehr als Parameter oder Leaderboard-Rang allein.

A

1,5T / Grok 4.6: Musks X-Post vom 28. Juli — keine Drittverifikation, kein Model Card.

B

4,2× / Token-Effizienz: Grok 4.5 ~19.000 Output-Token vs. Opus 4.8 ~67.000 pro SWE-Bench Pro — in 4.5 verifizierter Post-Training-Vorteil.

C

1679 Pkt. / Kimi K3 Frontend Code Arena: Erstes Open-Weight-Modell vor allen Closed-Modellen; Artificial Analysis Intelligence Index Platz 3.

Hinweis: Grok 4.6-Benchmarks und Preise fehlen; CSAM-Klage im Juli — Vendor-Risiko in Enterprise-Entscheidungen berücksichtigen.

Alternativen im Vergleich: Agent-Evals auf dem privaten Mac leiden unter Sleep und Netzwerkausfällen; reine Cloud-API-Abhängigkeit bedeutet im August-Migrationsaufwand; Enterprise-GPU-Genehmigung hält selten mit Frontier-Cadence mit. Für produktives iOS-CI/CD, lokale Inferenz und 24/7-AI-Agent-Automatisierung ist KVMNODE dedizierte Mac-Mini-M4-Cloud-Miete meist die bessere Wahl: Apple-Silicon-Unified-Memory, voller sudo-Zugriff, flexible Tages-/Wochen-/Monatsabrechnung. Siehe Preisseite, Hilfezentrum oder direkt bestellen.

Datenstand: 30. Juli 2026 · Quellen: xAI Grok 4.5-Ankündigung, Musks X-Post 28.07.2026, Moonshot AI Kimi K3, Chain Tech Daily / Tron Weekly, The Verge / TechTimes „Pacing the Frontier“, Ars Technica / TechCrunch zu xAI-Sicherheit