Grok 4.5 から 4.6・4.7 へ:xAI の今夏ペースはどれほど速いか
マスクは7月28日、Rauch への返信で xAI が8月7日前後に1.5兆パラメータの Grok 4.6 を、数週間後に2.1兆パラメータの Grok 4.7 を公開する予定と述べました。Grok 4.5 からわずか1か月——今夏だけで3つのフロンティアモデルが続く計画です。現時点で xAI はベンチマークや料金を公式発表しておらず、以下はマスク本人の発言と業界報道に基づく整理です。
| 日付 | マイルストーン | 主な内容 |
|---|---|---|
| 2026-07-08 | Grok 4.5 公開 | コーディング・エージェント向け。Cursor 共同学習、実開発者セッションデータ、50万 token コンテキスト、$2/$6 per 1M token |
| 2026-07-16 | Kimi K3 ホスト提供開始 | 月之暗面 Kimi K3 がホスト型サービスとして提供開始 |
| 2026-07-26 | Kimi K3 全面オープンウェイト | 2.8兆パラメータ、100万 token コンテキスト——オープンウェイト規模の記録更新 |
| 2026-07-28 | マスクがロードマップ公開 | Rauch への返信で Grok 4.6/4.7 スケジュール初公開——本記事の主情報源 |
| ~2026-08-07 | Grok 4.6(目標) | 1.5兆パラメータ、SFT/RL 強化が焦点——単純な規模拡大ではない |
| ~8月末–9月初 | Grok 4.7(見込み) | 2.1兆パラメータ、4.6 を上回るが推論はやや遅く token 効率は高い——マスク発言 |
マスクのスケジュールは「Musk time」として知られるように、数日到2週間のずれが珍しくありません。公開前は xAI 公式アカウントと x.ai の公告を基準にしてください。
ツイートを公式発表と同等視する:現時点の唯一の情報源は X の返信1件。xAI ブログ・製品ページは未更新です。
1.5T = 能力飛躍と決めつける:マスクは SFT & RL 強化を明示的に強調し、パラメータ数だけではないと述べています。
Kimi K3 の競争圧力を軽視する:Grok 4.6 の目標日は K3 全面公開の約10日後——業界は競争加速と見ています。
Grok 4.6 と 4.7 の役割を混同する:4.6 は後学習精緻化、4.7 はより大きく遅いが token 効率重視——SKU 分担が異なります。
xAI の安全論争を見落とす:7月、xAI は AI 生成ディープフェイク関連で初のユーザー訴訟——企業選定ではコンプライアンスリスクを評価してください。
核心データ:Grok シリーズ vs 同期競合
| モデル | 公開/目標日 | パラメータ | コンテキスト | 料金(入/出 per 1M) | 状態 |
|---|---|---|---|---|---|
| Grok 4.5 | 2026-07-08 | 非公開 | 50万 token | $2 / $6 | 公開済み |
| Grok 4.6(予告) | ~2026-08-07 | 1.5T | 非公開 | 非公開 | 予告のみ、未公開 |
| Grok 4.7(予告) | ~8月末–9月初 | 2.1T | 非公開 | 非公開 | 予告のみ、未公開 |
| Kimi K3 | 2026-07-26 OSS | 2.8T(MoE) | 100万 token | $0.30–3 入 / $15 出 | 公開済み |
| Claude Fable 5.1(噂) | 8月と噂 | 非公開 | 非公開 | 噂 $10/$50 | Anthropic 未確認 |
| GPT-5.6 Sol | 2026-06 | 非公開 | 非公開 | 非公開 | 公開済み |
注:Grok 4.6/4.7 の数値はマスク/xAI 発言ベースで、第三者検証はありません。正式公開まで参考値として扱ってください。
Kimi K3 は Frontend Code Arena で1679点、全クローズドモデルを上回る初のオープンウェイト1位。マスクも K3 関連スレで「印象的」とコメントしています。
深掘り:今回の焦点は「より大きく」ではなく「より学習する」
結論:Grok 4.6 の物語は後学習(SFT + RL)の精緻化であり、純粋なパラメータ増加ではありません。
教師あり微調整(SFT)は高品質な出力例で行動を整形します。強化学習(RL)は報酬信号で多段階エージェントタスクの正しい行動系列を学ばせます。マスクが「SFT & RL を大幅改善」と述べた点は、Grok 4.5 の延長線上です——4.5 は Cursor の実開発者セッションで Terminal-Bench 2.1 83.3%、SWE-Bench Pro 64.7% を達成し、Claude Opus 4.8 と比べ出力 token は約1.9万対6.7万と大幅に少ないです。
1.5T への拡大は事実ですが、4.7(2.1T)は「やや遅いが token 効率は高い」とされ、xAI は「最強」と「最速」を別 SKU で提供する方針を示しています。
7月28日——ロードマップ公開と同日、OpenAI・Anthropic 等1200名超が「Pacing the Frontier」公開書簡に署名し、米政府によるフロンティア AI 減速を求めました。xAI は署名者に含まれていません。
公開前6ステップ:Grok 4.6 を追跡し準備する
xAI 公式チャネルを監視:x.ai ブログ、@xai、@elonmusk——二次報道より公式公告を優先します。
「Musk time」余裕を確保:数日到2週間の遅延は過去にもあり、単日にスケジュールを固定しないでください。
Grok 4.5 を基線に記録:現行 API 料金($2/$6 per 1M)と SWE-Bench Pro 64.7% 等を4.6公開後の比較基準にします。
Kimi K3 と Claude Fable 5.1 を並行評価:8月は集中公開月の可能性——単一ベンダー確定前に長期契約を避けてください。
実タスクで token 効率を測定:自社コードベースで SWE/Agent ワークロードの総コストを比較します。
安全・コンプライアンス審査を組み込む:7月の CSAM 関連訴訟は企業統合前のベンダーリスクとして評価してください。
論点、3つのハードデータ、2026年8月の公開密度
マスクのスケジュールが成立すれば、Grok 4.6・4.7 と噂の Claude Fable 5.1 が同月に登場し、7月の Kimi K3 ショックも重なり、2026年8月は公開密度が極めて高い月になる可能性があります。選定ではtoken 効率と実タスクコスト——パラメータ数やリーダーボード単独より実務的です。
1.5T / Grok 4.6:マスク7月28日 X 投稿——第三者検証・公式モデルカードなし。
4.2× / token 効率:Grok 4.5 は SWE-Bench Pro で約1.9万出力 token、Opus 4.8 は約6.7万——4.5 で実証済みの後学習優位。
1679点 / Kimi K3 Frontend Code Arena:全クローズド上回る初のオープンウェイト1位、Artificial Analysis 智能指数3位。
注意:Grok 4.6 のベンチマークと料金は未公開。7月の CSAM 訴訟——企業選定では安全リスクを考慮してください。
代替案の整理:個人 Mac だけでの Agent 評価・多モデル A/Bはスリープと回線断で長コンテキストが中断しやすいです。クラウド API 一本は8月の集中公開で移行コストが増えます。企業 GPU クラスタ承認待ちはフロンティアの更新速度に追いつきにくいです。iOS CI/CD、ローカル推論、AI Agent 7×24 自動化の本番には、KVMNODE 専用 Mac Mini M4 クラウドレンタルが通常は適した選択です。Apple Silicon 統一メモリ、sudo 開放、日/週/月の柔軟契約。詳細は 料金ページ、ヘルプセンター、直接注文をご覧ください。
データ基準日:2026年7月30日 · 出典:xAI Grok 4.5 公告、マスク 2026-07-28 X 投稿、Moonshot AI Kimi K3、Chain Tech Daily / Tron Weekly、The Verge / TechTimes「Pacing the Frontier」、Ars Technica / TechCrunch xAI 安全論争