От Grok 4.5 к 4.6 и 4.7: насколько быстр темп xAI этим летом
28 июля в ответе Rauch Маск объявил Grok 4.6 с 1,5 трлн параметров около 7 августа и Grok 4.7 с 2,1 трлн через несколько недель. Всего месяц после Grok 4.5 — три frontier-модели подряд. xAI пока не опубликовала бенчмарки и цены; ниже — сводка по словам Maskа и отраслевым материалам.
| Дата | Веха | Ключевое |
|---|---|---|
| 2026-07-08 | Релиз Grok 4.5 | Кодинг и агенты, co-training с Cursor, реальные сессии разработчиков, контекст 500K токенов, $2/$6 за 1M токенов |
| 2026-07-16 | Kimi K3 в хостинге | Moonshot AI запускает Kimi K3 как hosted-сервис |
| 2026-07-26 | Kimi K3 полный open weight | 2,8 трлн параметров, 1M токенов — рекорд open-weight |
| 2026-07-28 | Дорожная карта Maskа | Ответ Rauch — первая публичная timeline Grok 4.6/4.7, главный источник статьи |
| ~2026-08-07 | Grok 4.6 (цель) | 1,5 трлн параметров, фокус SFT/RL — не просто масштаб |
| ~Конец авг.–нач. сент. | Grok 4.7 (оценка) | 2,1 трлн, по словам Maskа лучше 4.6, но inference чуть медленнее, выше token efficiency |
Сроки Maskа известны гибкостью — «Musk time» часто сдвигается на дни или до двух недель. До релиза ориентируйтесь на официальные аккаунты xAI и x.ai.
Считать твит официальным анонсом: Пока единственный источник — один ответ в X; блог xAI и product page не обновлены.
1,5T = скачок возможностей: Маск явно выделил SFT & RL, а не только число параметров.
Игнорировать давление Kimi K3: Цель Grok 4.6 — ~10 дней после полного open weight K3; отрасль видит гонку.
Смешивать Grok 4.6 и 4.7: 4.6 — post-training refinement SKU; 4.7 — больше, медленнее, эффективнее по токенам.
Не учитывать споры xAI о безопасности: В июле первый иск из-за AI deepfake — compliance-риск при enterprise-выборе.
Ключевые цифры: Grok vs конкуренты того же периода
| Модель | Дата/цель | Параметры | Контекст | Цена (вх/вых за 1M) | Статус |
|---|---|---|---|---|---|
| Grok 4.5 | 2026-07-08 | Не раскрыто | 500K | $2 / $6 | Выпущена |
| Grok 4.6 (анонс) | ~2026-08-07 | 1,5T | Не раскрыто | Не раскрыто | Только анонс |
| Grok 4.7 (анонс) | ~Конец авг.–сент. | 2,1T | Не раскрыто | Не раскрыто | Только анонс |
| Kimi K3 | 2026-07-26 OSS | 2,8T (MoE) | 1M | $0,30–3 вх / $15 вых | Выпущена |
| Claude Fable 5.1 (слух) | Слух август | Не раскрыто | Не раскрыто | Слух $10/$50 | Anthropic не подтвердила |
| GPT-5.6 Sol | 2026-06 | Не раскрыто | Не раскрыто | Не раскрыто | Выпущена |
Цифры Grok 4.6/4.7 — заявления Maskа/xAI без независимой верификации; до официального релиза трактуйте как ориентиры.
Kimi K3 лидирует в Frontend Code Arena с 1679 очками — первая open-weight модель впереди всех closed; Маск прокомментировал K3 как «впечатляющую».
Разбор: апгрейд про post-training, а не только масштаб
Итог: история Grok 4.6 — refinement post-training (SFT + RL), а не чистый прирост параметров.
Supervised fine-tuning (SFT) формирует поведение на курируемых примерах; reinforcement learning (RL) обучает правильным цепочкам действий через reward — критично для многошаговых agentic-задач. Акцент Maskа на «significantly improved SFT & RL» продолжает линию Grok 4.5: Terminal-Bench 2.1 83,3 %, SWE-Bench Pro 64,7 %, ~19 000 output-токенов vs ~67 000 у Claude Opus 4.8 на SWE-Bench Pro.
1,5T — реальный рост масштаба, но Grok 4.7 (2,1T) должен быть «лучше во всём, кроме чуть более медленного serving» — xAI сознательно строит два SKU с разными trade-off.
28 июля более 1200 сотрудников OpenAI, Anthropic и др. подписали «Pacing the Frontier» с призывом замедлить автоматизированную разработку frontier AI. xAI в списке подписантов отсутствует.
Шесть шагов до релиза: отслеживать Grok 4.6 и готовиться
Мониторинг официальных каналов xAI: x.ai/blog, @xai, @elonmusk — официальные анонсы важнее вторичных материалов.
Заложить буфер «Musk time»: Сдвиги на дни–недели типичны — не привязывайте проект к одной дате.
Зафиксировать baseline Grok 4.5: Текущие API-цены ($2/$6 за 1M) и SWE-Bench Pro 64,7 % — этalon для сравнения после 4.6.
Параллельно оценить Kimi K3 и Claude Fable 5.1: Август может стать месяцем плотных релизов — не заключайте долгие контракты до нескольких анонсов.
Измерить token efficiency на реальных задачах: Свой codebase через SWE/agent workloads — полная стоимость, не только прайс за токен.
Включить review безопасности и compliance: Иск xAI по CSAM в июле — vendor risk перед enterprise-интеграцией.
Споры, три hard facts и плотность релизов в августе
Если timeline Maskа сбудется, Grok 4.6, Grok 4.7 и слух Claude Fable 5.1 выйдут в один месяц после open-weight шока Kimi K3 — август 2026 может стать одним из самых плотных месяцев по релизам. При выборе модели token efficiency и реальная стоимость задачи важнее параметров или места в leaderboard.
1,5T / Grok 4.6: Пост Maskа в X 28 июля — без third-party verification и model card.
4,2× / token efficiency: Grok 4.5 ~19 000 output-токенов vs Opus 4.8 ~67 000 на SWE-Bench Pro — проверенное преимущество post-training от 4.5.
1679 / Kimi K3 Frontend Code Arena: Первая open-weight модель впереди всех closed; 3-е место Artificial Analysis Intelligence Index.
Важно: Бенчмарки и цены Grok 4.6 отсутствуют; иск по CSAM в июле — учитывайте vendor risk в enterprise-решениях.
Альтернативы: agent evals и A/B на личном Mac страдают от sleep и обрывов сети; только cloud API в августе даёт постоянные migration costs; ожидание enterprise GPU-кластера редко успевает за cadence frontier-моделей. Для production iOS CI/CD, локального inference и 24/7 AI agent automation выделенная аренда Mac Mini M4 в облаке KVMNODE обычно оптимальнее: unified memory Apple Silicon, полный sudo, гибкая оплата день/неделя/месяц. См. страницу цен, центр помощи или оформить заказ.
Данные на 30 июля 2026 · Источники: анонс Grok 4.5 xAI, пост Maskа в X 28.07.2026, релиз Kimi K3 Moonshot AI, Chain Tech Daily / Tron Weekly, The Verge / TechTimes о «Pacing the Frontier», Ars Technica / TechCrunch о спорах безопасности xAI