Grok 4.5에서 4.6·4.7까지: xAI의 올여름 속도는 얼마나 빠른가
머스크는 7월 28일 Rauch 답글에서 xAI가 8월 7일 전후 1.5조 파라미터 Grok 4.6을, 수주 내 2.1조 파라미터 Grok 4.7을 공개할 것이라고 했습니다. Grok 4.5 출시 후 불과 한 달——올여름만 세 개의 프론티어 모델이 연달아 나올 전망입니다. xAI는 아직 벤치마크·가격을 공식 발표하지 않았으며, 아래는 머스크 발언과 업계 보도를 정리한 것입니다.
| 날짜 | 마일스톤 | 핵심 내용 |
|---|---|---|
| 2026-07-08 | Grok 4.5 출시 | 코딩·에이전트 특화, Cursor 공동 학습, 실제 개발자 세션 데이터, 50만 token 컨텍스트, $2/$6 per 1M token |
| 2026-07-16 | Kimi K3 호스팅 시작 | 월之暗面 Kimi K3 호스팅 서비스 개시 |
| 2026-07-26 | Kimi K3 전면 오픈웨이트 | 2.8조 파라미터, 100만 token 컨텍스트, 오픈웨이트 규모 신기록 |
| 2026-07-28 | 머스크 로드맵 공개 | Rauch 답글로 Grok 4.6/4.7 일정 최초 공개——본문 주요 출처 |
| ~2026-08-07 | Grok 4.6 (목표) | 1.5조 파라미터, SFT/RL 업그레이드 중심——단순 스케일업 아님 |
| ~8월 말–9월 초 | Grok 4.7 (예상) | 2.1조 파라미터, 4.6보다 우수하나 추론은 다소 느리고 token 효율은 더 높음 |
머스크 일정은 업계에서 「Musk time」으로 불릴 만큼 며칠에서 2주 정도 밀리는 경우가 흔합니다. 출시 전 xAI 공식 계정과 x.ai 공지를 기준으로 삼으세요.
트윗을 공식 발표로 간주: 현재 유일한 출처는 X 답글 1건입니다. xAI 블로그·제품 페이지는 미동기화입니다.
1.5T = 능력 폭발로 단정: 머스크는 SFT & RL 강화를 명시했으며 파라미터 수만이 아닙니다.
Kimi K3 경쟁 압력 무시:Grok 4.6 목표일은 K3 전면 공개 약 10일 후——업계는 경쟁 가속으로 해석합니다.
Grok 4.6과 4.7 역할 혼동:4.6은 후학습 정제 SKU, 4.7은 더 크지만 느리고 token 효율 중심입니다.
xAI 안전 논란 간과:7월 xAI가 AI 생성 딥페이크 관련 최초 사용자 소송——기업 선정 시 컴플라이언스 리스크를 평가해야 합니다.
핵심 데이터: Grok 시리즈 vs 동시기 경쟁 모델
| 모델 | 출시/목표일 | 파라미터 | 컨텍스트 | 가격 (입/출 per 1M) | 상태 |
|---|---|---|---|---|---|
| Grok 4.5 | 2026-07-08 | 미공개 | 50만 token | $2 / $6 | 출시됨 |
| Grok 4.6 (예고) | ~2026-08-07 | 1.5T | 미공개 | 미공개 | 예고만, 미출시 |
| Grok 4.7 (예고) | ~8월 말–9월 초 | 2.1T | 미공개 | 미공개 | 예고만, 미출시 |
| Kimi K3 | 2026-07-26 OSS | 2.8T (MoE) | 100만 token | $0.30–3 입 / $15 출 | 출시됨 |
| Claude Fable 5.1 (루머) | 8월 루머 | 미공개 | 미공개 | 루머 $10/$50 | Anthropic 미확인 |
| GPT-5.6 Sol | 2026-06 | 미공개 | 미공개 | 미공개 | 출시됨 |
참고: Grok 4.6/4.7 수치는 머스크/xAI 진술 기준이며 제3자 검증은 없습니다. 정식 출시 전까지 방향성 정보만 참고하세요.
Kimi K3는 Frontend Code Arena 1679점으로 모든 클로즈드 모델을 넘긴 최초 오픈웨이트 1위. 머스크도 K3 관련 스레드에서 「인상적」이라 댓글을 남겼습니다.
심층 분석: 이번 업그레이드의 핵심은 「더 크게」가 아니라 「더 잘 배우기」
결론: Grok 4.6의 서사는 후학습(SFT + RL) 정제이며, 순수 파라미터 증가가 아닙니다.
지도 미세조정(SFT)은 고품질 출력 예시로 행동을 교정합니다. 강화학습(RL)은 보상 신호로 다단계 에이전트 작업의 올바른 행동 순서를 학습시킵니다. 머스크가 「SFT & RL 대폭 개선」을 강조한 것은 Grok 4.5와 동일한 전략입니다——4.5는 Cursor 실개발자 세션으로 Terminal-Bench 2.1 83.3%, SWE-Bench Pro 64.7%를 달성했고, Claude Opus 4.8 대비 출력 token은 약 1.9만 vs 6.7만입니다.
1.5T로의 확대는 분명하지만, 4.7(2.1T)은 「다소 느리지만 token 효율은 더 높다」고 설명되어 xAI가 「더 강함」과 「더 빠름」을 별도 SKU로 나누는 방향을 시사합니다.
7월 28일——로드맵 공개 당일 OpenAI·Anthropic 등 1200명 이상이 「Pacing the Frontier」공개서한에 서명, 미 정부의 프론티어 AI 속도 조절을 요구했습니다. xAI는 서명 목록에 없습니다.
출시 전 6단계: Grok 4.6 추적 및 준비
xAI 공식 채널 모니터링:x.ai 블로그, @xai, @elonmusk——2차 보도보다 공식 공지를 기준으로 합니다.
「Musk time」 여유 확보:며칠~2주 지연은 흔합니다. 단일 날짜에 일정을 고정하지 마세요.
Grok 4.5 기준선 기록:현재 API 가격($2/$6 per 1M)과 SWE-Bench Pro 64.7% 등을 4.6 출시 후 비교 기준으로 둡니다.
Kimi K3·Claude Fable 5.1 병행 평가:8월은 집중 출시월일 수 있습니다——단일 벤더 확정 전 장기 계약을 피하세요.
실제 작업으로 token 효율 측정:자체 코드베이스에서 SWE/Agent 워크로드 총비용을 비교합니다.
안전·컴플라이언스 검토 포함:7월 CSAM 관련 소송——기업 통합 전 벤더 리스크로 평가하세요.
논점, 3가지 하드 데이터, 2026년 8월 출시 밀도
머스크 일정이 맞다면 Grok 4.6·4.7과 루머의 Claude Fable 5.1이 같은 달에 등장하고, 7월 Kimi K3 충격까지 겹쳐 2026년 8월은 출시 밀도가 극히 높은 달이 될 수 있습니다. 선정 기준은 token 효율과 실제 작업 비용——파라미터·리더보드만으로는 부족합니다.
1.5T / Grok 4.6:머스크 7월 28일 X 게시——제3자 검증·공식 모델 카드 없음.
4.2× / token 효율:Grok 4.5 SWE-Bench Pro 약 1.9만 출력 token, Opus 4.8 약 6.7만——4.5에서 검증된 후학습 우위.
1679점 / Kimi K3 Frontend Code Arena:모든 클로즈드 초과 최초 오픈웨이트 1위, Artificial Analysis 지능 지수 3위.
주의:Grok 4.6 벤치마크·가격 미공개. 7월 CSAM 소송——기업 선정 시 안전 리스크를 반영하세요.
대안 정리:개인 Mac만으로 Agent 평가·다중 모델 A/B는 절전·네트워크 끊김으로 장컨텍스트가 중단되기 쉽습니다.클라우드 API 일원화는 8월 집중 출시기 이전 비용이 큽니다.기업 GPU 클러스터 승인 대기는 프론티어 업데이트 속도를 따라가기 어렵습니다. iOS CI/CD, 로컬 추론, AI Agent 7×24 자동화 본番 환경에는 KVMNODE 전용 Mac Mini M4 클라우드 임대가 보통 더 적합합니다. Apple Silicon 통합 메모리, sudo 개방, 일/주/월 유연 과금. 가격 페이지, 고객 센터, 바로 주문을 참고하세요.
데이터 기준: 2026년 7월 30일 · 출처: xAI Grok 4.5 공지, 머스크 2026-07-28 X 게시, Moonshot AI Kimi K3, Chain Tech Daily / Tron Weekly, The Verge / TechTimes 「Pacing the Frontier」, Ars Technica / TechCrunch xAI 안전 논란