21 день GPT-5.6: от релиза 9 июля до price cut 30 июля
30 июля 2026 OpenAI пересмотрел прайс GPT-5.6: Luna упал с $1/$6 до $0.20/$1.20 за 1M токенов (−80%), Terra с $2.50/$15 до $2.00/$12 (−20%), Sol standard остался $5/$30, Sol Fast стартовал на $10/$60 с ~2.5× inference throughput — замена Priority Processing. Срез пришёлся на полный open weight Kimi K3 (27 июля) и блог про Sol GPU optimization (29 июля). Консенсус: ответ на open-weight давление, а не добровольная уступка по всей линейке.
| Дата | Веха | Ключевое |
|---|---|---|
| 2026-07-09 | Релиз GPT-5.6 | Sol / Terra / Luna — Sol как flagship agentic coding SKU |
| 2026-07-16 | Kimi K3 hosted API | Moonshot AI выкатывает managed API — сдвиг price expectations |
| 2026-07-27 | Kimi K3 open weight | 2.8T MoE полностью открыт; Artificial Analysis: ~$0.94 per completed task |
| 2026-07-29 | Sol GPU optimization blog | Triton/Gluon kernel rewrite, speculative decoding, KV cache — −20% cost, +15% throughput (vendor self-report) |
| 2026-07-30 | Официальный price cut | Luna −80%, Terra −20%, Sol standard без изменений; Sol Fast $10/$60 |
Важный нюанс: Luna/Terra — list price cut. Нарратив «Sol подорожал» идёт от нового Fast tier: standard Sol не двигался, но latency-sensitive workloads платят 2× за token, если включают Fast.
Luna cut = семейная скидка: Sol standard $5/$30 на месте; premium добавляет только Fast SKU.
Игнор Kimi K3 price anchor: K3 $3/$15 (cache $0.30) = Claude Sonnet 5, но ~6× дороже K2.6 ($0.60/$2.50).
Бронировать Sol optimization savings: −20% inference cost и +15% throughput — internal benchmark OpenAI, third-party replication pending.
Sol Fast = rename Priority Processing: 2.5× speed при 2× price не снижает cost per wall-clock hour автоматически — считайте по SLA.
Reddit polarization как decision input: METR reward-hacking discourse и benchmark trust unresolved — enterprise выбирает по своему workload, не по hot takes.
Price matrix: GPT-5.6 до/после vs Kimi K3, DeepSeek, Claude
| Модель / SKU | До (вх/вых $/M) | После | Δ | Роль |
|---|---|---|---|---|
| GPT-5.6 Luna | $1.00 / $6.00 | $0.20 / $1.20 | −80% | Light / high-volume |
| GPT-5.6 Terra | $2.50 / $15.00 | $2.00 / $12.00 | −20% | Balanced / daily driver |
| GPT-5.6 Sol (standard) | $5.00 / $30.00 | $5.00 / $30.00 | Без изменений | Flagship agentic |
| GPT-5.6 Sol Fast (new) | — (Priority Processing) | $10.00 / $60.00 | New SKU | 2.5× speed, 2× price |
| Конкурент | Input ($/M) | Output ($/M) | AA per-task* | Заметки |
|---|---|---|---|---|
| Kimi K3 | $3.00 (cache $0.30) | $15.00 | ~$0.94 | ~6× vs K2.6 |
| DeepSeek V4 Pro | $0.435 (cache $0.0036) | $0.87 | — | Permanent cut май 2026 |
| DeepSeek V4 Flash | $0.14 | $0.28 | — | Light tier |
| Claude Sonnet 5 | $3.00 (promo $2.00 до 31 авг.) | $15.00 (promo $10.00) | — | List parity с K3 |
| Gemini 3.5 Flash-Lite | ~$2.80/M combined (input+output) | — | Google light tier | |
| MAI-Code-1-Flash | $0.75 | $4.50 | — | GitHub Copilot backend, no standalone API |
| GPT-5.6 Sol (standard) | $5.00 | $30.00 | ~$1.04 | AA чуть выше K3 |
*Artificial Analysis «per completed task» — third-party methodology, не официальный прайс OpenAI. Конкуренты: публичные price sheets июля 2026.
AA per-task: Kimi K3 ~$0.94, GPT-5.6 Sol ~$1.04 — Sol на 9.4% дороже в capability tier; Luna cut радикально сжимает unit cost на light workloads.
Sol переписал GPU kernels — но OpenAI режет Luna, а не Sol: разбор tier logic
Bottom line: engineering blog 29 июля и tier pricing 30 июля — две стороны одной стратегии: internal cost savings → light SKU cuts, latency monetization через Fast, flagship margin на standard Sol.
Sol team claims: Triton/Gluon kernel rewrite, speculative decoding, KV cache layout optimization — ~20% inference cost reduction и ~15% throughput gain в internal tests, FpSan numerical verification для precision. Savings идут в Luna/Terra, не в Sol list price. OpenAI направляет cost wins в volume tiers против DeepSeek V4 Flash ($0.14/$0.28), сохраняя Sol margin.
Sol Fast pricing transparent: $10/$60 = 2× standard за ~2.5× inference speed, replaces Priority Processing. Real-time agent tool calls и interactive IDE completion платят premium; batch offline jobs — standard Sol или discounted Terra. Контраст с Kimi K3: match Sonnet list + 1M context differentiation vs OpenAI SKU ladder approach.
После K3 open weight 27 июля AA pegged K3 ~$0.94 vs Sol ~$1.04 — gap 9.4%. Reddit/X debates про METR reward hacking и vendor-reported benchmarks без independent replication.
Шесть шагов после price cut: reroute, load test, пересчёт bill
Export 30-day token detail: split input/output/cache hits по SKU (Luna/Terra/Sol/Fast) — baseline pre-cut billing.
Remap task tiers: chat, classification, simple completion → Luna ($0.20/$1.20); medium reasoning → Terra; agentic/SWE → standard Sol.
Model Sol Fast ROI: benchmark latency-sensitive paths — 2.5× speed не worth 2× price для каждого workload; не включайте Fast по умолчанию на batch.
Parallel A/B Kimi K3 и DeepSeek V4: total cost на своём codebase, AA per-task methodology — не только list $/M.
Update OpenRouter/LiteLLM routing: Luna new rates в fallback chains; daily spend caps против stale model IDs.
7-day re-test window: watch further Sol/Terra moves; track K3 cache hit rate и K2.6 migration cost для existing users.
Controversies, три hard numbers и narrowing model-selection window
OpenAI price cut split opinion: supporters называют Luna $0.20/M input новой эрой для high-volume apps; skeptics указывают на self-reported Sol −20%/+15%, активный METR discourse и unresolved Reddit benchmark-trust debates. K3 beats Sol на AA per-task cost, но ~6× pricier vs K2.6 — July 2026 «price cut season» не однонаправленная: vendors re-tiering через speed premium, SKU ladders и open-weight anchors.
80% / Luna cut: input $1→$0.20, output $6→$1.20 per OpenAI 30 July announcement — largest list-price move в GPT-5.6 family.
$0.94 vs $1.04 / AA per-task: Kimi K3 ~$0.94, Sol ~$1.04 — Sol 9.4% higher; Luna post-cut widens gap на light workloads.
6× / K3 vs K2.6: K3 standard input $3/M vs K2.6 $0.60/M — open-weight camp не uniformly cheaper; flagship OSS SKUs re-anchoring too.
Важно: Sol GPU optimization figures, METR controversies и AA per-task costs — estimates; validate на своих workloads. Sol Fast 2× price ≠ 2× value автоматически.
Альтернативы: multi-model A/B на личном Mac — sleep interruptions и network drops; pure cloud API в July pricing churn — constant routing rewrites; enterprise GPU cluster approval не успевает за biweekly model/price iteration. Для production iOS CI/CD, local inference и 24/7 AI agent automation выделенная аренда Mac Mini M4 в облаке KVMNODE обычно оптимальнее: Apple Silicon unified memory, full sudo, flexible day/week/month billing. См. страницу цен, центр помощи или оформить заказ.
Данные на 31 июля 2026 · Источники: OpenAI pricing announcement 30.07.2026, Sol GPU optimization blog 29.07.2026, Moonshot AI Kimi K3 release и weight open, Artificial Analysis per-task estimates, DeepSeek V4 official price sheet, Reddit/X, METR coverage