Для разработчиков и техлидов, которые следят за снижением цен GPT-5.6, ценовой стратегией OpenAI API и ценовой войной LLM в июле 2026: 30 июля OpenAI уронил Luna на 80% ($1/$6 → $0.20/$1.20), Terra на 20% ($2.50/$15 → $2.00/$12), оставил Sol standard на $5/$30 и выкатил Sol Fast ($10/$60, ~2.5× inference speed). Разбираем таймлайн 9–30 июля, матрицу до/после vs Kimi K3, DeepSeek, Claude, GPU self-optimization Sol (Triton/Gluon, FpSan), чеклист из шести шагов и три hard numbers. См. также разбор Kimi K3 open weight и GPT-6 на подходе.
01

21 день GPT-5.6: от релиза 9 июля до price cut 30 июля

30 июля 2026 OpenAI пересмотрел прайс GPT-5.6: Luna упал с $1/$6 до $0.20/$1.20 за 1M токенов (−80%), Terra с $2.50/$15 до $2.00/$12 (−20%), Sol standard остался $5/$30, Sol Fast стартовал на $10/$60 с ~2.5× inference throughput — замена Priority Processing. Срез пришёлся на полный open weight Kimi K3 (27 июля) и блог про Sol GPU optimization (29 июля). Консенсус: ответ на open-weight давление, а не добровольная уступка по всей линейке.

ДатаВехаКлючевое
2026-07-09Релиз GPT-5.6Sol / Terra / Luna — Sol как flagship agentic coding SKU
2026-07-16Kimi K3 hosted APIMoonshot AI выкатывает managed API — сдвиг price expectations
2026-07-27Kimi K3 open weight2.8T MoE полностью открыт; Artificial Analysis: ~$0.94 per completed task
2026-07-29Sol GPU optimization blogTriton/Gluon kernel rewrite, speculative decoding, KV cache — −20% cost, +15% throughput (vendor self-report)
2026-07-30Официальный price cutLuna −80%, Terra −20%, Sol standard без изменений; Sol Fast $10/$60

Важный нюанс: Luna/Terra — list price cut. Нарратив «Sol подорожал» идёт от нового Fast tier: standard Sol не двигался, но latency-sensitive workloads платят 2× за token, если включают Fast.

01

Luna cut = семейная скидка: Sol standard $5/$30 на месте; premium добавляет только Fast SKU.

02

Игнор Kimi K3 price anchor: K3 $3/$15 (cache $0.30) = Claude Sonnet 5, но ~6× дороже K2.6 ($0.60/$2.50).

03

Бронировать Sol optimization savings: −20% inference cost и +15% throughput — internal benchmark OpenAI, third-party replication pending.

04

Sol Fast = rename Priority Processing: 2.5× speed при 2× price не снижает cost per wall-clock hour автоматически — считайте по SLA.

05

Reddit polarization как decision input: METR reward-hacking discourse и benchmark trust unresolved — enterprise выбирает по своему workload, не по hot takes.

02

Price matrix: GPT-5.6 до/после vs Kimi K3, DeepSeek, Claude

Модель / SKUДо (вх/вых $/M)ПослеΔРоль
GPT-5.6 Luna$1.00 / $6.00$0.20 / $1.20−80%Light / high-volume
GPT-5.6 Terra$2.50 / $15.00$2.00 / $12.00−20%Balanced / daily driver
GPT-5.6 Sol (standard)$5.00 / $30.00$5.00 / $30.00Без измененийFlagship agentic
GPT-5.6 Sol Fast (new)— (Priority Processing)$10.00 / $60.00New SKU2.5× speed, 2× price
КонкурентInput ($/M)Output ($/M)AA per-task*Заметки
Kimi K3$3.00 (cache $0.30)$15.00~$0.94~6× vs K2.6
DeepSeek V4 Pro$0.435 (cache $0.0036)$0.87Permanent cut май 2026
DeepSeek V4 Flash$0.14$0.28Light tier
Claude Sonnet 5$3.00 (promo $2.00 до 31 авг.)$15.00 (promo $10.00)List parity с K3
Gemini 3.5 Flash-Lite~$2.80/M combined (input+output)Google light tier
MAI-Code-1-Flash$0.75$4.50GitHub Copilot backend, no standalone API
GPT-5.6 Sol (standard)$5.00$30.00~$1.04AA чуть выше K3

*Artificial Analysis «per completed task» — third-party methodology, не официальный прайс OpenAI. Конкуренты: публичные price sheets июля 2026.

AA per-task: Kimi K3 ~$0.94, GPT-5.6 Sol ~$1.04 — Sol на 9.4% дороже в capability tier; Luna cut радикально сжимает unit cost на light workloads.

03

Sol переписал GPU kernels — но OpenAI режет Luna, а не Sol: разбор tier logic

Bottom line: engineering blog 29 июля и tier pricing 30 июля — две стороны одной стратегии: internal cost savings → light SKU cuts, latency monetization через Fast, flagship margin на standard Sol.

Sol team claims: Triton/Gluon kernel rewrite, speculative decoding, KV cache layout optimization — ~20% inference cost reduction и ~15% throughput gain в internal tests, FpSan numerical verification для precision. Savings идут в Luna/Terra, не в Sol list price. OpenAI направляет cost wins в volume tiers против DeepSeek V4 Flash ($0.14/$0.28), сохраняя Sol margin.

Sol Fast pricing transparent: $10/$60 = 2× standard за ~2.5× inference speed, replaces Priority Processing. Real-time agent tool calls и interactive IDE completion платят premium; batch offline jobs — standard Sol или discounted Terra. Контраст с Kimi K3: match Sonnet list + 1M context differentiation vs OpenAI SKU ladder approach.

После K3 open weight 27 июля AA pegged K3 ~$0.94 vs Sol ~$1.04 — gap 9.4%. Reddit/X debates про METR reward hacking и vendor-reported benchmarks без independent replication.

04

Шесть шагов после price cut: reroute, load test, пересчёт bill

01

Export 30-day token detail: split input/output/cache hits по SKU (Luna/Terra/Sol/Fast) — baseline pre-cut billing.

02

Remap task tiers: chat, classification, simple completion → Luna ($0.20/$1.20); medium reasoning → Terra; agentic/SWE → standard Sol.

03

Model Sol Fast ROI: benchmark latency-sensitive paths — 2.5× speed не worth 2× price для каждого workload; не включайте Fast по умолчанию на batch.

04

Parallel A/B Kimi K3 и DeepSeek V4: total cost на своём codebase, AA per-task methodology — не только list $/M.

05

Update OpenRouter/LiteLLM routing: Luna new rates в fallback chains; daily spend caps против stale model IDs.

06

7-day re-test window: watch further Sol/Terra moves; track K3 cache hit rate и K2.6 migration cost для existing users.

05

Controversies, три hard numbers и narrowing model-selection window

OpenAI price cut split opinion: supporters называют Luna $0.20/M input новой эрой для high-volume apps; skeptics указывают на self-reported Sol −20%/+15%, активный METR discourse и unresolved Reddit benchmark-trust debates. K3 beats Sol на AA per-task cost, но ~6× pricier vs K2.6 — July 2026 «price cut season» не однонаправленная: vendors re-tiering через speed premium, SKU ladders и open-weight anchors.

A

80% / Luna cut: input $1→$0.20, output $6→$1.20 per OpenAI 30 July announcement — largest list-price move в GPT-5.6 family.

B

$0.94 vs $1.04 / AA per-task: Kimi K3 ~$0.94, Sol ~$1.04 — Sol 9.4% higher; Luna post-cut widens gap на light workloads.

C

6× / K3 vs K2.6: K3 standard input $3/M vs K2.6 $0.60/M — open-weight camp не uniformly cheaper; flagship OSS SKUs re-anchoring too.

Важно: Sol GPU optimization figures, METR controversies и AA per-task costs — estimates; validate на своих workloads. Sol Fast 2× price ≠ 2× value автоматически.

Альтернативы: multi-model A/B на личном Mac — sleep interruptions и network drops; pure cloud API в July pricing churn — constant routing rewrites; enterprise GPU cluster approval не успевает за biweekly model/price iteration. Для production iOS CI/CD, local inference и 24/7 AI agent automation выделенная аренда Mac Mini M4 в облаке KVMNODE обычно оптимальнее: Apple Silicon unified memory, full sudo, flexible day/week/month billing. См. страницу цен, центр помощи или оформить заказ.

Данные на 31 июля 2026 · Источники: OpenAI pricing announcement 30.07.2026, Sol GPU optimization blog 29.07.2026, Moonshot AI Kimi K3 release и weight open, Artificial Analysis per-task estimates, DeepSeek V4 official price sheet, Reddit/X, METR coverage