21 Tage GPT-5.6: Von Launch am 9. Juli bis zur Senkung am 30. Juli
Am 30. Juli 2026 passte OpenAI die GPT-5.6-Preise an: Luna fiel von $1/$6 auf $0,20/$1,20 pro Million Token (-80 %), Terra von $2,50/$15 auf $2,00/$12 (-20 %), Sol Standard blieb bei $5/$30, und Sol Fast startete bei $10/$60 mit ca. 2,5× Inferenzgeschwindigkeit — als Ersatz für Priority Processing. Die Senkung folgte auf Kimi K3 Open Weight (27. Juli) und OpenAIs Sol-GPU-Blog (29. Juli); Branchenanalysten lesen das als Reaktion auf Open-Weight-Druck.
| Datum | Meilenstein | Kerninhalt |
|---|---|---|
| 2026-07-09 | GPT-5.6 live | Sol, Terra, Luna — Sol als Flaggschiff für agentisches Coding |
| 2026-07-16 | Kimi K3 gehostet | Moonshot AI bringt Kimi K3 als verwaltete API — Preiserwartungen verschieben sich |
| 2026-07-27 | Kimi K3 Open Weight | 2,8T MoE vollständig offen; Artificial Analysis: ~$0,94 pro Task |
| 2026-07-29 | Sol-GPU-Optimierung | Triton/Gluon-Kernel, spekulative Dekodierung, KV-Cache — 20 % Kosten, 15 % Durchsatz (Herstellerangabe) |
| 2026-07-30 | Offizielle Preissenkung | Luna -80 %, Terra -20 %, Sol Standard unverändert; Sol Fast $10/$60 neu |
Wichtig zu trennen: Luna/Terra sind Listenpreissenkungen. Die „Teuerungs“-Erzählung bei Sol kommt vom neuen Fast-Tier — Standard-Sol blieb unverändert, Latenz-sensitive Workloads zahlen optional das 2×-Premium.
Luna-Senkung = Familienweite Rabattaktion: Sol Standard $5/$30 unverändert; nur Fast fügt ein Premium-SKU hinzu.
Kimi-K3-Preisanker ignorieren: K3 $3/$15 (Cache $0,30) entspricht Claude Sonnet 5, liegt aber ~6× über K2.6 ($0,60/$2,50).
Sol-Optimierungszahlen direkt verbuchen: 20 % Kostenreduktion und 15 % Durchsatz — Hersteller-intern, Drittverifikation ausstehend.
Sol Fast = bloßes Priority-Rename: 2,5× Speed bei 2× Preis senkt Kosten pro Wanduhrstunde nicht automatisch — SLA-basiert rechnen.
Reddit-Polarität als Entscheidungsgrundlage: METR-Reward-Hacking und Benchmark-Vertrauen ungeklärt — Enterprise braucht eigene Workload-Messung.
Preis-Matrix: GPT-5.6 vor/nach vs. Kimi K3, DeepSeek, Claude
| Modell / SKU | Vorher (Ein/Aus $/M) | Nachher | Änderung | Rolle |
|---|---|---|---|---|
| GPT-5.6 Luna | $1,00 / $6,00 | $0,20 / $1,20 | -80 % | Leicht / hohes Volumen |
| GPT-5.6 Terra | $2,50 / $15,00 | $2,00 / $12,00 | -20 % | Ausgewogen / Alltag |
| GPT-5.6 Sol (Standard) | $5,00 / $30,00 | $5,00 / $30,00 | Unverändert | Flagship agentic |
| GPT-5.6 Sol Fast (neu) | — (Priority Processing) | $10,00 / $60,00 | Neues SKU | 2,5× Speed, 2× Preis |
| Wettbewerber | Input ($/M) | Output ($/M) | AA Task-Kosten* | Anmerkung |
|---|---|---|---|---|
| Kimi K3 | $3,00 (Cache $0,30) | $15,00 | ~$0,94 | ~6× vs. K2.6 |
| DeepSeek V4 Pro | $0,435 (Cache $0,0036) | $0,87 | — | Permanente Senkung Mai 2026 |
| DeepSeek V4 Flash | $0,14 | $0,28 | — | Leicht-Tier |
| Claude Sonnet 5 | $3,00 (Promo $2,00 bis 31.8.) | $15,00 (Promo $10,00) | — | Parität zu K3-Listenpreis |
| Gemini 3.5 Flash-Lite | ~$2,80/M kombiniert (Ein+Aus) | — | Google Leicht-Tier | |
| MAI-Code-1-Flash | $0,75 | $4,50 | — | GitHub Copilot, kein Standalone-API |
| GPT-5.6 Sol (Standard) | $5,00 | $30,00 | ~$1,04 | AA leicht über K3 |
*Artificial Analysis „pro abgeschlossener Task“ — Drittmethodik, nicht OpenAI-offiziell. Wettbewerberpreise: öffentliche Juli-2026-Preisblätter.
AA-Task-Kosten: Kimi K3 ~$0,94, GPT-5.6 Sol ~$1,04 — Sol 9,4 % teurer im Capability-Tier; Luna-Senkung vergrößert OpenAIs Vorteil bei Leicht-Workloads deutlich.
Sol GPU-Self-Optimization: Warum Luna fällt, Sol Standard bleibt, Fast monetarisiert Latenz
Fazit: Der 29.-Juli-Engineering-Blog und die 30.-Juli-Tier-Preise sind zwei Seiten einer Strategie — interne Kostensenkung finanziert Leicht-SKU-Rabatte, Fast monetarisiert Latenz, Standard-Sol hält Flaggschiff-Marge.
Sol-Team: Triton/Gluon-GPU-Kernel neu geschrieben, spekulative Dekodierung, KV-Cache-Layout — intern ~20 % Inferenzkosten und ~15 % Durchsatz, FpSan für numerische Präzision. Einsparungen fließen in Luna/Terra, nicht in Sol-Listenpreis — OpenAI lenkt Kostengewinne zu Volumen-Tiers gegen DeepSeek V4 Flash, behält Sol-Marge.
Sol Fast: $10/$60 = 2× Standard für ~2,5× Speed, ersetzt Priority Processing. Echtzeit-Agent-Toolcalls und IDE-Completion zahlen Premium; Batch-Jobs bleiben bei Terra oder Standard-Sol. Kontrast zu Kimi K3: Sonnet-Parität + 1M-Kontext-Differenzierung vs. OpenAIs SKU-Ladder.
Nach K3 Open Weight (27. Juli): AA ~$0,94 vs. Sol ~$1,04 — 9,4 % Gap. METR-Reward-Hacking und Benchmark-Vertrauen auf Reddit/X ungeklärt; unabhängige Replikation limitiert.
Sechs Schritte nach der Senkung: Routing, Lasttest, Rechnung neu kalkulieren
30-Tage-Token-Export: Input, Output, Cache-Hits nach SKU (Luna/Terra/Sol/Fast) — Baseline vor Senkung.
Task-Tiers neu mappen: Chat, Klassifikation, einfache Completion → Luna ($0,20/$1,20); mittlere Reasoning → Terra; agentic/SWE → Standard-Sol.
Sol-Fast-ROI modellieren: Latenz-kritische Pfade benchmarken — 2× Preis lohnt nicht überall; Batch nicht default Fast.
Kimi K3 und DeepSeek V4 parallel A/B: Gesamtkosten auf eigener Codebasis, AA-Task-Methodik — nicht nur $/M-Listenpreis.
OpenRouter/LiteLLM-Routing aktualisieren: Luna-Neupreise in Fallback-Ketten; Tages-Caps gegen alte Model-IDs.
7-Tage-Retest-Fenster: Weitere Sol/Terra-Anpassungen beobachten; K3-Cache-Hitrate und K2.6-Migrationskosten tracken. Bei personenbezogenen Prompts in EU-Workloads DSGVO-konforme Verarbeitung und Auftragsverarbeitungsverträge mit US-Anbietern prüfen.
Kontroversen, drei Hard Facts und das Re-Tiering-Fenster Juli 2026
OpenAIs Senkung spaltet: Befürworter sehen Luna bei $0,20/M Input als neue Ära für Hochvolumen-Apps; Skeptiker verweisen auf selbst gemeldete 20 %/15 %-Sol-Zahlen, METR-Diskurs und ungeklärte Benchmark-Vertrauensfragen. K3 schlägt Sol bei AA-Task-Kosten, ist aber ~6× teurer als K2.6 — Juli 2026 ist kein einseitiger Rabattmarkt, sondern SKU-Re-Tiering über Speed-Premium, Leiter-Routing und Open-Weight-Anker.
80 % / Luna: Input $1→$0,20, Output $6→$1,20 laut OpenAI 30.07. — größte Listenpreisänderung der GPT-5.6-Familie.
$0,94 vs. $1,04 / AA Task: Kimi K3 ~$0,94, Sol ~$1,04 — Sol 9,4 % höher; Luna-Senkung vergrößert Gap bei Leicht-Workloads.
6× / K3 vs. K2.6: K3 Input $3/M vs. K2.6 $0,60/M — Open-Weight-Camp senkt nicht pauschal; Flagship-OSS re-anchort ebenfalls.
Hinweis: Sol-GPU-Zahlen, METR-Kontroversen und AA-Task-Kosten sind Schätzungen — auf eigenen Workloads validieren. Sol Fast 2× Preis ≠ 2× Wert. EU-Nutzer: Cloud-Verarbeitung personenbezogener Prompts erfordert DSGVO-konforme Vendor-Bewertung.
Alternativen: Multi-Modell-A/B auf privatem Mac leidet unter Sleep und Netzausfällen; reine Cloud-API bedeutet im Juli-Preischurn ständiges Routing-Rewrite; Enterprise-GPU-Genehmigung hält selten mit zweiwöchiger Modell-/Preis-Cadence mit. Für produktives iOS-CI/CD, lokale Inferenz und 24/7-AI-Agent-Automatisierung ist KVMNODE dedizierte Mac-Mini-M4-Cloud-Miete meist die bessere Wahl: Apple-Silicon-Unified-Memory, voller sudo-Zugriff, flexible Tages-/Wochen-/Monatsabrechnung. Siehe Preisseite, Hilfezentrum oder direkt bestellen.
Datenstand: 31. Juli 2026 · Quellen: OpenAI Preisankündigung 30.07.2026, Sol-GPU-Blog 29.07.2026, Moonshot AI Kimi K3, Artificial Analysis Task-Kosten, DeepSeek V4 Preisblatt, Reddit/X, METR-Berichte