Für Entwickler und technische Entscheider, die GPT-5.6-Preissenkungen, OpenAIs API-Preisstrategie und den LLM-Preiskampf Juli 2026 verfolgen: Am 30. Juli senkte OpenAI Luna um 80 % ($1/$6 → $0,20/$1,20), Terra um 20 % ($2,50/$15 → $2,00/$12), hielt Sol Standard bei $5/$30 und führte Sol Fast ($10/$60, 2,5× Geschwindigkeit) ein. Dieser datengetriebene Überblick liefert die Timeline 9.–30. Juli, Preis-Matrix vs. Kimi K3, DeepSeek und Claude, Sol-GPU-Self-Optimization, eine Sechs-Schritte-Checkliste und drei harte Kennzahlen. Siehe auch Kimi K3 Open Weight und GPT-6-Vorlauf.
01

21 Tage GPT-5.6: Von Launch am 9. Juli bis zur Senkung am 30. Juli

Am 30. Juli 2026 passte OpenAI die GPT-5.6-Preise an: Luna fiel von $1/$6 auf $0,20/$1,20 pro Million Token (-80 %), Terra von $2,50/$15 auf $2,00/$12 (-20 %), Sol Standard blieb bei $5/$30, und Sol Fast startete bei $10/$60 mit ca. 2,5× Inferenzgeschwindigkeit — als Ersatz für Priority Processing. Die Senkung folgte auf Kimi K3 Open Weight (27. Juli) und OpenAIs Sol-GPU-Blog (29. Juli); Branchenanalysten lesen das als Reaktion auf Open-Weight-Druck.

DatumMeilensteinKerninhalt
2026-07-09GPT-5.6 liveSol, Terra, Luna — Sol als Flaggschiff für agentisches Coding
2026-07-16Kimi K3 gehostetMoonshot AI bringt Kimi K3 als verwaltete API — Preiserwartungen verschieben sich
2026-07-27Kimi K3 Open Weight2,8T MoE vollständig offen; Artificial Analysis: ~$0,94 pro Task
2026-07-29Sol-GPU-OptimierungTriton/Gluon-Kernel, spekulative Dekodierung, KV-Cache — 20 % Kosten, 15 % Durchsatz (Herstellerangabe)
2026-07-30Offizielle PreissenkungLuna -80 %, Terra -20 %, Sol Standard unverändert; Sol Fast $10/$60 neu

Wichtig zu trennen: Luna/Terra sind Listenpreissenkungen. Die „Teuerungs“-Erzählung bei Sol kommt vom neuen Fast-Tier — Standard-Sol blieb unverändert, Latenz-sensitive Workloads zahlen optional das 2×-Premium.

01

Luna-Senkung = Familienweite Rabattaktion: Sol Standard $5/$30 unverändert; nur Fast fügt ein Premium-SKU hinzu.

02

Kimi-K3-Preisanker ignorieren: K3 $3/$15 (Cache $0,30) entspricht Claude Sonnet 5, liegt aber ~6× über K2.6 ($0,60/$2,50).

03

Sol-Optimierungszahlen direkt verbuchen: 20 % Kostenreduktion und 15 % Durchsatz — Hersteller-intern, Drittverifikation ausstehend.

04

Sol Fast = bloßes Priority-Rename: 2,5× Speed bei 2× Preis senkt Kosten pro Wanduhrstunde nicht automatisch — SLA-basiert rechnen.

05

Reddit-Polarität als Entscheidungsgrundlage: METR-Reward-Hacking und Benchmark-Vertrauen ungeklärt — Enterprise braucht eigene Workload-Messung.

02

Preis-Matrix: GPT-5.6 vor/nach vs. Kimi K3, DeepSeek, Claude

Modell / SKUVorher (Ein/Aus $/M)NachherÄnderungRolle
GPT-5.6 Luna$1,00 / $6,00$0,20 / $1,20-80 %Leicht / hohes Volumen
GPT-5.6 Terra$2,50 / $15,00$2,00 / $12,00-20 %Ausgewogen / Alltag
GPT-5.6 Sol (Standard)$5,00 / $30,00$5,00 / $30,00UnverändertFlagship agentic
GPT-5.6 Sol Fast (neu)— (Priority Processing)$10,00 / $60,00Neues SKU2,5× Speed, 2× Preis
WettbewerberInput ($/M)Output ($/M)AA Task-Kosten*Anmerkung
Kimi K3$3,00 (Cache $0,30)$15,00~$0,94~6× vs. K2.6
DeepSeek V4 Pro$0,435 (Cache $0,0036)$0,87Permanente Senkung Mai 2026
DeepSeek V4 Flash$0,14$0,28Leicht-Tier
Claude Sonnet 5$3,00 (Promo $2,00 bis 31.8.)$15,00 (Promo $10,00)Parität zu K3-Listenpreis
Gemini 3.5 Flash-Lite~$2,80/M kombiniert (Ein+Aus)Google Leicht-Tier
MAI-Code-1-Flash$0,75$4,50GitHub Copilot, kein Standalone-API
GPT-5.6 Sol (Standard)$5,00$30,00~$1,04AA leicht über K3

*Artificial Analysis „pro abgeschlossener Task“ — Drittmethodik, nicht OpenAI-offiziell. Wettbewerberpreise: öffentliche Juli-2026-Preisblätter.

AA-Task-Kosten: Kimi K3 ~$0,94, GPT-5.6 Sol ~$1,04 — Sol 9,4 % teurer im Capability-Tier; Luna-Senkung vergrößert OpenAIs Vorteil bei Leicht-Workloads deutlich.

03

Sol GPU-Self-Optimization: Warum Luna fällt, Sol Standard bleibt, Fast monetarisiert Latenz

Fazit: Der 29.-Juli-Engineering-Blog und die 30.-Juli-Tier-Preise sind zwei Seiten einer Strategie — interne Kostensenkung finanziert Leicht-SKU-Rabatte, Fast monetarisiert Latenz, Standard-Sol hält Flaggschiff-Marge.

Sol-Team: Triton/Gluon-GPU-Kernel neu geschrieben, spekulative Dekodierung, KV-Cache-Layout — intern ~20 % Inferenzkosten und ~15 % Durchsatz, FpSan für numerische Präzision. Einsparungen fließen in Luna/Terra, nicht in Sol-Listenpreis — OpenAI lenkt Kostengewinne zu Volumen-Tiers gegen DeepSeek V4 Flash, behält Sol-Marge.

Sol Fast: $10/$60 = 2× Standard für ~2,5× Speed, ersetzt Priority Processing. Echtzeit-Agent-Toolcalls und IDE-Completion zahlen Premium; Batch-Jobs bleiben bei Terra oder Standard-Sol. Kontrast zu Kimi K3: Sonnet-Parität + 1M-Kontext-Differenzierung vs. OpenAIs SKU-Ladder.

Nach K3 Open Weight (27. Juli): AA ~$0,94 vs. Sol ~$1,04 — 9,4 % Gap. METR-Reward-Hacking und Benchmark-Vertrauen auf Reddit/X ungeklärt; unabhängige Replikation limitiert.

04

Sechs Schritte nach der Senkung: Routing, Lasttest, Rechnung neu kalkulieren

01

30-Tage-Token-Export: Input, Output, Cache-Hits nach SKU (Luna/Terra/Sol/Fast) — Baseline vor Senkung.

02

Task-Tiers neu mappen: Chat, Klassifikation, einfache Completion → Luna ($0,20/$1,20); mittlere Reasoning → Terra; agentic/SWE → Standard-Sol.

03

Sol-Fast-ROI modellieren: Latenz-kritische Pfade benchmarken — 2× Preis lohnt nicht überall; Batch nicht default Fast.

04

Kimi K3 und DeepSeek V4 parallel A/B: Gesamtkosten auf eigener Codebasis, AA-Task-Methodik — nicht nur $/M-Listenpreis.

05

OpenRouter/LiteLLM-Routing aktualisieren: Luna-Neupreise in Fallback-Ketten; Tages-Caps gegen alte Model-IDs.

06

7-Tage-Retest-Fenster: Weitere Sol/Terra-Anpassungen beobachten; K3-Cache-Hitrate und K2.6-Migrationskosten tracken. Bei personenbezogenen Prompts in EU-Workloads DSGVO-konforme Verarbeitung und Auftragsverarbeitungsverträge mit US-Anbietern prüfen.

05

Kontroversen, drei Hard Facts und das Re-Tiering-Fenster Juli 2026

OpenAIs Senkung spaltet: Befürworter sehen Luna bei $0,20/M Input als neue Ära für Hochvolumen-Apps; Skeptiker verweisen auf selbst gemeldete 20 %/15 %-Sol-Zahlen, METR-Diskurs und ungeklärte Benchmark-Vertrauensfragen. K3 schlägt Sol bei AA-Task-Kosten, ist aber ~6× teurer als K2.6 — Juli 2026 ist kein einseitiger Rabattmarkt, sondern SKU-Re-Tiering über Speed-Premium, Leiter-Routing und Open-Weight-Anker.

A

80 % / Luna: Input $1→$0,20, Output $6→$1,20 laut OpenAI 30.07. — größte Listenpreisänderung der GPT-5.6-Familie.

B

$0,94 vs. $1,04 / AA Task: Kimi K3 ~$0,94, Sol ~$1,04 — Sol 9,4 % höher; Luna-Senkung vergrößert Gap bei Leicht-Workloads.

C

6× / K3 vs. K2.6: K3 Input $3/M vs. K2.6 $0,60/M — Open-Weight-Camp senkt nicht pauschal; Flagship-OSS re-anchort ebenfalls.

Hinweis: Sol-GPU-Zahlen, METR-Kontroversen und AA-Task-Kosten sind Schätzungen — auf eigenen Workloads validieren. Sol Fast 2× Preis ≠ 2× Wert. EU-Nutzer: Cloud-Verarbeitung personenbezogener Prompts erfordert DSGVO-konforme Vendor-Bewertung.

Alternativen: Multi-Modell-A/B auf privatem Mac leidet unter Sleep und Netzausfällen; reine Cloud-API bedeutet im Juli-Preischurn ständiges Routing-Rewrite; Enterprise-GPU-Genehmigung hält selten mit zweiwöchiger Modell-/Preis-Cadence mit. Für produktives iOS-CI/CD, lokale Inferenz und 24/7-AI-Agent-Automatisierung ist KVMNODE dedizierte Mac-Mini-M4-Cloud-Miete meist die bessere Wahl: Apple-Silicon-Unified-Memory, voller sudo-Zugriff, flexible Tages-/Wochen-/Monatsabrechnung. Siehe Preisseite, Hilfezentrum oder direkt bestellen.

Datenstand: 31. Juli 2026 · Quellen: OpenAI Preisankündigung 30.07.2026, Sol-GPU-Blog 29.07.2026, Moonshot AI Kimi K3, Artificial Analysis Task-Kosten, DeepSeek V4 Preisblatt, Reddit/X, METR-Berichte