Pour les développeurs et décideurs techniques qui suivent la baisse tarifaire GPT-5.6, la stratégie prix d'OpenAI et la guerre des prix LLM de juillet 2026 : le 30 juillet, OpenAI a réduit Luna de 80 % ($1/$6 → $0,20/$1,20), Terra de 20 % ($2,50/$15 → $2,00/$12), maintenu Sol standard à $5/$30 et lancé Sol Fast ($10/$60, vitesse ×2,5). Cet article professionnel couvre la timeline du 9 au 30 juillet, la matrice avant/après vs Kimi K3, DeepSeek et Claude, la logique d'optimisation GPU de Sol, une checklist en six étapes et trois chiffres clés. Voir aussi Kimi K3 open weight et avant-garde GPT-6.
01

Du lancement du 9 juillet à la baisse du 30 : les 21 jours décisifs de GPT-5.6

Le 30 juillet 2026, OpenAI a ajusté la tarification GPT-5.6 : Luna est passé de $1/$6 à $0,20/$1,20 par million de tokens (-80 %), Terra de $2,50/$15 à $2,00/$12 (-20 %), Sol standard est resté à $5/$30, et Sol Fast a été introduit à $10/$60 avec environ 2,5× la vitesse d'inférence, remplaçant Priority Processing. Cette décision intervient après l'open weight complet de Kimi K3 (27 juillet) et le billet technique sur l'optimisation GPU de Sol (29 juillet) — une réponse structurée à la pression des modèles open weight.

DateJalonDétail clé
2026-07-09Lancement GPT-5.6Sol, Terra, Luna — Sol positionné comme flagship agentic coding
2026-07-16Kimi K3 hébergéMoonshot AI met Kimi K3 en API managée — recalibrage des attentes prix
2026-07-27Kimi K3 open weightMoE 2,8T entièrement ouvert ; Artificial Analysis : ~$0,94 par tâche
2026-07-29Blog optimisation GPU SolKernels Triton/Gluon, décodage spéculatif, KV cache — -20 % coût, +15 % débit (auto-déclaré)
2026-07-30Baisse officielleLuna -80 %, Terra -20 %, Sol standard inchangé ; Sol Fast $10/$60

La nuance : Luna et Terra bénéficient d'une baisse de prix catalogue ; le récit de « hausse » sur Sol provient du nouveau tier Fast — le Sol standard n'a pas bougé, mais les workloads sensibles à la latence paient un premium optionnel de 2×.

01

Confondre la baisse Luna avec une remise globale : Sol standard reste à $5/$30 ; seul Fast ajoute un SKU premium.

02

Négliger l'ancrage prix Kimi K3 : K3 à $3/$15 (cache $0,30) aligne Sonnet 5, mais coûte ~6× K2.6 ($0,60/$2,50).

03

Capitaliser les gains Sol auto-déclarés : -20 % coût et +15 % débit — chiffres internes, vérification tierce en attente.

04

Traiter Sol Fast comme un simple renommage Priority : vitesse ×2,5 à prix ×2 ne réduit pas automatiquement le coût horaire — modéliser par SLA.

05

Se fier aux débats Reddit polarisés : controverses METR et confiance benchmarks non tranchées — l'entreprise doit prouver sur ses propres workloads.

02

Matrice tarifaire : GPT-5.6 avant/après face à Kimi K3, DeepSeek, Claude

Modèle / SKUAvant (entrée/sortie $/M)AprèsVariationRôle
GPT-5.6 Luna$1,00 / $6,00$0,20 / $1,20-80 %Léger / volume
GPT-5.6 Terra$2,50 / $15,00$2,00 / $12,00-20 %Équilibré / quotidien
GPT-5.6 Sol (standard)$5,00 / $30,00$5,00 / $30,00InchangéFlagship agentic
GPT-5.6 Sol Fast (nouveau)— (Priority Processing)$10,00 / $60,00Nouveau SKU×2,5 vitesse, ×2 prix
ConcurrentEntrée ($/M)Sortie ($/M)Coût tâche AA*Notes
Kimi K3$3,00 (cache $0,30)$15,00~$0,94~6× vs K2.6
DeepSeek V4 Pro$0,435 (cache $0,0036)$0,87Baisse permanente mai 2026
DeepSeek V4 Flash$0,14$0,28Tier léger
Claude Sonnet 5$3,00 (promo $2,00 jusqu'au 31 août)$15,00 (promo $10,00)Parité liste K3
Gemini 3.5 Flash-Lite~$2,80/M combiné (entrée+sortie)Tier léger Google
MAI-Code-1-Flash$0,75$4,50GitHub Copilot, pas d'API standalone
GPT-5.6 Sol (standard)$5,00$30,00~$1,04AA légèrement au-dessus de K3

*Coût « par tâche complétée » Artificial Analysis — méthodologie tierce, pas tarif officiel OpenAI. Concurrents : grilles publiques juillet 2026.

Artificial Analysis estime Kimi K3 à ~$0,94 par tâche et GPT-5.6 Sol à ~$1,04 — Sol reste 9,4 % plus cher au tier capability ; la baisse Luna élargit nettement l'avantage OpenAI sur les workloads légers.

03

Pourquoi Sol réécrit ses kernels GPU mais OpenAI baisse Luna plutôt que Sol

En synthèse : le billet engineering du 29 juillet et la tarification tierée du 30 juillet sont deux faces d'une même stratégie — convertir les économies internes en baisses sur les SKU légers, monétiser la latence via Fast, et préserver la marge du Sol standard.

L'équipe Sol indique avoir réécrit les kernels GPU en Triton/Gluon, ajouté le décodage spéculatif et optimisé le layout KV cache — environ -20 % coût d'inférence et +15 % débit en tests internes, avec validation numérique FpSan. Ces gains alimentent Luna/Terra, pas le prix catalogue de Sol : OpenAI oriente les économies vers les tiers volume face à DeepSeek V4 Flash, tout en conservant la marge flagship.

Sol Fast est explicite : $10/$60 = 2× le standard pour ~2,5× la vitesse, remplaçant Priority Processing. Les chemins production sensibles à la latence (appels d'outils agent en temps réel, complétion IDE) paient le premium ; les jobs batch restent sur Terra ou Sol standard. Contraste avec Kimi K3 : alignement Sonnet + différenciation contexte 1M vs. échelle de SKU chez OpenAI.

Après l'open weight K3 du 27 juillet, AA place K3 à ~$0,94 vs Sol ~$1,04 — écart 9,4 %. Les débats METR et la confiance benchmarks sur Reddit/X restent ouverts ; réplication indépendante limitée.

04

Six étapes après la baisse : recalibrer routage, charge et facturation

01

Exporter 30 jours de détail tokens : entrée, sortie, cache par SKU (Luna/Terra/Sol/Fast) — baseline pré-baisse.

02

Remapper les tiers de tâches : chat, classification, complétion simple → Luna ($0,20/$1,20) ; raisonnement moyen → Terra ; agentic/SWE → Sol standard.

03

Modéliser le ROI Sol Fast : benchmarker les chemins latence-critiques — prix ×2 ne vaut pas toujours vitesse ×2,5 ; ne pas activer Fast par défaut sur le batch.

04

A/B parallèle Kimi K3 et DeepSeek V4 : coût total sur votre codebase, méthodologie AA par tâche — pas seulement le $/M catalogue.

05

Mettre à jour routage OpenRouter / LiteLLM : nouveaux tarifs Luna dans les chaînes fallback ; plafonds journaliers contre anciens model IDs.

06

Fenêtre de retest 7 jours : surveiller ajustements Sol/Terra ; suivre taux cache K3 et coût migration K2.6 pour utilisateurs existants.

05

Controverses, trois chiffres clés et la fenêtre de re-tiering de juillet 2026

La baisse OpenAI divise : les partisans saluent Luna à $0,20/M en entrée comme une ère pour les apps à fort volume ; les sceptiques rappellent que les -20 %/+15 % de Sol sont auto-déclarés, que le discours METR persiste et que la confiance benchmarks sur Reddit n'est pas tranchée. K3 bat Sol en coût tâche AA mais coûte ~6× K2.6 — juillet 2026 n'est pas une saison de rabais unidirectionnelle, mais un re-tiering par SKU, premium vitesse et ancres open weight.

A

80 % / Luna : entrée $1→$0,20, sortie $6→$1,20 selon annonce OpenAI du 30 juillet — plus grande variation catalogue de la famille GPT-5.6.

B

$0,94 vs $1,04 / coût tâche AA : Kimi K3 ~$0,94, Sol ~$1,04 — Sol 9,4 % plus cher ; Luna post-baisse creuse l'écart sur workloads légers.

C

6× / K3 vs K2.6 : K3 entrée $3/M vs K2.6 $0,60/M — le camp open weight ne baisse pas uniformément ; les SKU flagship se ré-ancrent aussi.

Attention : chiffres optimisation GPU Sol, controverses METR et coûts tâche AA sont des estimations — valider sur vos workloads ; Sol Fast à prix ×2 n'apporte pas automatiquement ×2 de valeur.

Les alternatives ont leurs limites : A/B multi-modèles sur Mac personnel subit veille et coupures réseau ; API cloud seule implique réécritures de routage fréquentes en période de churn tarifaire ; attente cluster GPU enterprise rate rarement le rythme bihebdomadaire modèle/prix. Pour CI/CD iOS, inférence locale et automatisation agent 24/7 en production, la location cloud Mac Mini M4 dédiée KVMNODE est généralement le meilleur fit : mémoire unifiée Apple Silicon, sudo complet, facturation jour/semaine/mois. Voir page tarifs, centre d'aide ou commander directement.

Données au 31 juillet 2026 · Sources : annonce tarifaire OpenAI 30.07.2026, blog optimisation GPU Sol 29.07.2026, release Kimi K3 Moonshot AI, coûts tâche Artificial Analysis, grille DeepSeek V4, discussions Reddit/X, couverture METR