7月9日リリースから7月30日値下げまで:OpenAI の21日間
7月30日、OpenAI は GPT-5.6 シリーズの料金を改定しました。軽量 Luna は $1/$6 から $0.20/$1.20(-80%)、バランス Terra は $2.50/$15 から $2.00/$12(-20%)。旗艦 Sol 標準は $5/$30 のまま、新 SKU Sol Fast($10/$60、推論約2.5倍速)が Priority Processing を置き換えます。Kimi K3 全面公開と Sol GPU 最適化ブログの直後——オープンウェイト競争への応答と業界は読んでいます。
| 日付 | マイルストーン | 主な内容 |
|---|---|---|
| 2026-07-09 | GPT-5.6 ファミリー公開 | Sol / Terra / Luna 三層、Sol は agentic coding 旗艦 |
| 2026-07-16 | Kimi K3 ホスト提供 | 月之暗面 Kimi K3 が API ホスト型で提供開始 |
| 2026-07-27 | Kimi K3 ウェイト公開 | 2.8T MoE 全面公開、Artificial Analysis がタスク単価 ~$0.94 |
| 2026-07-29 | Sol GPU 自最適化ブログ | Triton/Gluon カーネル書き換え、投機デコード、KV cache 最適化を公開 |
| 2026-07-30 | 公式値下げ | Luna -80%、Terra -20%、Sol 標準据え置き、Sol Fast $10/$60 新設 |
Luna/Terra はリスト価格の引き下げです。Sol の「値上げ」論争は Fast 追加が起点——標準 Sol は動いていませんが、低レイテンシ需要は token 単価2倍を払う構造になります。
Luna 値下げ=全系列値下げと混同:Sol 標準 $5/$30 は据え置き。Fast だけがプレミアム SKU です。
Kimi K3 の価格アンカーを軽視:K3 標準 $3/$15 は Claude Sonnet 5 と同水準に見えますが、K2.6($0.60/$2.50)比で約6倍——オープン側も再階層化しています。
Sol 自社数値をそのまま請求に換算:GPU 自最適化で20%コスト削減・15%スループット向上は自社テスト。第三者検証はまだありません。
Sol Fast を Priority Processing の改名と見なす:2.5倍速で2倍単価——壁時計あたりコストが下がるとは限りません。SLA ごとに試算してください。
Reddit の二極化に引きずられる:Luna 歓喜と METR 報酬ハック・ベンチ自証への疑念が並立——企業選定は自社 workload で検証が必要です。
調整前後:GPT-5.6 三層 vs Kimi K3・DeepSeek・Claude 競合マトリクス
| モデル / SKU | 調整前(入/出 per 1M) | 調整後 | 変動 | 位置づけ |
|---|---|---|---|---|
| GPT-5.6 Luna | $1.00 / $6.00 | $0.20 / $1.20 | -80% | 軽量 / 高頻度 |
| GPT-5.6 Terra | $2.50 / $15.00 | $2.00 / $12.00 | -20% | バランス / 主力 |
| GPT-5.6 Sol(標準) | $5.00 / $30.00 | $5.00 / $30.00 | 据え置き | 旗艦 agentic |
| GPT-5.6 Sol Fast(新) | —(Priority Processing) | $10.00 / $60.00 | 新 SKU | 2.5× 速度、2× 単価 |
| 競合モデル | 入力($/M) | 出力($/M) | AA タスク単価* | 備考 |
|---|---|---|---|---|
| Kimi K3 | $3.00(キャッシュ $0.30) | $15.00 | ~$0.94 | K2.6 比約6倍 |
| DeepSeek V4 Pro | $0.435(キャッシュ $0.0036) | $0.87 | — | 2026年5月75%永久値下げ |
| DeepSeek V4 Flash | $0.14 | $0.28 | — | 軽量層 |
| Claude Sonnet 5 | $3.00(プロモ $2.00 8/31まで) | $15.00(プロモ $10.00) | — | Kimi K3 標準と同水準 |
| Gemini 3.5 Flash-Lite | 約 $2.80/100万 token(入出合算) | — | Google 軽量層 | |
| MAI-Code-1-Flash | $0.75 | $4.50 | — | GitHub Copilot 限定、単体 API なし |
| GPT-5.6 Sol(標準) | $5.00 | $30.00 | ~$1.04 | AA タスク単価は K3 よりやや高い |
*Artificial Analysis「完了タスクあたりコスト」は第三者手法であり OpenAI 公式料金ではありません。競合 token 単価は各社2026年7月公開価格表ベースです。
Artificial Analysis:Kimi K3 ~$0.94/タスク、GPT-5.6 Sol ~$1.04——能力層では Sol がわずかに高い一方、Luna 値下げ後の軽量ワークロードでは OpenAI 側の単位コストが大きく圧縮されています。
深掘り:Sol が GPU カーネルを自前最適化したのに「Luna を下げ、Sol は据え置き、Fast を売る」理由
結論:7月29日の技術ブログと7月30日の階層料金は同じ戦略の表裏——内部コスト削減で軽量 SKU を下げ、レイテンシ需要を Fast で収益化し、標準 Sol で旗艦マージンを維持する。
Sol チームは Triton/Gluon による GPU カーネル書き換え、投機デコード、KV cache レイアウト最適化で、社内テストでは推論コスト約20%削減・スループット約15%向上、FpSan による数値精度検証も実施したと述べています。理論上 Luna/Terra への値下げ余地は生まれますが、Sol 標準は据え置き——コスト改善は DeepSeek V4 Flash 等との軽量層争いに振り、旗艦はプレミアム維持という読みです。
Sol Fast は $10/$60(標準の2倍)で約2.5倍速、Priority Processing 後継。リアルタイム Agent ツール呼び出しや IDE 補完などレイテンシ敏感系はプレミアムを払う構造、バッチ離線は標準 Sol か値下げ Terra が合理的です。Kimi K3 の「Sonnet 並み標準価格+100万 token 差別化」と対照的に、OpenAI は全面値下げではなく SKU 階層で応戦しています。
7月27日 K3 ウェイト公開後、AA は K3 ~$0.94、Sol ~$1.04——差9.4%。METR 報酬ハックやベンチ自証をめぐる Reddit/X の論争は続き、独立再現データはまだ限定的です。
値下げ後の6ステップ:ルーティング・負荷試験・請求の再計算
直近30日の token 明細をエクスポート:Luna / Terra / Sol / Sol Fast 別に入出力・キャッシュヒットを分解し、調整前ベースラインを作成します。
タスク階層を再マッピング:雑談・分類・単純補完は Luna($0.20/$1.20)、中程度推論は Terra、agentic / SWE のみ標準 Sol に残します。
Sol Fast の ROI を実測:レイテンシ敏感系で2.5倍速が2倍単価に見合うか——バッチは Fast をデフォルトにしないでください。
Kimi K3 と DeepSeek V4 を並行 A/B:Artificial Analysis 式の「完了タスクコスト」で自社コードベースの総コストを比較。$/M だけ見ないでください。
OpenRouter / LiteLLM ルールを更新:Luna 新価格を fallback チェーンに反映、日次上限で旧 model ID への降格を防ぎます。
7日間の再検証ウィンドウ:Sol/Terra の追加調整、K3 キャッシュ命中率、K2.6 からの移行コストを追跡します。
論点、3つのハードデータ、階層料金下の選定ウィンドウ
今回の調整は意見が割れます。Luna 入力 $0.20/M は高頻度アプリの門戸を大きく下げた一方、Sol の20%/15%は自社報告、METR 関連の報酬ハック議論も継続中です。K3 は AA タスク単価で Sol をわずかに下回るが K2.6 比6倍——2026年7月の「値下げシーズン」は一方向の譲歩ではなく、速度プレミアム・SKU 階層・オープンウェイトアンカーの再調整です。
80% / Luna 降幅:入力 $1→$0.20、出力 $6→$1.20(OpenAI 7月30日公告)——GPT-5.6 ファミリー最大のリスト変更。
$0.94 vs $1.04 / AA タスク単価:Kimi K3 ~$0.94、GPT-5.6 Sol ~$1.04——能力層で Sol は9.4%高いが、Luna 値下げ後の軽量系では差が拡大。
6× / K3 vs K2.6:K3 入力 $3/M、K2.6 $0.60/M——オープン陣営も旗艦 SKU は再アンカー中。
注意:Sol GPU 数値、METR 論点、AA タスク単価はベンダー/第三者推計——自社 workload で検証してください。Sol Fast の2倍単価が自動的に2倍の価値を意味しません。
代替案:個人 Mac だけでの多モデル A/B・Agent 負荷試験はスリープと回線断で長コンテキストが中断しやすいです。クラウド API 一本は7月の密集調整でルーティング書き換えが頻発します。企業 GPU クラスタ承認待ちは隔週級のモデル・料金更新に追いつきにくいです。iOS CI/CD、ローカル推論、AI Agent 7×24 自動化の本番には、KVMNODE 専用 Mac Mini M4 クラウドレンタルが通常は適した選択です。Apple Silicon 統一メモリ、sudo 開放、日/週/月の柔軟契約。詳細は 料金ページ、ヘルプセンター、直接注文をご覧ください。
データ基準日:2026年7月31日 · 出典:OpenAI 2026-07-30 料金公告、OpenAI 2026-07-29 Sol GPU 最適化ブログ、Moonshot AI Kimi K3、Artificial Analysis タスク単価、DeepSeek V4 公式価格、Reddit / X、METR 関連報道