7월 9일 출시부터 7월 30일 인하까지: OpenAI의 21일
7월 30일 OpenAI는 GPT-5.6 시리즈 요금을 조정했습니다. 경량 Luna는 $1/$6에서 $0.20/$1.20(-80%), 균형 Terra는 $2.50/$15에서 $2.00/$12(-20%)입니다. 플래그십 Sol 표준은 $5/$30 그대로, 신규 Sol Fast($10/$60, 추론 약 2.5배)가 Priority Processing을 대체합니다. Kimi K3 전면 공개와 Sol GPU 최적화 블로그 직후——업계는 오픈웨이트 압력에 대한 대응으로 해석합니다.
| 날짜 | 마일스톤 | 핵심 내용 |
|---|---|---|
| 2026-07-09 | GPT-5.6 패밀리 출시 | Sol / Terra / Luna 3티어, Sol은 agentic coding 플래그십 |
| 2026-07-16 | Kimi K3 호스팅 개시 | 월之暗面 Kimi K3 API 호스팅 서비스 시작 |
| 2026-07-27 | Kimi K3 가중치 공개 | 2.8T MoE 전면 공개, Artificial Analysis 태스크당 ~$0.94 |
| 2026-07-29 | Sol GPU 자체 최적화 블로그 | Triton/Gluon 커널 재작성, 투기 디코딩, KV cache 최적화 공개 |
| 2026-07-30 | 공식 가격 인하 | Luna -80%, Terra -20%, Sol 표준 유지, Sol Fast $10/$60 신설 |
Luna/Terra는 정가 인하입니다. Sol 「인상」 논쟁은 Fast 추가에서 비롯됩니다——표준 Sol은 그대로지만, 저지연 수요는 token 단가 2배를 감수하는 구조입니다.
Luna 인하=전체 인하로 오해:Sol 표준 $5/$30은 유지됩니다. Fast만 프리미엄 SKU입니다.
Kimi K3 가격 앵커 간과:K3 표준 $3/$15는 Claude Sonnet 5와 같아 보이지만 K2.6($0.60/$2.50) 대비 약 6배——오픈웨이트 진영도 재계층화 중입니다.
Sol 자체 보고 수치를 청구에 그대로 적용:GPU 자체 최적화 20% 비용 절감·15% 처리량 향상은 자체 테스트입니다. 제3자 검증은 아직 없습니다.
Sol Fast를 Priority Processing 개명으로 간주:2.5배 속도에 2배 단가——벽시계당 비용이 자동으로 내려가지 않습니다. SLA별로 계산하세요.
Reddit 양극화에 휘둘리기:Luna 환호와 METR 보상 해킹·벤치 자체 보고 의혹이 공존——기업 선정은 자체 workload 검증이 필요합니다.
조정 전후: GPT-5.6 3티어 vs Kimi K3·DeepSeek·Claude 경쟁 매트릭스
| 모델 / SKU | 조정 전 (입/출 per 1M) | 조정 후 | 변동 | 역할 |
|---|---|---|---|---|
| GPT-5.6 Luna | $1.00 / $6.00 | $0.20 / $1.20 | -80% | 경량 / 고빈도 |
| GPT-5.6 Terra | $2.50 / $15.00 | $2.00 / $12.00 | -20% | 균형 / 메인 |
| GPT-5.6 Sol (표준) | $5.00 / $30.00 | $5.00 / $30.00 | 유지 | 플래그십 agentic |
| GPT-5.6 Sol Fast (신규) | — (Priority Processing) | $10.00 / $60.00 | 신 SKU | 2.5× 속도, 2× 단가 |
| 경쟁 모델 | 입력 ($/M) | 출력 ($/M) | AA 태스크당* | 비고 |
|---|---|---|---|---|
| Kimi K3 | $3.00 (캐시 $0.30) | $15.00 | ~$0.94 | K2.6 대비 약 6배 |
| DeepSeek V4 Pro | $0.435 (캐시 $0.0036) | $0.87 | — | 2026년 5월 75% 영구 인하 |
| DeepSeek V4 Flash | $0.14 | $0.28 | — | 경량 티어 |
| Claude Sonnet 5 | $3.00 (프로모 $2.00 8/31까지) | $15.00 (프로모 $10.00) | — | Kimi K3 표준과 동일 |
| Gemini 3.5 Flash-Lite | 약 $2.80/100만 token (입출 합산) | — | Google 경량 티어 | |
| MAI-Code-1-Flash | $0.75 | $4.50 | — | GitHub Copilot 전용, 단독 API 없음 |
| GPT-5.6 Sol (표준) | $5.00 | $30.00 | ~$1.04 | AA 태스크당 K3보다 약간 높음 |
*Artificial Analysis 「완료 태스크당 비용」은 제3자 방법론이며 OpenAI 공식 요금이 아닙니다. 경쟁 token 단가는 각사 2026년 7월 공개 가격표 기준입니다.
Artificial Analysis: Kimi K3 ~$0.94/태스크, GPT-5.6 Sol ~$1.04——능력 티어에서는 Sol이 약간 비싸지만, Luna 인하 후 경량 워크로드 단위 비용은 OpenAI 쪽이 크게 압축됩니다.
심층 분석: Sol이 GPU 커널을 자체 최적화했는데 「Luna 인하·Sol 유지·Fast 판매」를 택한 이유
결론: 7월 29일 기술 블로그와 7월 30일 계층 요금은 같은 전략의 양면——내부 비용 절감으로 경량 SKU를 내리고, 지연 민감 수요는 Fast로 수익화하며, 표준 Sol로 플래그십 마진을 유지합니다.
Sol 팀은 Triton/Gluon GPU 커널 재작성, 투기 디코딩, KV cache 레이아웃 최적화로 내부 테스트에서 추론 비용 약 20% 절감·처리량 약 15% 향상, FpSan 수치 검증까지 수행했다고 밝혔습니다. 이론상 Luna/Terra 인하 여지는 생기지만 Sol 표준은 유지——비용 개선은 DeepSeek V4 Flash 등 경량 경쟁에 투입하고 플래그십 프리미엄은 지키는 해석입니다.
Sol Fast는 $10/$60(표준 2배)로 약 2.5배 속도, Priority Processing 후속입니다. 실시간 Agent 도구 호출·IDE 보완 등 저지연 경로는 프리미엄을 지불하고, 배치 오프라인은 표준 Sol이나 인하된 Terra가 합리적입니다. Kimi K3의 「Sonnet급 표준가+100만 token 차별화」와 대조적으로 OpenAI는 전면 인하가 아닌 SKU 계층으로 대응합니다.
7월 27일 K3 가중치 공개 후 AA는 K3 ~$0.94, Sol ~$1.04——차이 9.4%. METR 보상 해킹·벤치 자체 보고를 둘러싼 Reddit/X 논쟁은 계속되며, 독립 재현 데이터는 아직 제한적입니다.
인하 후 6단계: 라우팅·부하 테스트·청구 재계산
최근 30일 token 명세 내보내기:Luna / Terra / Sol / Sol Fast별 입력·출력·캐시 히트를 분해해 조정 전 기준선을 만듭니다.
태스크 계층 재매핑:잡담·분류·단순 보완은 Luna($0.20/$1.20), 중간 추론은 Terra, agentic/SWE만 표준 Sol에 둡니다.
Sol Fast ROI 실측:저지연 경로에서 2.5배 속도가 2배 단가를 정당화하는지——배치 작업에 Fast 기본값을 쓰지 마세요.
Kimi K3·DeepSeek V4 병행 A/B:Artificial Analysis식 「완료 태스크 비용」으로 자체 코드베이스 총비용을 비교합니다. $/M만 보지 마세요.
OpenRouter / LiteLLM 라우팅 규칙 갱신:Luna 신가격을 fallback 체인에 반영하고, 일일 상한으로 구 model ID로의 강등을 막습니다.
7일 재검증 기간:Sol/Terra 추가 조정, K3 캐시 적중률, K2.6에서의 이전 비용을 추적합니다.
논점, 3가지 하드 데이터, 계층 요금 하의 선정 창
이번 조정은 의견이 갈립니다. Luna 입력 $0.20/M는 고빈도 앱 문턱을 크게 낮췄지만, Sol 20%/15%는 자체 보고이고 METR 관련 보상 해킹 논의도 이어집니다. K3는 AA 태스크당 Sol을 약간 밑돌지만 K2.6 대비 6배——2026년 7월 「인하 시즌」은 일방적 양보가 아니라 속도 프리미엄·SKU 계층·오픈웨이트 앵커의 재조정입니다.
80% / Luna 인하:입력 $1→$0.20, 출력 $6→$1.20(OpenAI 7월 30일 공지)——GPT-5.6 패밀리 최대 정가 변경.
$0.94 vs $1.04 / AA 태스크당:Kimi K3 ~$0.94, GPT-5.6 Sol ~$1.04——능력 티어에서 Sol 9.4% 높지만 Luna 인하 후 경량 워크로드 격차 확대.
6× / K3 vs K2.6:K3 입력 $3/M, K2.6 $0.60/M——오픈웨이트 진영 플래그십 SKU도 재앵커 중.
주의:Sol GPU 수치, METR 논점, AA 태스크당 비용은 벤더/제3자 추정——자체 workload로 검증하세요. Sol Fast 2배 단가가 자동으로 2배 가치를 의미하지 않습니다.
대안 정리:개인 Mac만으로 다중 모델 A/B·Agent 부하 테스트는 절전·네트워크 끊김으로 장컨텍스트가 중단되기 쉽습니다.클라우드 API 일원화는 7월 집중 조정기 라우팅 재작성이 잦습니다.기업 GPU 클러스터 승인 대기는 격주급 모델·요금 업데이트를 따라가기 어렵습니다. iOS CI/CD, 로컬 추론, AI Agent 7×24 자동화 본番 환경에는 KVMNODE 전용 Mac Mini M4 클라우드 임대가 보통 더 적합합니다. Apple Silicon 통합 메모리, sudo 개방, 일/주/월 유연 과금. 가격 페이지, 고객 센터, 바로 주문을 참고하세요.
데이터 기준: 2026년 7월 31일 · 출처: OpenAI 2026-07-30 요금 공지, OpenAI 2026-07-29 Sol GPU 최적화 블로그, Moonshot AI Kimi K3, Artificial Analysis 태스크당 비용, DeepSeek V4 공식 가격, Reddit / X, METR 관련 보도