GPT-5.6 가격 인하, OpenAI API 요금 전략, 2026년 7월 LLM 가격 경쟁을 추적하는 AI 개발자·기술 의사결정자를 위한 글입니다. OpenAI는 7월 30일 Luna 입출력 80%, Terra 20%를 인하하고 Sol 표준 $5/$30은 유지한 채 2배 요금·2.5배 속도의 Sol Fast($10/$60)로 Priority Processing을 대체했습니다. 본문은 7월 9일~30일 타임라인, 조정 전후 가격표와 Kimi K3·DeepSeek·Claude 비교, Sol GPU 커널 자체 최적화 의도, 개발자 6단계 대응, 논점과 인용 가능한 3가지 수치를 다룹니다. 관련: Kimi K3 오픈웨이트 해설, GPT-6 전초전.
01

7월 9일 출시부터 7월 30일 인하까지: OpenAI의 21일

7월 30일 OpenAI는 GPT-5.6 시리즈 요금을 조정했습니다. 경량 Luna는 $1/$6에서 $0.20/$1.20(-80%), 균형 Terra는 $2.50/$15에서 $2.00/$12(-20%)입니다. 플래그십 Sol 표준은 $5/$30 그대로, 신규 Sol Fast($10/$60, 추론 약 2.5배)가 Priority Processing을 대체합니다. Kimi K3 전면 공개와 Sol GPU 최적화 블로그 직후——업계는 오픈웨이트 압력에 대한 대응으로 해석합니다.

날짜마일스톤핵심 내용
2026-07-09GPT-5.6 패밀리 출시Sol / Terra / Luna 3티어, Sol은 agentic coding 플래그십
2026-07-16Kimi K3 호스팅 개시월之暗面 Kimi K3 API 호스팅 서비스 시작
2026-07-27Kimi K3 가중치 공개2.8T MoE 전면 공개, Artificial Analysis 태스크당 ~$0.94
2026-07-29Sol GPU 자체 최적화 블로그Triton/Gluon 커널 재작성, 투기 디코딩, KV cache 최적화 공개
2026-07-30공식 가격 인하Luna -80%, Terra -20%, Sol 표준 유지, Sol Fast $10/$60 신설

Luna/Terra는 정가 인하입니다. Sol 「인상」 논쟁은 Fast 추가에서 비롯됩니다——표준 Sol은 그대로지만, 저지연 수요는 token 단가 2배를 감수하는 구조입니다.

01

Luna 인하=전체 인하로 오해:Sol 표준 $5/$30은 유지됩니다. Fast만 프리미엄 SKU입니다.

02

Kimi K3 가격 앵커 간과:K3 표준 $3/$15는 Claude Sonnet 5와 같아 보이지만 K2.6($0.60/$2.50) 대비 약 6배——오픈웨이트 진영도 재계층화 중입니다.

03

Sol 자체 보고 수치를 청구에 그대로 적용:GPU 자체 최적화 20% 비용 절감·15% 처리량 향상은 자체 테스트입니다. 제3자 검증은 아직 없습니다.

04

Sol Fast를 Priority Processing 개명으로 간주:2.5배 속도에 2배 단가——벽시계당 비용이 자동으로 내려가지 않습니다. SLA별로 계산하세요.

05

Reddit 양극화에 휘둘리기:Luna 환호와 METR 보상 해킹·벤치 자체 보고 의혹이 공존——기업 선정은 자체 workload 검증이 필요합니다.

02

조정 전후: GPT-5.6 3티어 vs Kimi K3·DeepSeek·Claude 경쟁 매트릭스

모델 / SKU조정 전 (입/출 per 1M)조정 후변동역할
GPT-5.6 Luna$1.00 / $6.00$0.20 / $1.20-80%경량 / 고빈도
GPT-5.6 Terra$2.50 / $15.00$2.00 / $12.00-20%균형 / 메인
GPT-5.6 Sol (표준)$5.00 / $30.00$5.00 / $30.00유지플래그십 agentic
GPT-5.6 Sol Fast (신규)— (Priority Processing)$10.00 / $60.00신 SKU2.5× 속도, 2× 단가
경쟁 모델입력 ($/M)출력 ($/M)AA 태스크당*비고
Kimi K3$3.00 (캐시 $0.30)$15.00~$0.94K2.6 대비 약 6배
DeepSeek V4 Pro$0.435 (캐시 $0.0036)$0.872026년 5월 75% 영구 인하
DeepSeek V4 Flash$0.14$0.28경량 티어
Claude Sonnet 5$3.00 (프로모 $2.00 8/31까지)$15.00 (프로모 $10.00)Kimi K3 표준과 동일
Gemini 3.5 Flash-Lite약 $2.80/100만 token (입출 합산)Google 경량 티어
MAI-Code-1-Flash$0.75$4.50GitHub Copilot 전용, 단독 API 없음
GPT-5.6 Sol (표준)$5.00$30.00~$1.04AA 태스크당 K3보다 약간 높음

*Artificial Analysis 「완료 태스크당 비용」은 제3자 방법론이며 OpenAI 공식 요금이 아닙니다. 경쟁 token 단가는 각사 2026년 7월 공개 가격표 기준입니다.

Artificial Analysis: Kimi K3 ~$0.94/태스크, GPT-5.6 Sol ~$1.04——능력 티어에서는 Sol이 약간 비싸지만, Luna 인하 후 경량 워크로드 단위 비용은 OpenAI 쪽이 크게 압축됩니다.

03

심층 분석: Sol이 GPU 커널을 자체 최적화했는데 「Luna 인하·Sol 유지·Fast 판매」를 택한 이유

결론: 7월 29일 기술 블로그와 7월 30일 계층 요금은 같은 전략의 양면——내부 비용 절감으로 경량 SKU를 내리고, 지연 민감 수요는 Fast로 수익화하며, 표준 Sol로 플래그십 마진을 유지합니다.

Sol 팀은 Triton/Gluon GPU 커널 재작성, 투기 디코딩, KV cache 레이아웃 최적화로 내부 테스트에서 추론 비용 약 20% 절감·처리량 약 15% 향상, FpSan 수치 검증까지 수행했다고 밝혔습니다. 이론상 Luna/Terra 인하 여지는 생기지만 Sol 표준은 유지——비용 개선은 DeepSeek V4 Flash 등 경량 경쟁에 투입하고 플래그십 프리미엄은 지키는 해석입니다.

Sol Fast는 $10/$60(표준 2배)로 약 2.5배 속도, Priority Processing 후속입니다. 실시간 Agent 도구 호출·IDE 보완 등 저지연 경로는 프리미엄을 지불하고, 배치 오프라인은 표준 Sol이나 인하된 Terra가 합리적입니다. Kimi K3의 「Sonnet급 표준가+100만 token 차별화」와 대조적으로 OpenAI는 전면 인하가 아닌 SKU 계층으로 대응합니다.

7월 27일 K3 가중치 공개 후 AA는 K3 ~$0.94, Sol ~$1.04——차이 9.4%. METR 보상 해킹·벤치 자체 보고를 둘러싼 Reddit/X 논쟁은 계속되며, 독립 재현 데이터는 아직 제한적입니다.

04

인하 후 6단계: 라우팅·부하 테스트·청구 재계산

01

최근 30일 token 명세 내보내기:Luna / Terra / Sol / Sol Fast별 입력·출력·캐시 히트를 분해해 조정 전 기준선을 만듭니다.

02

태스크 계층 재매핑:잡담·분류·단순 보완은 Luna($0.20/$1.20), 중간 추론은 Terra, agentic/SWE만 표준 Sol에 둡니다.

03

Sol Fast ROI 실측:저지연 경로에서 2.5배 속도가 2배 단가를 정당화하는지——배치 작업에 Fast 기본값을 쓰지 마세요.

04

Kimi K3·DeepSeek V4 병행 A/B:Artificial Analysis식 「완료 태스크 비용」으로 자체 코드베이스 총비용을 비교합니다. $/M만 보지 마세요.

05

OpenRouter / LiteLLM 라우팅 규칙 갱신:Luna 신가격을 fallback 체인에 반영하고, 일일 상한으로 구 model ID로의 강등을 막습니다.

06

7일 재검증 기간:Sol/Terra 추가 조정, K3 캐시 적중률, K2.6에서의 이전 비용을 추적합니다.

05

논점, 3가지 하드 데이터, 계층 요금 하의 선정 창

이번 조정은 의견이 갈립니다. Luna 입력 $0.20/M는 고빈도 앱 문턱을 크게 낮췄지만, Sol 20%/15%는 자체 보고이고 METR 관련 보상 해킹 논의도 이어집니다. K3는 AA 태스크당 Sol을 약간 밑돌지만 K2.6 대비 6배——2026년 7월 「인하 시즌」은 일방적 양보가 아니라 속도 프리미엄·SKU 계층·오픈웨이트 앵커의 재조정입니다.

A

80% / Luna 인하:입력 $1→$0.20, 출력 $6→$1.20(OpenAI 7월 30일 공지)——GPT-5.6 패밀리 최대 정가 변경.

B

$0.94 vs $1.04 / AA 태스크당:Kimi K3 ~$0.94, GPT-5.6 Sol ~$1.04——능력 티어에서 Sol 9.4% 높지만 Luna 인하 후 경량 워크로드 격차 확대.

C

6× / K3 vs K2.6:K3 입력 $3/M, K2.6 $0.60/M——오픈웨이트 진영 플래그십 SKU도 재앵커 중.

주의:Sol GPU 수치, METR 논점, AA 태스크당 비용은 벤더/제3자 추정——자체 workload로 검증하세요. Sol Fast 2배 단가가 자동으로 2배 가치를 의미하지 않습니다.

대안 정리:개인 Mac만으로 다중 모델 A/B·Agent 부하 테스트는 절전·네트워크 끊김으로 장컨텍스트가 중단되기 쉽습니다.클라우드 API 일원화는 7월 집중 조정기 라우팅 재작성이 잦습니다.기업 GPU 클러스터 승인 대기는 격주급 모델·요금 업데이트를 따라가기 어렵습니다. iOS CI/CD, 로컬 추론, AI Agent 7×24 자동화 본番 환경에는 KVMNODE 전용 Mac Mini M4 클라우드 임대가 보통 더 적합합니다. Apple Silicon 통합 메모리, sudo 개방, 일/주/월 유연 과금. 가격 페이지, 고객 센터, 바로 주문을 참고하세요.

데이터 기준: 2026년 7월 31일 · 출처: OpenAI 2026-07-30 요금 공지, OpenAI 2026-07-29 Sol GPU 최적화 블로그, Moonshot AI Kimi K3, Artificial Analysis 태스크당 비용, DeepSeek V4 공식 가격, Reddit / X, METR 관련 보도