핵심 요약: 2026년 7월 24일 Anthropic이 Claude Opus 5를 출시했습니다. CursorBench 3.2에서 Fable 5와의 격차는 0.5% 이내, 비용은 약 절반입니다. Claude Max 기본 모델이 되었고 강제 데이터 보존은 없습니다. 3일 뒤 Kimi K3 증류 논란이 격화되었습니다. 백악관 OSTP 국장 Michael Kratsios가 Moonshot AI를 산업 증류로 비난했고, Redwood Research의 Ryan Greenblatt는 Kimi K3가 Claude라고 자칭하며 claude-opus-4-5-20250929 같은 내부 배포 ID를 출력한다는 분석을 공개했습니다. 본문은 Claude Opus 5 vs Fable 5 벤치마크·요금, Kimi K3가 Claude라고 말하는 이유, Moonshot이 Claude를 훔쳤는가에 대한 일정 논쟁, 개발자 6단계 라우팅 가이드, 7월 27일 가중치 공개의 의미를 다룹니다. Kimi K3 오픈 웨이트 가이드OpenRouter API 라우팅 가이드도 참고하세요.
01

Claude Opus 5 출시: Fable 5 반값, Claude Max 새 기본값

Anthropic은 2026년 7월 24일(미국 태평양 시간) Claude Opus 5를 공개하고 즉시 Claude Max 기본 모델로 설정했습니다. Claude Pro 구독자가 쓸 수 있는 가장 강력한 일상 모델입니다. 모델 ID: claude-opus-5. Claude API, AWS Bedrock, Google Vertex AI, Microsoft Foundry에서 이용 가능합니다. 요금은 입력 $5/M, 출력 $25/M로 Opus 4.8과 동일하지만 에이전트·코딩·리서치 워크로드 전반에서 성능이 크게 올랐습니다.

포지셔닝은 분명합니다. Opus 5는 플래그십이 아니라 Anthropic이 실제로 쓰길 원하는 일상 모델입니다. Fable급 지능을 Fable 가격이나 30일 데이터 보존 의무 없이 제공합니다.

사양Claude Opus 5
출시일2026년 7월 24일
요금입력 $5/M · 출력 $25/M(Opus 4.8과 동일)
컨텍스트1M tokens(기본·유일 티어)
최대 출력128K tokens
추론Thinking 기본 ON; Effort 파라미터로 깊이 조절
데이터 보존강제 없음(Fable 5/Mythos 5 30일 opt-in 정책과 대비)
고속 모드약 2.5× 속도, 2× 가격(Opus 4.8과 동일)

벤치마크 하이라이트(Anthropic 공식):

01

Frontier-Bench v0.1: 모든 모델 상회. 소프트웨어 엔지니어링 태스크에서 Opus 4.8의 2배 이상, 태스크당 비용은 더 낮음.

02

CursorBench 3.2: max effort에서 Fable 5 피크와 0.5% 이내, 비용은 절반. high/xhigh/max 티어에서 최고 성능 대비 가격.

03

ARC-AGI 3: 신규 문제 해결에서 2위 모델의 3배.

04

OSWorld 2.0: Fable 5 최고 점수를 비용 3분의 1 미만으로 넘김.

05

Zapier AutomationBench: 엔드투엔드 계정 헬스 워크플로 100% 통과——이전 모델은 0%.

06

연구/생명과학: 분광→구조 추론 +10.2점; 단백질 변이 기능 예측 +7.7점. Box 보고 전체 정확도 +8%, 데이터 분석 +11%, 실사 +17%.

안전·정렬: Anthropic 자동 행동 감사에서 Opus 5는 지금까지 가장 정렬된 모델로 평가됩니다. 기만률 최저, 악용 유도가 가장 어렵고, 되돌리기 어려운 조작에서 가장 안전합니다. Opus 5는 의도적으로 이중용도 사이버·바이오 리스크에서는 1위가 아닙니다(Mythos 5가 해당 티어). 사이버 분류기 개입은 Fable 5보다 약 85% 적음——소스코드 취약점 발견에는 쓸 수 있으나 바이너리 스캔, 펜테스트, exploit 생성은 차단됩니다.

02

Kimi K3 증류 논란: 백악관 비난과 「2주 일정」 문제

Moonshot AI(월지암면)는 2026년 7월 16일 Kimi K3를 공개했습니다. 2.8T 파라미터 희소 MoE(896 전문가, 16 활성), 1M 컨텍스트, 네이티브 비전, Kimi Delta Attention 기반입니다. 완전 가중치는 7월 27일 공개 예정입니다. 벤치마크는 강력합니다: 93.5% GPQA-Diamond, 91.2% BrowseComp. Fable 5·GPT-5.6 Sol 다음 순위, 가격은 훨씬 낮습니다. 아키텍처·API는 Kimi K3 오픈 웨이트 출시 가이드를 참고하세요.

6일 뒤 이야기는 지정학으로 전환되었습니다.

날짜사건
2026년 2월Anthropic, Moonshot·DeepSeek·MiniMax 산업 증류 비난; 340만+ 이상 API 호출 인용, 요청 메타데이터가 Moonshot 경영진으로 이어진다고 주장
2026년 7월 1일Claude Fable 5 일반 공개(이전 제한 rollout)
2026년 7월 16일Kimi K3 API·제품 가동
2026년 7월 22–23일백악관 OSTP 국장 Michael Kratsios, Moonshot 「대규모·은밀한 산업 증류」+ 태국 경유 무허가 Nvidia GB300 칩 사용 비난
2026년 7월 23일TechCrunch, 증류 일정에 대한 전문가 회의 보도
2026년 7월 24일Ryan Greenblatt 「K3 Claude 자칭」통계 분석 공개
2026년 7월 27일K3 완전 가중치 공개 예정——독립 검증 대기

7월 22–23일 Michael Kratsios(백악관 OSTP)가 X에서 Moonshot의 Anthropic Fable 역량 탈취 목적 증류, 태국 경유 수출 규제 Nvidia GB300 칩 사용을 비난했습니다. 재무장관 Scott Bessent도 미국 LLM 「워터마크」가 중국 모델에 나타났다고 말했으나 구체 내용은 없었습니다. Moonshot은 학습 과정 문의에 응답하지 않았고 Kratsios도 공개 증거를 제시하지 않았습니다.

Fable 5는 7월 1일부터 일반 공개되었습니다. 2주 만에 그만큼 데이터를 증류하고 모델을 학습해 출시하는 것은 불가능합니다.——Braden Hancock, Laude Institute/Snorkel AI 공동 창업자

TechCrunch는 여러 독립 연구자를 인터뷰했고, 일정만으로도 Kimi K3 증류 논란에 의문을 제기했습니다. Nathan Lambert(Allen Institute for AI)는 중국 랩이 강화학습으로 이동하면서 증류 한계효용이 줄어든다고 주장합니다. 증류만으로 K3를 설명할 수 있다면 경쟁사는 이미 GLM이나 K3를 복제했을 것입니다. Elon Musk는 xAI가 Grok 구축 시 OpenAI 모델을 증류했다고 증언하며 업계 관행이라고 했습니다. 쟁점은 「증류 존재 여부」가 아니라 「정상적 기술 차용」과 「은밀한 산업 절취」의 경계입니다.

참고: 7월 25일 기준 K3 완전 가중치는 미공개입니다. 외부 연구자는 파라미터 수·아키텍처·벤치마크 재현을 독립 검증할 수 없습니다——논란이 미결인 핵심 이유입니다.

03

Kimi K3가 Claude라고 말하는 이유: Greenblatt의 배포 ID 증거

Moonshot이 Claude를 훔쳤는가 논쟁에서 가장 기술적으로 설득력 있는 것은 정치 rhetoric이 아니라 행동 증거입니다. 7월 24일 전후 Redwood Research 수석 과학자 Ryan Greenblatt가 교차 엔트로피 분석(GitHub: rgreenblatt/which_claude_is_k3)을 공개해 각 모델의 identity 프롬프트 응답을 비교했습니다.

발견: Kimi K3는 Claude 자칭에 과도하게 치우침——모호한 표현이 아니라 Anthropic 내부 배포 ID 문자열을 그대로 출력하는 경우가 있습니다:

examples
claude-opus-4-5-20250929
claude-sonnet-4-5-20250929

실제 Claude 모델은 이렇게 동작하지 않습니다. Claude Sonnet 4.5는 「Claude Sonnet 4.5입니다」라고 답합니다. Opus 4.5는 버전 문자열을 생략하거나 틀립니다. K3는 교사 모델 자신의 설명보다 배포 메타데이터를 더 정확히 재현합니다——대화 모방만으로는 설명하기 어렵습니다.

모델자기 ID 신호고정된 세대
Kimi K2Claude Sonnet 4 지목2025년 중반 Claude 세대
Kimi K3Claude Opus 4.5/Sonnet 4.5 배포 ID 지목2025년 말 「Claude 4.5 세대」——Fable/Mythos 아님
실제 Claude 모델사람이 읽을 수 있는 제품명만현행 제품 라인

Greenblatt 해석: 학습 데이터에 배포 메타데이터가 붙은 Claude 출력——API 로그나 metadata 태그 합성 데이터——가 포함됐을 가능성이 큽니다. 일반적 스타일 모방보다 변명하기 어려운 증류 형태입니다. 세대 패턴(K2→Sonnet 4, K3→Opus 4.5)은 각 Kimi 릴리스가 당시 최신 Claude 세대를 흡수했음을 시사합니다.

01

시사하는 것: 내부 배포 문자열이 포함된 Claude 라벨 데이터로 학습——공개 채팅 transcript만이 아님.

02

증명하지 않는 것: Greenblatt는 이것이 증류의 결정적 증거가 아님을 명시——오염, 유출 system prompt, 공개 합성 데이터셋으로도 이론상 identity 혼란 설명 가능.

03

중요한 이유: saga에서 첫 기술적(비정치) 증거——백악관 rhetoric보다 강하고 학습 로그 결정적 증거보다 약함.

04

커뮤니티 해석(r/LocalLLaMA): 오픈/폐쇄 격차가 「일」 단위로 좁혀지는 흥분; 2.8T 로컬 실행 불가 농담; 실용파는 K3 강점이 Fable 5 초과가 아니라 가격+적은 거부.

컴플라이언스 표현: 증류 주장 인용 시 「alleged」「Greenblatt 분석에 따르면」「보도에 따르면」을 사용하세요. identity 혼란은 증거이지 판결은 아닙니다.

04

개발자 6단계: Opus 5 vs Fable 5 vs Kimi K3 라우팅

모델입력($/M)출력($/M)컨텍스트데이터 보존
Claude Opus 5$5.00$25.001M강제 없음
Claude Fable 5~$10.00~$50.001M30일 opt-in 필수
Kimi K3$3.00$15.001MMoonshot API 약관
GPT-5.6 Sol~$5.00~$15.00400KOpenAI 약관

Claude Opus 5 vs Fable 5에서 CursorBench 격차는 0.5%, 가격 격차는 약 50%입니다. 컴플라이언스 민감 워크로드에서는 Opus 5 무보존 기본값이 Fable의 미세 벤치마크 우위보다 중요할 수 있습니다. OpenRouter로 프로바이더 간 통합 청구 라우팅이 가능합니다.

6단계 운영 가이드:

01

컴플라이언스 우선 평가: 데이터 보존·수출 규제 노출·벤더 출처가 중요하면 Moonshot이 증류 의혹에 답할 때까지 Opus 5 무보존 정책과 Anthropic 계약이 K3보다 우선. Fable 5는 30일 보존 opt-in 필요.

02

자체 eval로 Opus 5 vs Fable 5 비교: CursorBench급 코딩 태스크와 자체 Agent harness 실행. Opus 5 $5/$25 vs Fable ~$10/$50——0.5% 격차가 워크로드에 허용 가능한지 검증 후 플래그십 요금 지불.

03

7월 27일 K3 가중치 대기: Hugging Face 가중치 공개·독립 팀 벤치마크 재현 전까지 K3 아키텍처 주장에 프로덕션 라우팅을 고정하지 마세요. API 실험은 가능, 아키텍처 의존 결정은 불가.

04

Greenblatt 발견 직접 검증: K3, Fable 5, Opus 5에 identity 프롬프트 실행. 자체 system prompt 설정에서 K3가 배포 ID를 출력하는지 확인하고 컴플라이언스 팀용 기록.

05

혼합 모델 라우팅: 일상 coding+Agent→Opus 5; 전沿 repo bug→Fable 5; 비용 민감 bulk+1M 컨텍스트→K3 API; 터미널 중심→GPT-5.6 Sol. 논란 미결 주간에 단일 모델 all-in 금지.

06

정책 동향 모니터링: 미국 오픈 웨이트 제한, 칩 수출 집행, Moonshot 7월 27일 라이선스 조항 추적. Anthropic 2월 340만 호출 비난과 7월 백악관 격상은 API ToS·라우팅 정책 변경을 촉발할 수 있습니다.

python
from openai import OpenAI

client = OpenAI(
    api_key="your_openrouter_key",
    base_url="https://openrouter.ai/api/v1"
)

response = client.chat.completions.create(
    model="anthropic/claude-opus-5",
    messages=[{"role": "user", "content": "당신은 누구입니까? 모델명과 버전만 답하세요."}]
)
05

가격 전쟁, 세 가지 하드 넘버, 7월 27일이 바꾸는 것

두 뉴스는 같은 산업 전환을 가리킵니다. 전沿 지능의 급속한 상품화입니다. Anthropic은 Opus 가격 유지로 Opus 5를 출하해 플래그십과 일상 모델 격차를 좁혔습니다. Moonshot은 오픈 웨이트, 1M flat 컨텍스트, 공격적 API 요금을 밀어냈고——Claude 출력에 편승했다는 비난을 받았습니다. Kimi K3 증류 논란은 누군가 턱없이 낮은 비용으로 전沿에 근접할 때 「더 나은 엔지니어링인가, 빌린 지능인가」라는 모든 랩이 맞닥뜨릴 첫 공개 쟁점입니다.

시나리오권장 경로이유
컴플라이언스 민감 기업Claude Opus 5 API강제 보존 없음; Fable급 벤치마크; Anthropic 계약 명확
전沿 coding/repo bugClaude Fable 5 APIFrontierSWE·GDPval v2 선두, 비용은 2순위
비용+1M 컨텍스트 실험Kimi K3 API(7/27 전)→7/27 후 자체 호스팅$3/$15·1M flat; 가중치 확인 전 올인 금지
출처 미결 리스크7/27+독립 감사 대기Greenblatt 증거는 시사적이나 결정적 아님; 가중치로 외부 검증 가능
멀티모델 Agent 프로덕션OpenRouter 혼합 라우팅단일 청구 레이어; 인프라 재배포 없이 모델 전환

개발자 관점: 컴플라이언스·데이터 보존이 중요하면 이번 주 Opus 5가 쉬운 업그레이드입니다. 절대 최저 비용이 이기고 출처 리스크가 허용되면 7월 27일 외부자가 숫자를 확인한 뒤 K3를 재평가하세요.

A

0.5%/50%: Opus 5 CursorBench 3.2 max effort에서 Fable 5와 0.5% 이내, token당 비용 약 절반($5/$25 vs ~$10/$50).

B

340만/2주: Anthropic 2월 비난 340만+ 이상 API 호출; Fable 5 공개~K3 출시 약 2주——일정 회의론 핵심 논점.

C

2.8T/7월 27일: K3 2.8T 파라미터 주장——최대급 오픈 웨이트 공개 대기; 외부 검증이 증류 논쟁 전체의 관문.

요약: Opus 5는 Anthropic의 가격 전쟁에 대한 실무적 답——플래그십급 Agent 성능을 Fable 가격·보존 마찰 없이. K3 증류 saga는 compelling 비용 스토리에 출처 질문을 덧씌웠습니다. 자체 워크로드에서 검증하고, 컴플라이언스가 필요하면 identity 검사를 실행하며, 7월 27일을 Moonshot 주장의 첫 실전 테스트로 보세요.

개인 Mac만으로 멀티모델 Agent 워크플로를 돌리면 슬립·네트워크 단절로 장 컨텍스트 작업이 쉽게 끊깁니다. 7/27 자체 호스팅 대기에는 64+ 가속 카드 슈퍼노드가 필요해 대부분 팀에 비현실적입니다. 단일 폐쇄형 API 의존은 K3 1M flat 요금 우위를 놓칩니다. iOS CI/CD, Claude Code/Kimi Code 상시 Agent, 7×24 AI 프로덕션 환경에는 KVMNODE 전용 Mac Mini M4 클라우드 대여가 보통 더 나은 호스트입니다. Apple Silicon 통합 메모리, sudo 개방, 일/주/월 유연 계약. 가격 페이지, 고객 센터, 직접 주문을 참고하세요.

데이터 기준: 2026년 7월 25일 · 벤치마크에 Anthropic·Moonshot 자체 보고 수치 포함 · 출처: anthropic.com/news/claude-opus-5, TechCrunch, Ryan Greenblatt GitHub(rgreenblatt/which_claude_is_k3), Moonshot/Kimi 공식 블로그, CNBC, The Verge, r/LocalLLaMA