Qwen3.8-Max는 오픈소스인가, API만 공개된 것인가?
결론부터 말하면, 현재 시점에서는 오픈소스가 아닙니다. 2026년 8월 3일 Alibaba는 Qwen flagship Qwen3.8-Max를 클라우드 API로 GA 출시하고 Agent 제품 「Qwen Office」를 동시 론칭했습니다. 총 2.4조·활성 950억 파라미터, 100만 토큰 컨텍스트 sparse MoE입니다. 공식 사이트는 Open-Source로 표시하지만 Hugging Face·ModelScope에는 저장소·라이선스·확정일이 없고 「다음 주」(약 8월 10일 전후)라는 모호한 약속만 있습니다.
| 날짜 | 마일스톤 | 핵심 내용 |
|---|---|---|
| 7월 16일 | Kimi K3 API | 월지암면 2.8T MoE 공개, 독립 벤치마크·기술 보고서 강조 |
| 7월 19일 | Qwen 프리뷰 | Qwen3.8-Max 프리뷰, 정가 10%, 활성 파라미터 미공개, 프로덕션 자동화 금지 |
| 7월 27일 | K3 가중치 | Kimi K3 전체 가중치 Hugging Face, MoonEP 등 인프라 동시 오픈 |
| 7월 31일 | DeepSeek V4-Flash | 파라미터 유지, V4-Pro 초과 Agent·코드 벤치마크 |
| 8월 3일 | Qwen3.8-Max GA | 전체 벤치마크·Qwen Office·API $2/$6, 알리 주가 HK +7%, 미국 +4.5% |
Open-Source 표기와 가중치 공개 혼동: GA 당일부터 사이트에 Open-Source 라벨이 있지만 저장소는 미공개입니다.
벤더 자체 벤치마크를 확정으로 받아들이기: PaperBench·RecreationBench 등 Alibaba 독자 벤치. Artificial Analysis·Arena 공식 GA 재현은 없습니다.
프리뷰 투명성 공백 무시: 7월 19일 프리뷰는 model card·안전 평가·활성 파라미터가 없었습니다.
2.4T 총 파라미터를 추론 비용과 동일시: 실제 활성은 950억. API 가격은 천억급에 가깝지만 풀 가중치 로컬 배포는 별개입니다.
가중치 공개 전 프로덕션 이전: 독립 맹심 테스트 Kimi K3 83·Qwen 프리뷰 80——동급 격돌, 전면 우위는 아닙니다.
Qwen3.8-Max 스펙과 경쟁 모델 비교
| 스펙 | 값 |
|---|---|
| GA 일 | 2026년 8월 3일 |
| 총 / 활성 파라미터 | 2.4조 / 950억 |
| 아키텍처 | Qwen3.5 기반 sparse MoE + 하이브리드 attention |
| 컨텍스트 | 100만 토큰(사고 모드 약 98.3만, 출력 상한 13.1만) |
| 입력 모달 | 텍스트 / 이미지 / 비디오 |
| API 가격 | 입력 $2/M, 출력 $6/M(암시 캐시 $0.25, 명시 쓰기 $2.5, 읽기 $0.17) |
| Arena 텍스트 | 5위, 1496점(Preliminary), 상위 8 중 유일 비-Anthropic |
| Arena 비전 | 2위, Claude Fable 5 다음 |
| 가중치 | 「다음 주」 약속, 미공개 |
| 모델 | 총 / 활성 | 컨텍스트 | 가격(입/출 $/M) | 가중치 | 독립 벤치마크 |
|---|---|---|---|---|---|
| Qwen3.8-Max | 2.4T / 95B | 1M | $2 / $6 | 미공개(약속) | 없음 |
| Kimi K3 | 2.8T / ~50B | ~1.05M | $3 / $15 | 7/27 공개 | AA Index ≈57.11 |
| DeepSeek V4-Pro | 1.6T / 49B | 1M | 미완전 공개 | 공개 | SWE-bench Verified 80.6% |
| DeepSeek V4-Flash | V4-Pro 동급 | 1M | 미완전 공개 | 공개 | 9항목 V4-Pro 초과 |
| Claude Opus 5 | 비공개 | 1M | $5 / $25 | 폐쇄 | Arena 상위 |
| Claude Fable 5 | 비공개 | 1M | $10 / $50 | 폐쇄 | Arena 텍스트 1위 |
Alibaba 자체 측정: PaperBench 93.0, OSWorld-Verified 86.1, SWE-bench Pro 67.7(Fable 5 80.0·Opus 4.8 69.2에 근소 열세), HLE 43.6(Fable 5 53.3). 비교표 각주는 Fable 5 fallback 가능성을 언급하지만 Alibaba 방법론도 제3자 재현 수준으로 공개되지 않았습니다.
2.4조 파라미터 이면: sparse MoE와 장기 자율
왜 sparse MoE인가? Qwen3.8-Max는 Qwen3.5 노선을 계승하여 총 2.4조를 유지하되 토큰당 활성을 950억으로 제한합니다. 추론 비용은 활성 수를 따르므로 API를 $2/$6으로 설정할 수 있고 Claude Opus 5($5/$25)·Fable 5($10/$50)보다 저렴합니다. 규모가 아닌 아키텍처 효율로 가격 경쟁력을 노립니다.
reasoning_effort 3단(low / medium / xhigh, 기본 xhigh)은 비용 다이얼입니다. enable_thinking 또는 Anthropic 호환 reasoning.effort로 깊이와 지연을 조절합니다.
장기 자율 태스크가 이번 핵심 소구: 16일 무인 코딩, 500단계 이상 칩 설계 최적화, RecreationBench(네트·소스 불가 흑박스에서 앱 재구축). 모두 Alibaba 독자 벤치이며 GitHub qwen-code-dev-bot/oh-my-cli에 일부 기록이 있지만 독립 감사·완전 재현은 아닙니다.
API는 OpenAI·Anthropic 양쪽 호환으로 Claude Code, Codex, Qoder CLI, Qwen Code, OpenClaw에 base URL 변경으로 연결 가능합니다. Qwen Office는 Tencent WorkBuddy·Kimi Work 대응 제품입니다.
유일한 독립 맹심 테스트(269파일 실프로젝트 아키텍처, 맹심)에서 Kimi K3 83점, Qwen3.8-Max 프리뷰 80점——전면 우위가 아닌 동급 격돌입니다. K3는 가중치 공개·AA 점수 확보. Qwen 강점은 낮은 API 가격과 네이티브 멀티모달입니다.
API 배포 체크리스트와 OpenAI SDK 연동
Qwen3.8-Max는 API로 당일 사용 가능하지만 가중치는 미공개입니다. 프로덕션 이전 전 자체 workload A/B 테스트를 권장합니다.
QwenCloud / 백련 API 키 발급: Alibaba Cloud Model Studio에서 키를 생성하고 base_url을 https://dashscope.aliyuncs.com/compatible-mode/v1, 모델 ID를 qwen3.8-max로 설정합니다.
Open-Source 표기 확인: 가중치 저장소·라이선스·공개일이 공식 공지에 있는지 확인한 뒤 셀프호스팅을 계획합니다.
OpenAI SDK 호환 연결: 대부분 기존 프로젝트는 base URL과 API 키만 바꾸면 동작합니다.
reasoning_effort 조정: 단순 작업은 low/medium, xhigh는 고비용·고깊이 태스크에만 사용합니다.
캐시 prefix 최적화: system prompt와 도구 정의를 재사용하여 암시 캐시 $0.25/M을 노립니다.
로컬 배포 대안: 풀 2.4T는 데이터센터급. 대기한다면 동시 약속된 Qwen3.8-27B 오픈 웨이트를 검토합니다.
from openai import OpenAI
client = OpenAI(
api_key="your_dashscope_api_key",
base_url="https://dashscope.aliyuncs.com/compatible-mode/v1"
)
response = client.chat.completions.create(
model="qwen3.8-max",
messages=[{"role": "user", "content": "이 코드의 복잡도를 분석해 주세요..."}]
)업계 맥락과 세 가지 핵심 수치
2026년은 조 파라미터 「확산의 해」였지만 7월 31일 DeepSeek V4-Flash는 파라미터를 늘리지 않고 Agent·코드 능력을 올려 「단순 스케일」 내러티브에 의문을 던졌습니다. Alibaba는 Max급을 처음 오픈 웨이트로 약속하여 Kimi K3·DeepSeek과 함께 국산 헤드 벤더의 개방 가중치 전환을 형성합니다.
소비 단에서는 Qwen이 Apple Intelligence 중국판 생성 AI 기반입니다——iPhone 15 이상에서 약 4GB로 압축된 체크포인트 온디바이스 실행. Qwen 상업 범위는 API를 넘어 수억 대 iPhone에 닿습니다. 8월 4일 Agent 샌드박스 탈출 사건에 백악관이 OpenAI·Anthropic·Google·Meta와 자발적 사이버보안 테스트 프레임을 협의——중국의 가속 오픈과 미국의 Agent 규제 강화가 같은 주에 병렬했습니다.
2.4T / 95B 활성: 총 파라미터 최상위급이지만 추론은 950억——API $2/$6으로 Opus 5·Fable 5보다 저렴.
1496 / Arena 5위: 텍스트 잠정 5위, 비전 2위——GA 독립 재현은 미착.
+7% / +4.5%: GA 당일 알리 주가——시장은 단순 이터레이션이 아닌 서사 주도권 회복으로 해석.
실용적 대안에도 숨은 비용이 있습니다: 개인 Mac에서 Agent 툴체인 7×24 가동은 절전·네트워크 단절에 취약합니다; 다중 모델 A/B와 iOS CI에는 안정적인 전용 컴퓨트가 필요합니다. 프로덕션 파이프라인에는 KVMNODE 전용 Mac Mini M4 클라우드 대여가 보통 더 적합합니다: 네이티브 Apple Silicon, 전체 sudo, 일/주/월 유연 과금. 가격 페이지, 고객 센터, 또는 바로 주문을 참고하세요.
데이터 기준: 2026년 8월 4일 · 출처: Alibaba Cloud 공식, Arena.ai, qwen.ai, Apidog·TechNode·SiliconANGLE, Apple Intelligence 중국 관련 보도