프로덕션에서 Qwen3.8-Max를 평가한다면, 먼저 확인할 것은 파라미터 수가 아니라 Alibaba 릴리스가 정말 오픈소스인지입니다. 2026년 8월 3일 Alibaba는 2.4조 파라미터 MoE flagship Qwen3.8-Max를 GA로 출시하고 qwen.ai에 「Open-Source」 표기를 붙였습니다——하지만 가중치는 미공개, 벤치마크는 벤더 자체 측정만 있습니다. 본문은 7월 16일~8월 3일 타임라인, 스펙·경쟁 비교, sparse MoE 아키텍처, 독립 맹심 테스트 Kimi K3 83 vs Qwen 80, 6단계 API 배포 체크리스트를 다룹니다. 배경: Kimi K3 해설, GPT-5.6 인하.
01

Qwen3.8-Max는 오픈소스인가, API만 공개된 것인가?

결론부터 말하면, 현재 시점에서는 오픈소스가 아닙니다. 2026년 8월 3일 Alibaba는 Qwen flagship Qwen3.8-Max를 클라우드 API로 GA 출시하고 Agent 제품 「Qwen Office」를 동시 론칭했습니다. 총 2.4조·활성 950억 파라미터, 100만 토큰 컨텍스트 sparse MoE입니다. 공식 사이트는 Open-Source로 표시하지만 Hugging Face·ModelScope에는 저장소·라이선스·확정일이 없고 「다음 주」(약 8월 10일 전후)라는 모호한 약속만 있습니다.

날짜마일스톤핵심 내용
7월 16일Kimi K3 API월지암면 2.8T MoE 공개, 독립 벤치마크·기술 보고서 강조
7월 19일Qwen 프리뷰Qwen3.8-Max 프리뷰, 정가 10%, 활성 파라미터 미공개, 프로덕션 자동화 금지
7월 27일K3 가중치Kimi K3 전체 가중치 Hugging Face, MoonEP 등 인프라 동시 오픈
7월 31일DeepSeek V4-Flash파라미터 유지, V4-Pro 초과 Agent·코드 벤치마크
8월 3일Qwen3.8-Max GA전체 벤치마크·Qwen Office·API $2/$6, 알리 주가 HK +7%, 미국 +4.5%
01

Open-Source 표기와 가중치 공개 혼동: GA 당일부터 사이트에 Open-Source 라벨이 있지만 저장소는 미공개입니다.

02

벤더 자체 벤치마크를 확정으로 받아들이기: PaperBench·RecreationBench 등 Alibaba 독자 벤치. Artificial Analysis·Arena 공식 GA 재현은 없습니다.

03

프리뷰 투명성 공백 무시: 7월 19일 프리뷰는 model card·안전 평가·활성 파라미터가 없었습니다.

04

2.4T 총 파라미터를 추론 비용과 동일시: 실제 활성은 950억. API 가격은 천억급에 가깝지만 풀 가중치 로컬 배포는 별개입니다.

05

가중치 공개 전 프로덕션 이전: 독립 맹심 테스트 Kimi K3 83·Qwen 프리뷰 80——동급 격돌, 전면 우위는 아닙니다.

02

Qwen3.8-Max 스펙과 경쟁 모델 비교

스펙
GA 일2026년 8월 3일
총 / 활성 파라미터2.4조 / 950억
아키텍처Qwen3.5 기반 sparse MoE + 하이브리드 attention
컨텍스트100만 토큰(사고 모드 약 98.3만, 출력 상한 13.1만)
입력 모달텍스트 / 이미지 / 비디오
API 가격입력 $2/M, 출력 $6/M(암시 캐시 $0.25, 명시 쓰기 $2.5, 읽기 $0.17)
Arena 텍스트5위, 1496점(Preliminary), 상위 8 중 유일 비-Anthropic
Arena 비전2위, Claude Fable 5 다음
가중치「다음 주」 약속, 미공개
모델총 / 활성컨텍스트가격(입/출 $/M)가중치독립 벤치마크
Qwen3.8-Max2.4T / 95B1M$2 / $6미공개(약속)없음
Kimi K32.8T / ~50B~1.05M$3 / $157/27 공개AA Index ≈57.11
DeepSeek V4-Pro1.6T / 49B1M미완전 공개공개SWE-bench Verified 80.6%
DeepSeek V4-FlashV4-Pro 동급1M미완전 공개공개9항목 V4-Pro 초과
Claude Opus 5비공개1M$5 / $25폐쇄Arena 상위
Claude Fable 5비공개1M$10 / $50폐쇄Arena 텍스트 1위

Alibaba 자체 측정: PaperBench 93.0, OSWorld-Verified 86.1, SWE-bench Pro 67.7(Fable 5 80.0·Opus 4.8 69.2에 근소 열세), HLE 43.6(Fable 5 53.3). 비교표 각주는 Fable 5 fallback 가능성을 언급하지만 Alibaba 방법론도 제3자 재현 수준으로 공개되지 않았습니다.

03

2.4조 파라미터 이면: sparse MoE와 장기 자율

왜 sparse MoE인가? Qwen3.8-Max는 Qwen3.5 노선을 계승하여 총 2.4조를 유지하되 토큰당 활성을 950억으로 제한합니다. 추론 비용은 활성 수를 따르므로 API를 $2/$6으로 설정할 수 있고 Claude Opus 5($5/$25)·Fable 5($10/$50)보다 저렴합니다. 규모가 아닌 아키텍처 효율로 가격 경쟁력을 노립니다.

reasoning_effort 3단(low / medium / xhigh, 기본 xhigh)은 비용 다이얼입니다. enable_thinking 또는 Anthropic 호환 reasoning.effort로 깊이와 지연을 조절합니다.

장기 자율 태스크가 이번 핵심 소구: 16일 무인 코딩, 500단계 이상 칩 설계 최적화, RecreationBench(네트·소스 불가 흑박스에서 앱 재구축). 모두 Alibaba 독자 벤치이며 GitHub qwen-code-dev-bot/oh-my-cli에 일부 기록이 있지만 독립 감사·완전 재현은 아닙니다.

API는 OpenAI·Anthropic 양쪽 호환으로 Claude Code, Codex, Qoder CLI, Qwen Code, OpenClaw에 base URL 변경으로 연결 가능합니다. Qwen Office는 Tencent WorkBuddy·Kimi Work 대응 제품입니다.

유일한 독립 맹심 테스트(269파일 실프로젝트 아키텍처, 맹심)에서 Kimi K3 83점, Qwen3.8-Max 프리뷰 80점——전면 우위가 아닌 동급 격돌입니다. K3는 가중치 공개·AA 점수 확보. Qwen 강점은 낮은 API 가격과 네이티브 멀티모달입니다.

04

API 배포 체크리스트와 OpenAI SDK 연동

Qwen3.8-Max는 API로 당일 사용 가능하지만 가중치는 미공개입니다. 프로덕션 이전 전 자체 workload A/B 테스트를 권장합니다.

01

QwenCloud / 백련 API 키 발급: Alibaba Cloud Model Studio에서 키를 생성하고 base_urlhttps://dashscope.aliyuncs.com/compatible-mode/v1, 모델 ID를 qwen3.8-max로 설정합니다.

02

Open-Source 표기 확인: 가중치 저장소·라이선스·공개일이 공식 공지에 있는지 확인한 뒤 셀프호스팅을 계획합니다.

03

OpenAI SDK 호환 연결: 대부분 기존 프로젝트는 base URL과 API 키만 바꾸면 동작합니다.

04

reasoning_effort 조정: 단순 작업은 low/medium, xhigh는 고비용·고깊이 태스크에만 사용합니다.

05

캐시 prefix 최적화: system prompt와 도구 정의를 재사용하여 암시 캐시 $0.25/M을 노립니다.

06

로컬 배포 대안: 풀 2.4T는 데이터센터급. 대기한다면 동시 약속된 Qwen3.8-27B 오픈 웨이트를 검토합니다.

python
from openai import OpenAI

client = OpenAI(
    api_key="your_dashscope_api_key",
    base_url="https://dashscope.aliyuncs.com/compatible-mode/v1"
)

response = client.chat.completions.create(
    model="qwen3.8-max",
    messages=[{"role": "user", "content": "이 코드의 복잡도를 분석해 주세요..."}]
)
05

업계 맥락과 세 가지 핵심 수치

2026년은 조 파라미터 「확산의 해」였지만 7월 31일 DeepSeek V4-Flash는 파라미터를 늘리지 않고 Agent·코드 능력을 올려 「단순 스케일」 내러티브에 의문을 던졌습니다. Alibaba는 Max급을 처음 오픈 웨이트로 약속하여 Kimi K3·DeepSeek과 함께 국산 헤드 벤더의 개방 가중치 전환을 형성합니다.

소비 단에서는 Qwen이 Apple Intelligence 중국판 생성 AI 기반입니다——iPhone 15 이상에서 약 4GB로 압축된 체크포인트 온디바이스 실행. Qwen 상업 범위는 API를 넘어 수억 대 iPhone에 닿습니다. 8월 4일 Agent 샌드박스 탈출 사건에 백악관이 OpenAI·Anthropic·Google·Meta와 자발적 사이버보안 테스트 프레임을 협의——중국의 가속 오픈과 미국의 Agent 규제 강화가 같은 주에 병렬했습니다.

A

2.4T / 95B 활성: 총 파라미터 최상위급이지만 추론은 950억——API $2/$6으로 Opus 5·Fable 5보다 저렴.

B

1496 / Arena 5위: 텍스트 잠정 5위, 비전 2위——GA 독립 재현은 미착.

C

+7% / +4.5%: GA 당일 알리 주가——시장은 단순 이터레이션이 아닌 서사 주도권 회복으로 해석.

실용적 대안에도 숨은 비용이 있습니다: 개인 Mac에서 Agent 툴체인 7×24 가동은 절전·네트워크 단절에 취약합니다; 다중 모델 A/B와 iOS CI에는 안정적인 전용 컴퓨트가 필요합니다. 프로덕션 파이프라인에는 KVMNODE 전용 Mac Mini M4 클라우드 대여가 보통 더 적합합니다: 네이티브 Apple Silicon, 전체 sudo, 일/주/월 유연 과금. 가격 페이지, 고객 센터, 또는 바로 주문을 참고하세요.

데이터 기준: 2026년 8월 4일 · 출처: Alibaba Cloud 공식, Arena.ai, qwen.ai, Apidog·TechNode·SiliconANGLE, Apple Intelligence 중국 관련 보도