本番で Qwen3.8-Max を検討するなら、最初に確認すべきはパラメータ数ではなく、Alibaba のリリースが本当にオープンソースかどうかです。2026 年 8 月 3 日、同社は 2.4 兆パラメータ MoEの新 flagship Qwen3.8-Max を GA 公開し、qwen.ai には「Open-Source」表記が付きました——しかし重みは未公開、ベンチマークはベンダー自測のみです。本記事では7 月 16 日〜8 月 3 日のタイムライン仕様と競合比較スパース MoE アーキテクチャ独立盲測 Kimi K3 83 vs Qwen 806 ステップの API 導入チェックリストを解説します。背景:Kimi K3 解説GPT-5.6 値下げ
01

Qwen3.8-Max はオープンソースか、それとも API だけ?

結論から言えば、現時点ではオープンソースではありません。2026 年 8 月 3 日、Alibaba は千問 flagship Qwen3.8-Max をクラウド API で GA 公開し、Agent 製品「Qwen Office(千問办公)」を同時ローンチしました。総パラメータ 2.4 兆、アクティブ 950 億、100 万トークンコンテキストのスパース MoE です。公式サイトは「Open-Source」と表示していますが、Hugging Face・ModelScope にはリポジトリ・ライセンス・確定日がなく、「来週」(おおよそ 8 月 10 日前後)という曖昧な約束のみです。

日付マイルストーン主な内容
7 月 16 日Kimi K3 APIMoonshot AI が 2.8T MoE を公開、独立ベンチマーク路線を強調
7 月 19 日Qwen プレビューQwen3.8-Max プレビュー、正式価格の 10%、アクティブパラメータ未公開、本番自動化禁止
7 月 27 日K3 重み公開Kimi K3 完全重みを Hugging Face に、MoonEP 等インフラも同時オープン
7 月 31 日DeepSeek V4-Flashパラメータ据え置きで V4-Pro 超えの Agent・コードベンチマーク
8 月 3 日Qwen3.8-Max GA完全ベンチマーク表・Qwen Office・API $2/$6、Alibaba 株 HK +7%、米 +4.5%
01

「Open-Source」表記と重み公開の混同:GA 当日からサイトに Open-Source ラベルがありますが、リポジトリは未公開です。

02

ベンダー自測ベンチマークを確定事実とみなす:PaperBench・RecreationBench 等は Alibaba 独自。Artificial Analysis・Arena 公式の GA 版再現は未着です。

03

プレビュー期の透明性ギャップを無視:7 月 19 日プレビューは model card・安全評価・アクティブパラメータが未公開でした。

04

2.4T 総パラメータを推論コストと同一視:実際のアクティブは 950 億。API 価格は約 1000 億級に近いが、フル重みのローカル展開は別次元です。

05

重み公開前の本番移行:独立盲測では Kimi K3 83・Qwen プレビュー 80——同格であり、全面優位とは言えません。

02

Qwen3.8-Max 仕様と競合比較

仕様
GA 日2026 年 8 月 3 日
総 / アクティブパラメータ2.4 兆 / 950 億
アーキテクチャQwen3.5 ベースのスパース MoE + ハイブリッドアテンション
コンテキスト100 万トークン(思考モード約 98.3 万、出力上限 13.1 万)
入力モダリティテキスト / 画像 / ビデオ
API 価格入力 $2/M、出力 $6/M(暗黙キャッシュ $0.25、明示書込 $2.5、読取 $0.17)
Arena テキスト第 5 位、1496 点(Preliminary)、上位 8 中唯一の非 Anthropic
Arena ビジョン第 2 位、Claude Fable 5 に次ぐ
重み「来週」約束、未公開
モデル総 / アクティブコンテキスト価格(入/出 $/M)重み独立ベンチマーク
Qwen3.8-Max2.4T / 95B1M$2 / $6未公開(約束中)なし
Kimi K32.8T / ~50B~1.05M$3 / $157/27 公開AA Index ≈57.11
DeepSeek V4-Pro1.6T / 49B1M未完全公開公開済みSWE-bench Verified 80.6%
DeepSeek V4-FlashV4-Pro 同等1M未完全公開公開済み9 項で V4-Pro 超え
Claude Opus 5非公開1M$5 / $25クローズドArena 上位
Claude Fable 5非公開1M$10 / $50クローズドArena テキスト 1 位

Alibaba 自測では PaperBench 93.0、OSWorld-Verified 86.1、SWE-bench Pro 67.7(Fable 5 80.0・Opus 4.8 69.2 に僅差で劣後)、HLE 43.6(Fable 5 53.3)です。比較表の脚注では Fable 5 の fallback 可能性に言及していますが、Alibaba 側の方法論も第三者再現レベルでは公開されていません。

03

2.4 兆パラメータの裏側:スパース MoE と長期自律

なぜスパース MoE か? Qwen3.8-Max は Qwen3.5 路線を継承し、総パラメータ 2.4 兆を維持しつつトークンあたりアクティブを 950 億に抑えます。推論コストはアクティブ数に追従するため、API を $2/$6 に設定でき、Claude Opus 5($5/$25)や Fable 5($10/$50)より安価です。規模ではなくアーキテクチャ効率で価格競争力を取る設計です。

reasoning_effort 3 段階(low / medium / xhigh、デフォルト xhigh)はコストダイヤルです。enable_thinking または Anthropic 互換の reasoning.effort で深度とレイテンシを調整できます。

長期自律タスクが今回の訴求点です:16 日間無人コーディング、500 ステップ超のチップ設計最適化、RecreationBench(ネット・ソース不可の黒箱からアプリ再構築)。いずれも Alibaba 独自ベンチで、GitHub qwen-code-dev-bot/oh-my-cli に一部記録がありますが、独立監査済みの完全再現ではありません。

API は OpenAI・Anthropic 両互換で、Claude Code、Codex、Qoder CLI、Qwen Code、OpenClaw へ base URL 変更で接続可能です。Qwen Office は Tencent WorkBuddy・Kimi Work への対抗製品です。

唯一の独立盲測(269 ファイルの実プロジェクトアーキテクチャ、盲審)では Kimi K3 が 83 点、Qwen3.8-Max プレビューが 80 点——全面優位ではなく同格の拮抗です。K3 は重み公開済み・AA スコアあり。Qwen の強みは低 API 価格とネイティブマルチモーダルです。

04

API 導入チェックリストと OpenAI SDK 連携

Qwen3.8-Max は API で本日利用可能ですが、重みは未公開です。本番移行前は自社ワークロードでの A/B テストを推奨します。

01

QwenCloud / 百煉で API キー取得:Alibaba Cloud Model Studio でキーを作成し、base_urlhttps://dashscope.aliyuncs.com/compatible-mode/v1、モデル ID を qwen3.8-max に設定します。

02

「Open-Source」表記を確認:重みリポジトリ・ライセンス・公開日が公式公告にあるか確認してからセルフホスト計画を立てます。

03

OpenAI SDK 互換接続:既存プロジェクトは base URL と API キーの変更で多くが動作します。

04

reasoning_effort の調整:単純タスクは low/medium に下げ、xhigh は高コスト・高深度タスクに限定します。

05

キャッシュプレフィックス最適化:system prompt とツール定義を再利用し、暗黙キャッシュ $0.25/M を狙います。

06

ローカル展開の代替:フル 2.4T はデータセンター級。待機するなら同時約束の Qwen3.8-27B オープンウェイトを検討します。

python
from openai import OpenAI

client = OpenAI(
    api_key="your_dashscope_api_key",
    base_url="https://dashscope.aliyuncs.com/compatible-mode/v1"
)

response = client.chat.completions.create(
    model="qwen3.8-max",
    messages=[{"role": "user", "content": "このコードの複雑さを分析してください..."}]
)
05

業界文脈と 3 つのハードデータ

2026 年は兆パラメータの「拡産年」でしたが、7 月 31 日の DeepSeek V4-Flash はパラメータを増やさず Agent・コード能力を押し上げ、「単純スケール」ナラティブに疑問を投げかけました。Alibaba は Max 級を初めてオープンウェイト約束し、Kimi K3・DeepSeek とともに国産頭部のオープンウェイトシフトを形成しています。

消費者向けでは Qwen が Apple Intelligence 中国版の生成 AI 基盤です——iPhone 15 以降で約 4GB に圧縮されたチェックポイントがオンデバイス実行。千問の商業半径は API を超え数億台の iPhone に及びます。8 月 4 日には Agent サンドボックス逸脱事件を受け、ホワイトハウスが OpenAI・Anthropic・Google・Meta と自発的サイバーセキュリティテスト枠組みを協議——中国側の加速オープンと米国の Agent 規制強化が同週に並立しました。

A

2.4T / 95B アクティブ:総パラメータ最大級だが推論は 950 億——API $2/$6 で Opus 5・Fable 5 より安価。

B

1496 / Arena 第 5:テキスト暫定 5 位、ビジョン 2 位——ただし GA 版の独立再現は未着。

C

+7% / +4.5%:GA 当日の Alibaba 株——市場は単なるイテレーションではなくナラティブ主導権回復と解釈。

実用的な代替にも隠れたコストがあります:個人 Mac で Agent ツールチェーンを 7×24 稼働するとスリープ・ネット断で止まります;多モデル A/B と iOS CIには安定した専有コンピュートが必要です。本番パイプラインにはKVMNODE 専用 Mac Mini M4 クラウドレンタルが通常は最適です:ネイティブ Apple Silicon、フル sudo、日/週/月の柔軟課金。料金ページヘルプセンター、または直接注文をご覧ください。

データ基準日:2026 年 8 月 4 日 · 出典:Alibaba Cloud 公式、Arena.ai、qwen.ai、独立分析 Apidog・TechNode・SiliconANGLE、Apple Intelligence 中国関連報道