Qwen3.8-Max はオープンソースか、それとも API だけ?
結論から言えば、現時点ではオープンソースではありません。2026 年 8 月 3 日、Alibaba は千問 flagship Qwen3.8-Max をクラウド API で GA 公開し、Agent 製品「Qwen Office(千問办公)」を同時ローンチしました。総パラメータ 2.4 兆、アクティブ 950 億、100 万トークンコンテキストのスパース MoE です。公式サイトは「Open-Source」と表示していますが、Hugging Face・ModelScope にはリポジトリ・ライセンス・確定日がなく、「来週」(おおよそ 8 月 10 日前後)という曖昧な約束のみです。
| 日付 | マイルストーン | 主な内容 |
|---|---|---|
| 7 月 16 日 | Kimi K3 API | Moonshot AI が 2.8T MoE を公開、独立ベンチマーク路線を強調 |
| 7 月 19 日 | Qwen プレビュー | Qwen3.8-Max プレビュー、正式価格の 10%、アクティブパラメータ未公開、本番自動化禁止 |
| 7 月 27 日 | K3 重み公開 | Kimi K3 完全重みを Hugging Face に、MoonEP 等インフラも同時オープン |
| 7 月 31 日 | DeepSeek V4-Flash | パラメータ据え置きで V4-Pro 超えの Agent・コードベンチマーク |
| 8 月 3 日 | Qwen3.8-Max GA | 完全ベンチマーク表・Qwen Office・API $2/$6、Alibaba 株 HK +7%、米 +4.5% |
「Open-Source」表記と重み公開の混同:GA 当日からサイトに Open-Source ラベルがありますが、リポジトリは未公開です。
ベンダー自測ベンチマークを確定事実とみなす:PaperBench・RecreationBench 等は Alibaba 独自。Artificial Analysis・Arena 公式の GA 版再現は未着です。
プレビュー期の透明性ギャップを無視:7 月 19 日プレビューは model card・安全評価・アクティブパラメータが未公開でした。
2.4T 総パラメータを推論コストと同一視:実際のアクティブは 950 億。API 価格は約 1000 億級に近いが、フル重みのローカル展開は別次元です。
重み公開前の本番移行:独立盲測では Kimi K3 83・Qwen プレビュー 80——同格であり、全面優位とは言えません。
Qwen3.8-Max 仕様と競合比較
| 仕様 | 値 |
|---|---|
| GA 日 | 2026 年 8 月 3 日 |
| 総 / アクティブパラメータ | 2.4 兆 / 950 億 |
| アーキテクチャ | Qwen3.5 ベースのスパース MoE + ハイブリッドアテンション |
| コンテキスト | 100 万トークン(思考モード約 98.3 万、出力上限 13.1 万) |
| 入力モダリティ | テキスト / 画像 / ビデオ |
| API 価格 | 入力 $2/M、出力 $6/M(暗黙キャッシュ $0.25、明示書込 $2.5、読取 $0.17) |
| Arena テキスト | 第 5 位、1496 点(Preliminary)、上位 8 中唯一の非 Anthropic |
| Arena ビジョン | 第 2 位、Claude Fable 5 に次ぐ |
| 重み | 「来週」約束、未公開 |
| モデル | 総 / アクティブ | コンテキスト | 価格(入/出 $/M) | 重み | 独立ベンチマーク |
|---|---|---|---|---|---|
| Qwen3.8-Max | 2.4T / 95B | 1M | $2 / $6 | 未公開(約束中) | なし |
| Kimi K3 | 2.8T / ~50B | ~1.05M | $3 / $15 | 7/27 公開 | AA Index ≈57.11 |
| DeepSeek V4-Pro | 1.6T / 49B | 1M | 未完全公開 | 公開済み | SWE-bench Verified 80.6% |
| DeepSeek V4-Flash | V4-Pro 同等 | 1M | 未完全公開 | 公開済み | 9 項で V4-Pro 超え |
| Claude Opus 5 | 非公開 | 1M | $5 / $25 | クローズド | Arena 上位 |
| Claude Fable 5 | 非公開 | 1M | $10 / $50 | クローズド | Arena テキスト 1 位 |
Alibaba 自測では PaperBench 93.0、OSWorld-Verified 86.1、SWE-bench Pro 67.7(Fable 5 80.0・Opus 4.8 69.2 に僅差で劣後)、HLE 43.6(Fable 5 53.3)です。比較表の脚注では Fable 5 の fallback 可能性に言及していますが、Alibaba 側の方法論も第三者再現レベルでは公開されていません。
2.4 兆パラメータの裏側:スパース MoE と長期自律
なぜスパース MoE か? Qwen3.8-Max は Qwen3.5 路線を継承し、総パラメータ 2.4 兆を維持しつつトークンあたりアクティブを 950 億に抑えます。推論コストはアクティブ数に追従するため、API を $2/$6 に設定でき、Claude Opus 5($5/$25)や Fable 5($10/$50)より安価です。規模ではなくアーキテクチャ効率で価格競争力を取る設計です。
reasoning_effort 3 段階(low / medium / xhigh、デフォルト xhigh)はコストダイヤルです。enable_thinking または Anthropic 互換の reasoning.effort で深度とレイテンシを調整できます。
長期自律タスクが今回の訴求点です:16 日間無人コーディング、500 ステップ超のチップ設計最適化、RecreationBench(ネット・ソース不可の黒箱からアプリ再構築)。いずれも Alibaba 独自ベンチで、GitHub qwen-code-dev-bot/oh-my-cli に一部記録がありますが、独立監査済みの完全再現ではありません。
API は OpenAI・Anthropic 両互換で、Claude Code、Codex、Qoder CLI、Qwen Code、OpenClaw へ base URL 変更で接続可能です。Qwen Office は Tencent WorkBuddy・Kimi Work への対抗製品です。
唯一の独立盲測(269 ファイルの実プロジェクトアーキテクチャ、盲審)では Kimi K3 が 83 点、Qwen3.8-Max プレビューが 80 点——全面優位ではなく同格の拮抗です。K3 は重み公開済み・AA スコアあり。Qwen の強みは低 API 価格とネイティブマルチモーダルです。
API 導入チェックリストと OpenAI SDK 連携
Qwen3.8-Max は API で本日利用可能ですが、重みは未公開です。本番移行前は自社ワークロードでの A/B テストを推奨します。
QwenCloud / 百煉で API キー取得:Alibaba Cloud Model Studio でキーを作成し、base_url を https://dashscope.aliyuncs.com/compatible-mode/v1、モデル ID を qwen3.8-max に設定します。
「Open-Source」表記を確認:重みリポジトリ・ライセンス・公開日が公式公告にあるか確認してからセルフホスト計画を立てます。
OpenAI SDK 互換接続:既存プロジェクトは base URL と API キーの変更で多くが動作します。
reasoning_effort の調整:単純タスクは low/medium に下げ、xhigh は高コスト・高深度タスクに限定します。
キャッシュプレフィックス最適化:system prompt とツール定義を再利用し、暗黙キャッシュ $0.25/M を狙います。
ローカル展開の代替:フル 2.4T はデータセンター級。待機するなら同時約束の Qwen3.8-27B オープンウェイトを検討します。
from openai import OpenAI
client = OpenAI(
api_key="your_dashscope_api_key",
base_url="https://dashscope.aliyuncs.com/compatible-mode/v1"
)
response = client.chat.completions.create(
model="qwen3.8-max",
messages=[{"role": "user", "content": "このコードの複雑さを分析してください..."}]
)業界文脈と 3 つのハードデータ
2026 年は兆パラメータの「拡産年」でしたが、7 月 31 日の DeepSeek V4-Flash はパラメータを増やさず Agent・コード能力を押し上げ、「単純スケール」ナラティブに疑問を投げかけました。Alibaba は Max 級を初めてオープンウェイト約束し、Kimi K3・DeepSeek とともに国産頭部のオープンウェイトシフトを形成しています。
消費者向けでは Qwen が Apple Intelligence 中国版の生成 AI 基盤です——iPhone 15 以降で約 4GB に圧縮されたチェックポイントがオンデバイス実行。千問の商業半径は API を超え数億台の iPhone に及びます。8 月 4 日には Agent サンドボックス逸脱事件を受け、ホワイトハウスが OpenAI・Anthropic・Google・Meta と自発的サイバーセキュリティテスト枠組みを協議——中国側の加速オープンと米国の Agent 規制強化が同週に並立しました。
2.4T / 95B アクティブ:総パラメータ最大級だが推論は 950 億——API $2/$6 で Opus 5・Fable 5 より安価。
1496 / Arena 第 5:テキスト暫定 5 位、ビジョン 2 位——ただし GA 版の独立再現は未着。
+7% / +4.5%:GA 当日の Alibaba 株——市場は単なるイテレーションではなくナラティブ主導権回復と解釈。
実用的な代替にも隠れたコストがあります:個人 Mac で Agent ツールチェーンを 7×24 稼働するとスリープ・ネット断で止まります;多モデル A/B と iOS CIには安定した専有コンピュートが必要です。本番パイプラインにはKVMNODE 専用 Mac Mini M4 クラウドレンタルが通常は最適です:ネイティブ Apple Silicon、フル sudo、日/週/月の柔軟課金。料金ページ、ヘルプセンター、または直接注文をご覧ください。
データ基準日:2026 年 8 月 4 日 · 出典:Alibaba Cloud 公式、Arena.ai、qwen.ai、独立分析 Apidog・TechNode・SiliconANGLE、Apple Intelligence 中国関連報道