Qwen3.8-Max正式リリース:2.4兆パラメータでArena世界5位、来週オープンソース予定
誰:Alibaba;いつ:2026年8月3日;何を:千問 Qwen3.8-Max を GA し Agent 製品「千問办公(Qwen Office)」を同時投入。本記事は AI 開発者向けにタイムライン、コアベンチ、Kimi K3/DeepSeek V4 比較、Open-Source 論争を整理し、5 段階 API Runbook と FAQ 5 件を付します。
痛点の整理:Qwen3.8-Max公開後、開発者が直視すべき3点
- Open-Sourceラベルが重みより先:qwen.ai は GA 当日に「Open-Source」表記。Hugging Face / ModelScope にリポジトリ・ライセンス・確定日なし。「来週」(8月10日前後予想)のみ——既オープンソース扱いはコンプライアンス監査リスク。
- ベンチマークはすべて Alibaba 自社ハーネス:PaperBench、QwenSWEBench、RecreationBench は社内;Arena 1,496点は Preliminary。Artificial Analysis は GA 版未再現。本番移行前に自前 A/B 必須。
- プレビュー期の透明性不足が GA まで:7/19 プレビューは本番自動化禁止・活性パラメータ非公開。GA で 950億開示;独立盲検(269ファイル設計)Kimi K3 83点 vs Qwen プレビュー 80点——同格互角。
タイムライン:プレビューから GA まで2週間
- 7月16日 — Moonshot AI が Kimi K3(2.8兆、896中16活性)公開、独立ベンチと技術レポート。
- 7月19日 — Qwen3.8-Max プレビュー(Token Plan / Qoder / QoderWork)、正式価格10%、活性パラメータ・ベンチ表なし、本番自動化禁止。
- 7月27日 — Kimi K3 が HF に open weight、注意カーネル・MoE 通信ライブラリも公開。
- 7月31日 — DeepSeek V4-Flash GA、パラメータ不変で V4-Pro を9項 Agent/コードベンチで上回る。
- 8月3日 — Qwen3.8-Max GA、完全ベンチ表と Qwen Office;阿里港股約+7%、米株約+4.5%。
- 来週(8月10日前後予想) — Qwen3.8-Max と Qwen3.8-27B を HF / ModelScope に。リポジトリ・ライセンス・確定日未公開。
コアスペック一覧
| 項目 | Qwen3.8-Max |
|---|---|
| GA日 | 2026年8月3日 |
| 総 / 活性 | 2.4兆 / 950億 |
| アーキテクチャ | Qwen3.5 ベース疎 MoE + ハイブリッド注意 |
| コンテキスト | 100万 token(思考約98.3万、出力上限13.1万) |
| モダリティ | テキスト / 画像 / 動画 |
| API 価格 | 入力 $2/百万、出力 $6/百万 token |
| 国内価格 | 入力12元/百万、出力36元/百万 |
| Arena Text(8/1) | 第5位、1496点(Preliminary)— 上位8中唯一非 Anthropic |
| Arena Vision | 第2位(Claude Fable 5 の次) |
| PaperBench(Alibaba) | 93.0(+28.2) |
| SWE-bench Pro(Alibaba) | 67.7(Fable 5 の 80.0 より低い) |
| 重み公開 | 「来週」約束、未公開 |
「Alibaba 自測」は公式資料由来。GA 版の独立再現は未確認。
横断比較表
| モデル | ラボ | 総/活性 | コンテキスト | 価格(入/出100万) | 重み | 独立ベンチ |
|---|---|---|---|---|---|---|
| Qwen3.8-Max | Alibaba | 2.4T / 950億 | 100万 | $2 / $6 | 未公開(約束中) | なし |
| Kimi K3 | Moonshot AI | 2.8T / 約500億 | 約104.8万 | $3 / $15 | 7/27 公開 | AA ≈57.11 |
| DeepSeek V4-Pro | DeepSeek | 1.6T / 490億 | 100万 | 未完全公開 | 公開済 | SWE-bench Verified 80.6% |
| DeepSeek V4-Flash | DeepSeek | V4-Pro 同規模 | 100万 | 未完全公開 | 公開済 | 9項で V4-Pro 超え |
| Claude Opus 5 | Anthropic | 非公開 | 100万 | $5 / $25 | クローズド | Arena 上位 |
| Claude Fable 5 | Anthropic | 非公開 | 100万 | $10 / $50 | クローズド | Arena Text 第1 |
アーキテクチャとエコシステム
疎 MoE:総 2.4兆・/token 活性 950億——推論コストは活性数に追従し $2/$6(Opus 5 $5/$25、Fable 5 $10/$50 より低い)。
reasoning_effort 三段(low/medium/xhigh、既定 xhigh)を enable_thinking または Anthropic 互換 reasoning.effort で調整。長期自律 Agent:16日無人コーディング、500+ステップチップ設計、RecreationBench 黒箱復元——Alibaba 自社ベンチ;一部 GitHub qwen-code-dev-bot/oh-my-cli。
Qwen Office と同時投入。OpenAI / Anthropic 両互換——Claude Code、Codex、Qoder CLI、Qwen Code、OpenClaw に base URL 差し替えで接続。
Open-Source ラベル論争
- GA 当日から Open-Source、HF / ModelScope にリポジトリなし。
- ベンチはすべて vendor-run;Arena 1496点は Preliminary。
- 脚注「Fable 5 may involve fallbacks」——自社方法論は未公開。
- プレビュー期:本番自動化禁止・活性パラメータ・model card・安全評価なし。
引用可能な技術データ(EEAT)
- 規模とコスト: 総 2.4T、活性 950億;API $2/M 入力、$6/M 出力。
- Arena と盲検: Arena Text 第5位 1496点(8/1、Preliminary);269ファイル Kimi K3 83、Qwen プレビュー 80。
- 長コンテキスト・マルチモーダル: 100万 token;Arena Vision 第2位。
5段階 API Runbook
FAQ
Qwen3.8-Max は今使える?オープンソース?
API は QwenCloud 経由で可(OpenAI / Anthropic 互換)。重み未公開。8/10 前後 HF / ModelScope 予定、確定日なし。
Kimi K3 との比較?
統一ベンチなし。盲検 Kimi K3 83 vs Qwen 80。K3 は重み公開済・AA あり;Qwen3.8-Max は API 安価・マルチモーダル。
2.4兆は自前運用不可?
フルモデルは DC 級。API が現実解。Qwen3.8-27B がローカル向け。
Alibaba ベンチは信頼できる?
ベンダー主張として扱い、第三者再現または自社 A/B を推奨。
一般ユーザーへの影響?
中国版 Apple Intelligence が圧縮 Qwen を iPhone 15+ でオンデバイス実行。
まとめ
Qwen3.8-Max は Alibaba 初の Max 級 open-weight 約束——2.4T/950億と $2/$6 は Agent エコシステム狙い。Open-Source は現時点では意図に過ぎず、スコアも独立再現待ち。Qwen Code / OpenClaw を個人ノート PC や Linux VPSだけで回すと、スリープ中断、API キーと本番 Repo 混在、Apple ツールチェーン(Xcode / Fastlane / notarytool)同機不可。7×24 無人 Agentで Qwen3.8-Max API と iOS CI / OpenClaw ゲートウェイを両立するなら VPSMAC M4 Mac クラウド(macOS ネイティブ、SSH + launchd)が個人端末や Linux VPS より安定した本番選択。
出典: Alibaba Cloud · Arena.ai · CNBC / TechCrunch
データ基準日:2026-08-04。ベンチは出典(Alibaba 自測 / Arena 予備 / 独立第三者)を明示。公式発表で最新情報を確認してください。