Qwen3.8-Max正式リリース:2.4兆パラメータでArena世界5位、来週オープンソース予定

:Alibaba;いつ:2026年8月3日;何を:千問 Qwen3.8-Max を GA し Agent 製品「千問办公(Qwen Office)」を同時投入。本記事は AI 開発者向けにタイムライン、コアベンチ、Kimi K3/DeepSeek V4 比較、Open-Source 論争を整理し、5 段階 API Runbook と FAQ 5 件を付します。

大規模 MoE 言語モデル Qwen3.8-Max と Arena ランキングを象徴する抽象ニューラルネットワークのビジュアル

目次

痛点の整理:Qwen3.8-Max公開後、開発者が直視すべき3点

  1. Open-Sourceラベルが重みより先:qwen.ai は GA 当日に「Open-Source」表記。Hugging Face / ModelScope にリポジトリ・ライセンス・確定日なし。「来週」(8月10日前後予想)のみ——既オープンソース扱いはコンプライアンス監査リスク。
  2. ベンチマークはすべて Alibaba 自社ハーネス:PaperBench、QwenSWEBench、RecreationBench は社内;Arena 1,496点は Preliminary。Artificial Analysis は GA 版未再現。本番移行前に自前 A/B 必須。
  3. プレビュー期の透明性不足が GA まで:7/19 プレビューは本番自動化禁止・活性パラメータ非公開。GA で 950億開示;独立盲検(269ファイル設計)Kimi K3 83点 vs Qwen プレビュー 80点——同格互角。

タイムライン:プレビューから GA まで2週間

コアスペック一覧

項目Qwen3.8-Max
GA日2026年8月3日
総 / 活性2.4兆 / 950億
アーキテクチャQwen3.5 ベース疎 MoE + ハイブリッド注意
コンテキスト100万 token(思考約98.3万、出力上限13.1万)
モダリティテキスト / 画像 / 動画
API 価格入力 $2/百万、出力 $6/百万 token
国内価格入力12元/百万、出力36元/百万
Arena Text(8/1)第5位、1496点(Preliminary)— 上位8中唯一非 Anthropic
Arena Vision第2位(Claude Fable 5 の次)
PaperBench(Alibaba)93.0(+28.2)
SWE-bench Pro(Alibaba)67.7(Fable 5 の 80.0 より低い)
重み公開「来週」約束、未公開
「Alibaba 自測」は公式資料由来。GA 版の独立再現は未確認。

横断比較表

モデルラボ総/活性コンテキスト価格(入/出100万)重み独立ベンチ
Qwen3.8-MaxAlibaba2.4T / 950億100万$2 / $6未公開(約束中)なし
Kimi K3Moonshot AI2.8T / 約500億約104.8万$3 / $157/27 公開AA ≈57.11
DeepSeek V4-ProDeepSeek1.6T / 490億100万未完全公開公開済SWE-bench Verified 80.6%
DeepSeek V4-FlashDeepSeekV4-Pro 同規模100万未完全公開公開済9項で V4-Pro 超え
Claude Opus 5Anthropic非公開100万$5 / $25クローズドArena 上位
Claude Fable 5Anthropic非公開100万$10 / $50クローズドArena Text 第1

アーキテクチャとエコシステム

疎 MoE:総 2.4兆・/token 活性 950億——推論コストは活性数に追従し $2/$6(Opus 5 $5/$25、Fable 5 $10/$50 より低い)。

reasoning_effort 三段(low/medium/xhigh、既定 xhigh)を enable_thinking または Anthropic 互換 reasoning.effort で調整。長期自律 Agent:16日無人コーディング、500+ステップチップ設計、RecreationBench 黒箱復元——Alibaba 自社ベンチ;一部 GitHub qwen-code-dev-bot/oh-my-cli

Qwen Office と同時投入。OpenAI / Anthropic 両互換——Claude Code、Codex、Qoder CLI、Qwen CodeOpenClaw に base URL 差し替えで接続。

Open-Source ラベル論争

  1. GA 当日から Open-Source、HF / ModelScope にリポジトリなし。
  2. ベンチはすべて vendor-run;Arena 1496点は Preliminary。
  3. 脚注「Fable 5 may involve fallbacks」——自社方法論は未公開。
  4. プレビュー期:本番自動化禁止・活性パラメータ・model card・安全評価なし。

引用可能な技術データ(EEAT)

5段階 API Runbook

Step 1 Alibaba Cloud Model Studio / QwenCloud で登録、API Key 作成 Step 2 OpenAI 互換または Anthropic 互換(Claude Code / Qwen Code / OpenClaw)を選択 Step 3 base_url、model=qwen3.8-max、reasoning_effort(low/medium/xhigh)を設定 Step 4 長コード / Agent タスク 10–20 件パイロット;品質・token・キャッシュ記録 Step 5 ハイブリッド:長期自律→Qwen3.8-Max、重要修正→Fable 5;27B ローカル評価

FAQ

Qwen3.8-Max は今使える?オープンソース?

API は QwenCloud 経由で可(OpenAI / Anthropic 互換)。重み未公開。8/10 前後 HF / ModelScope 予定、確定日なし。

Kimi K3 との比較?

統一ベンチなし。盲検 Kimi K3 83 vs Qwen 80。K3 は重み公開済・AA あり;Qwen3.8-Max は API 安価・マルチモーダル。

2.4兆は自前運用不可?

フルモデルは DC 級。API が現実解。Qwen3.8-27B がローカル向け。

Alibaba ベンチは信頼できる?

ベンダー主張として扱い、第三者再現または自社 A/B を推奨。

一般ユーザーへの影響?

中国版 Apple Intelligence が圧縮 Qwen を iPhone 15+ でオンデバイス実行。

まとめ

Qwen3.8-Max は Alibaba 初の Max 級 open-weight 約束——2.4T/950億と $2/$6 は Agent エコシステム狙い。Open-Source は現時点では意図に過ぎず、スコアも独立再現待ち。Qwen Code / OpenClaw個人ノート PC や Linux VPSだけで回すと、スリープ中断、API キーと本番 Repo 混在、Apple ツールチェーン(Xcode / Fastlane / notarytool)同機不可。7×24 無人 Agentで Qwen3.8-Max API と iOS CI / OpenClaw ゲートウェイを両立するなら VPSMAC M4 Mac クラウド(macOS ネイティブ、SSH + launchd)が個人端末や Linux VPS より安定した本番選択。

出典: Alibaba Cloud · Arena.ai · CNBC / TechCrunch

データ基準日:2026-08-04。ベンチは出典(Alibaba 自測 / Arena 予備 / 独立第三者)を明示。公式発表で最新情報を確認してください。