アリババ Qwen3.8-Max 解説 2026: 2.4兆MoE・100万コンテキスト・Terminal-Bench 86.6
アリババが8月4日に公開した過去最大モデルQwen3.8-Max。総2.4兆パラメータのMoEで回答時に950億のみ活性化、100万コンテキスト・マルチモーダル。Frontend Code Arena 1,668、Terminal-Bench 86.6などでFable 5・Opus 5に接近・一部上回ると主張し、オープンウェイトで公開予定だ。
中国発のAIラッシュがまた更新された。8月4日、アリババが過去最大のモデルQwen3.8-Maxを公開した。パラメータはなんと2.4兆、ただし回答時にはそのうち950億のみを活性化するMoE方式だ。ベンチマークではAnthropicのFable 5やClaude Opus 5に接近、一部で上回ると主張している。要点をまとめた。
何がすごいのか?
- 構造: スパースMoE、総2.4兆中アクティブ950億パラメータ
- コンテキスト: 100万トークン — 一度に200ページ超の文書、約100時間分の映像を処理
- マルチモーダル: テキスト・画像・映像の入力
- アリババ過去最大にして最も強力なQwen

「大きく作り、活性は一部だけ」という昨今の大型モデルの潮流の頂点だ。同じ流れの中国オープンモデルはDeepSeek V4 Flashに続く。
ベンチマークはどこまで?
アリババが公開した表による。
| 項目 | Qwen3.8-Max | メモ |
|---|---|---|
| Frontend Code Arena | 1,668 | Opus 5最上位構成に37点差 |
| PaperBench | 93.0 | 首位 |
| IFBench | 82.8 | 首位 |
| Terminal-Bench 2.1 | 86.6 | Opus 4.8・Fable 5(84.6)より上 |

コーディングや実務的な指標で最上位と肩を並べるのが核心だ。中国モデルの台頭はOpenRouterで見るAIランキングにも表れている。
価格と公開は?
- 価格(100万トークン): 入力$2 / 出力$6 / キャッシュ入力$0.25
- 現在はQwenCloudで提供、重みはHugging Face・ModelScopeにオープンウェイトで公開予定

最上位級の性能をオープンウェイトで出すことは、業界に大きな圧力を与える。
よくある質問
Q. 2.4兆パラメータなのになぜ速い? MoE(専門家混合)構造なので、回答ごとに全体ではなく約950億パラメータのみを活性化する。だから非常に大きなモデルでありながら比較的速く安く動く。
Q. ベンチマークをそのまま信じてよい? アリババ自身が公開した数値だ。方向性は明確だが、独立したベンチマーク検証は見守る必要がある。
Q. オープンウェイトなら商用利用できる? 重みはHugging Face・ModelScopeで公開予定だ。具体的なライセンス条件は公開時に確認が必要だ。
関連記事
ビッグテックDeepSeek V4 Flash 0731 解説 2026: $0.14/$0.28・100万コンテキスト・Terminal-Bench 82.7
新設計なし、再学習だけで — 低価格・高効率コーディングモデルの次の一手
ビッグテックOpenAI「Astra」まとめ:マルチエージェント構造と10年来の未解決数学問題10件
回答ツールから研究パートナーへ — 数日間ひとつの問題に取り組むモデル
ビッグテックAmazon +13%急騰・Apple -7%下落:AWS 37%成長とメモリ不足ガイダンスの明暗
決算ウィークの結論 — AIで稼ぐ会社は急騰、AIの副作用に足を取られた会社は急落