Alibaba、2.4兆パラメータの Qwen3.8-Max をオープンウェイト公開
Qwen (Hugging Face モデルカード)公式発表
AlibabaQwenオープンウェイトMoELLM
Alibaba は自社最大級のモデル Qwen3.8-Max のウェイトを Hugging Face で公開した。総パラメータ2.4兆・活性化950億のMoE構成で、線形アテンションを組み合わせたハイブリッド設計を採用する。コンテキスト長はネイティブ26万2144トークン、拡張で約101万トークンに達する。
何が発表されたか
Alibaba の Qwen チームが、フラッグシップモデル Qwen3.8-Max のオープンウェイト版「Qwen3.8-2.4T-A95B」を Hugging Face で公開した。モデルカードに記載された主な仕様は以下のとおり。
- 総パラメータ2.4兆、うち活性化パラメータ950億の Mixture-of-Experts 構成
- 92層。gated DeltaNet による線形アテンションと gated attention を組み合わせたハイブリッド設計
- エキスパートは512(ルーティング10+共有1)、隠れ次元8192
- コンテキスト長はネイティブ262,144トークン、拡張時1,010,000トークン
- ライセンスは Qwen3.8-Max 独自ライセンス(Apache 2.0 ではない)
- 推論の深さを xhigh / medium / low で切り替えられる「thinking」モードを内蔵
- vLLM、SGLang、Transformers での動作をサポート
得意領域としてコーディングとソフトウェアエンジニアリング、長期にわたるエージェント的な推論と計画、金融・法務・医療といった専門業務が挙げられている。推奨サンプリングは temperature=1.0、top_p=0.95、top_k=20。
開発者への影響
100万トークン級のコンテキストと明示的な推論深度コントロールが同時に手に入る点が実務的だ。大規模なコードベースや長い契約書・仕様書をまとめて渡す用途で、分割・要約の前処理を減らせる。
ただし2.4兆パラメータのモデルを自前で回せる環境はごく限られる。フリーランスや小規模チームにとっての現実的な選択肢は、ホスティング事業者経由での利用か、同ファミリーの小型モデルへの置き換えになる。オープンウェイト公開の意味は「自分で動かす」よりも「提供事業者が増えて選択肢と価格競争が生まれる」ことの方が大きい。
またライセンスが Apache 2.0 ではなく独自ライセンスである点は、商用案件に組み込む前に必ず条文を確認しておきたい。オープンウェイト=自由に商用利用可、と早合点しないこと。
