アリババ、2.4兆パラメーターのQwen3.8-Maxを発表 ベンチマークとオープンウェイト計画も公表

アリババ、2.4兆パラメーターのQwen3.8-Maxを発表 ベンチマークとオープンウェイト計画も公表

アリババは、Qwen3.8-Maxを初のオープンウェイトのMax級Qwenとして無料で公開するとしており、ベンチマークデータと予測市場の価格動向は、Anthropicやその他の最先端モデルの競合に対する圧力が一段と高まる可能性を示している。

ファクトチェック
中核となる事実関係は、Alibaba自身のプレスリリースと複数の独立報道で確認できる。Alibaba Cloudのプレスリリースでは、パラメータ数が2.4兆であること、重みを「来週」公開する予定であることが確認されており、この主張と一致する。CNBCとSiliconANGLEは、Claude Fable 5との同水準・競合という位置づけと、Moonshot AIのKimi K3に続く中国AI競争の文脈を裏づけている。唯一の細かなニュアンスとして、Alibabaが自ら述べているのは厳密な「同等」ではなく「Fable 5に次ぐ」という表現である。ただし、CNBCは性能について「Fable 5と競合する」「匹敵する」と表現しており、見出しの「同等性を主張」は、誤解を招かない範囲の妥当な言い換えである。
要約

アリババはQwen3.8-Maxを発表した。パラメーター数は2.4兆で、オープンウェイトとして無料公開されるとしており、Max級のQwenモデルがその形で配布されるのは初めてである。アリババは同システムについて、Claude級やChatGPT級のツールに迫る能力を備えていると位置付けた。一方、同社自身のベンチマーク表では、より評価が分かれる結果が示された。AnthropicのFable 5は31件のテキスト試験のうち15件で首位となり、OpenAIのGPT-5.6 Solは9件、Qwen3.8-Maxは7件で首位だった。Qwenは中核的なコーディング評価よりもマルチモーダル業務で比較的強い成績を示した。 アリババによると、このモデルは一度に950億パラメーターを活性化し、100万トークンのコンテキストウィンドウに対応し、AnthropicのClaude CodeおよびOpenAIのCodex内で動作できる。同社は、自律実行の事例として、コーディングツールの構築に16日間を費やしたケースを強調した。また以前には、Qwen3.8-MaxとQwen3.8-27BのオープンウェイトをHugging FaceとModelScopeに掲載するとしていた。発表後、予測市場の価格はわずかに変動し、2026年9月末時点でもAnthropicが首位のAIモデルを維持している確率を、トレーダーがやや低く見積もるようになったことを示唆した。市場は現在、採用動向、ベンチマーク結果、そしてAnthropicやその他の主要開発企業の反応を注視している。

用語解説
  • オープンウェイト: 訓練済みパラメーターをユーザーがダウンロードし、ローカルで利用したり追加開発したりできるモデル公開の方式。
  • パラメーター: AIモデルがプロンプトをどのように処理し、出力を生成するかを左右する内部の数値設定。
  • 予測市場の価格動向: 将来の結果の確率について、トレーダー全体がどのように評価しているかを推定するために用いられる市場価格。