阿里巴巴发布2.4万亿参数Qwen3.8-Max,公布基准测试和开放权重计划

阿里巴巴发布2.4万亿参数Qwen3.8-Max,公布基准测试和开放权重计划

阿里巴巴称,Qwen3.8-Max将作为首个开放权重的Max级Qwen免费发布,而基准测试数据和预测市场定价表明,Anthropic及其他前沿模型竞争对手面临的压力进一步加大。

事实核查
核心事实性表述已得到阿里巴巴自身新闻稿及多家独立媒体的确认。阿里云新闻稿确认其参数规模为2.4万亿,并表示模型权重将于“下周”发布,与相关说法一致。CNBC和SiliconANGLE确认了其与Claude Fable 5对标/竞争的表述框架,以及在Moonshot AI发布Kimi K3之后中国AI竞赛的背景。唯一细微之处在于,阿里巴巴自述的说法是“仅次于Fable 5”,而非严格意义上的“性能持平”;不过,CNBC将其表述为“可与Fable 5竞争”并称其“与Fable 5相抗衡”,因此标题中的“宣称性能持平”是合理且不会造成误导的释义。
摘要

阿里巴巴推出了Qwen3.8-Max,这是一款拥有2.4万亿参数的模型。该公司表示,将以开放权重形式免费发布该模型,这标志着Max级Qwen模型首次以这种方式分发。阿里巴巴将该系统描述为接近Claude和ChatGPT级别工具的能力,不过其自身的基准测试表显示情况更为复杂:在31项文本测试中,Anthropic的Fable 5在15项中领先,OpenAI的GPT-5.6 Sol在9项中领先,Qwen3.8-Max在7项中领先;与核心编程评测相比,Qwen在多模态任务上的表现更强。 阿里巴巴表示,该模型每次激活950亿个参数,支持100万个token的上下文窗口,并可在Anthropic的Claude Code和OpenAI的Codex中运行。该公司强调了其自主运行能力,其中包括连续16天用于构建一款编程工具;此前该公司还表示,Qwen3.8-Max和Qwen3.8-27B的开放权重将发布在Hugging Face和ModelScope上。公告发布后,预测市场定价略有变化,表明交易员认为Anthropic到2026年9月底仍将持有顶级AI模型的概率有所下降。市场目前正关注采用情况、基准测试结果,以及Anthropic或其他主要开发者的任何回应。

术语与概念
  • 开放权重: 一种模型发布方式,允许用户下载训练后的参数,用于本地使用或进一步开发。
  • 参数: AI模型内部的数值设定,决定其如何处理提示并生成输出。
  • 预测市场定价: 用于推断交易员整体如何评估某一未来结果发生概率的市场价格。