阿里巴巴于8月3日发布Qwen3.8-Max,推出了一款2.4万亿参数的多模态模型。该模型采用稀疏混合专家(Mixture-of-Experts)系统构建,每个token约有950亿个活跃参数,拥有100万个token的上下文窗口,应用程序接口 (API)定价为每100万个输入token 2美元、每100万个输出token 6美元。公司表示,该模型在英伟达GB300 NVL72硬件上每块GPU的运行速度超过每秒4,000个token,或单颗芯片每秒约3,000个单词,并在OSWorld-Verified中获得86.1分,高于Anthropic的Claude Fable 5的85.0分以及OpenAI的GPT-5.6 Sol Max,而更广泛的评估则将其总体排名列为仅次于Fable 5的第二名。阿里巴巴表示,Qwen3.8-Max和更小的Qwen3.8-27B的开放权重预计将在发布后的一周内发布,尽管更早的材料曾显示Qwen3.8-27B将于8月15日午夜在ModelScope发布。27B模型仍定位于在消费级硬件上进行本地部署;路透此前报道称,随着阿里巴巴将Qwen3.8重新转向开放权重分发,公司计划为Qwen3.8-Max的大型商业用户推出收入分成机制。