Z.ai的GLM 5.2逼近Anthropic Opus 4.8,成本约为后者五分之一

智谱AI的开放权重模型在编程、智能体及部分网络安全测试中取得接近前沿水平的结果;研究人员称,其在某些漏洞发现测试中可比肩Anthropic的Mythos,同时在价格上低于美国领先模型。

摘要

原名智谱AI的Z.ai已发布GLM 5.2。CNBC和安全研究人员表示,这一开放权重模型在编程、智能体以及部分网络安全任务上正逼近美国顶级系统,同时使用成本显著更低。这款来自北京的模型在关键基准测试中的得分接近Anthropic的Opus 4.8,在MCP-Atlas上表现优于后者;研究人员还称,在部分安全漏洞发现情境中,它可与Anthropic的Mythos相当,不过在其他任务上仍落后于Anthropic和OpenAI。 GLM 5.2于6月13日向GLM Coding Plan订阅用户上线,并于6月16日在MIT license下发布开放权重和基准评分卡。该7440亿参数的专家混合模型拥有100万token上下文窗口,运行速度为每秒300 tokens,定价为每百万tokens输入$1.40、输出$4.40,而Anthropic的Opus 4.8则分别为输入$5、输出$25。 其发布时间点之所以受到关注,是因为美国商务部于6月12日发布出口管制命令后,Anthropic在全球范围内停用了Fable 5和Mythos 5。分析人士和研究人员表示,此次发布凸显人工智能竞争正在加剧,并且在白宫重塑美国AI政策之际,可能进一步带来压力;与此同时,围绕中国来源模型的安全和数据治理担忧依然存在。

术语与概念
  • 开放权重: 向公众发布的模型参数,可供下载、微调和自行托管。
  • MoE: 专家混合,一种针对特定任务激活部分参数的模型架构。
  • MIT license: 一种宽松的软件许可证,允许广泛复用和修改。