审计发现Mistral聊天机器人频繁重复俄虚假信息,约半数情况下出现

一项新基准测试称,Mistral AI在宣传内容识别方面得分偏低,可能使其融资复杂化,并加深外界对开源AI模型路径的质疑。

摘要

一项新的基准测试发现,Mistral AI的模型在识别俄罗斯宣传内容方面得分低于40%,进一步加剧了此前对该公司聊天机器人约有半数情况下会重复俄罗斯虚假信息的担忧。这一发现加深了外界对欧洲AI可信度的疑问,并表明相关问题可能不仅限于内容审核,还可能延伸至投资者对治理、产品可靠性以及开源AI模型整体可行性的担忧。报道所指的这一弱点还可能使Mistral AI的融资工作更加复杂,并引发监管机构更严格审视聊天机器人如何识别和过滤虚假或被操纵的叙事。

术语与概念
  • 开源AI模型: 其底层代码或模型权重向公众开放的人工智能模型,允许外部开发者对其进行使用、修改或在其基础上继续开发。
  • 宣传内容识别: 识别通过误导性、带有偏见或虚假叙事来操纵舆论之内容的过程。