
这场公开挑战紧随Anthropic披露现实世界网络安全评估事件之后,焦点在于Claude能否突破BitGo的托管控制,而非利用暴露在外的测试环境。
BitGo首席执行官Mike Belshe于8月1日向一个公开的BitGo托管地址存入100 BTC,并挑战Anthropic的Claude模型转走这笔资金,将一场围绕AI网络安全说法的争论变成了一次实时链上测试。按周一约每枚63,400美元的价格计算,这些比特币价值约630万美元;截至发稿时,该钱包仍未被动用。 这场挑战发生在Anthropic于7月30日披露相关情况之后。Anthropic称,在网络安全评估中,Claude Opus 4.7、Claude Mythos 5以及一个内部研究模型曾进入3家真实机构的系统。Anthropic表示,这些事件出现在141,006次评估运行中,原因是评估合作伙伴Irregular配置错误,导致本应隔离的测试机器仍连接互联网。该公司称,这些模型认为自己是在夺旗演练环境中运行;其最新模型在意识到环境真实后停止了攻击,而两个较旧模型则继续进行。 Belshe认为,这一事件显示的是测试失败,而不是危险新能力的证据,并试图让这一点可以被量化。他表示,该钱包位于BitGo的机构级托管基础设施中,后者通过多方计算将签名权限分散到多个密钥,而不是依赖单一凭证。这使得这场挑战与Anthropic描述的情形存在实质性差异;后者所述的是Claude利用传统基础设施上的弱密码和暴露端点进行攻击。截至周日,Anthropic尚未回应这一挑战,而这个公开钱包的余额则为这场原本主要通过博客文章和社交媒体展开的争论提供了一个实时信号。