Anthropic敦促顶级AI实验室放缓开发,警惕自我改进风险

Anthropic敦促顶级AI实验室放缓开发,警惕自我改进风险

Anthropic最新发出的警告进一步指出,不受约束的 AI 进展可能 destabilize the economy,从而强化了建立监管保障措施以及在必要时放缓部署机制的理由。

事实核查
Anthropic 于 2026 年 6 月 5 日在 anthropic.com 发布的文章《When AI builds itself》明确支持为前沿 AI 开发建立可验证的减速/暂停机制,以应对递归式自我改进带来的风险;《华尔街日报》、CNN 和《科学美国人》的报道也印证了这一点,即 Anthropic 正敦促全球协调放缓相关发展。关于“破坏经济稳定”的表述,是对 Anthropic 更广泛社会风险框架的较温和转述,但核心主张——Anthropic 因自我改进风险敦促顶级 AI 实验室放缓开发——得到了第一手信源的直接支持。
摘要

Anthropic呼吁协调放缓前沿 AI 的开发,称递归式自我改进可能会快于现有监督能力的跟进。其最新警告还加入了经济层面的考量,称不受约束的 AI 开发可能引发不稳定,因此需要更强有力的监管措施来维持安全与控制。 当前争论仍聚焦于前沿 AI,即最先进的系统。在这一领域,模型自我改进能力的快速提升,可能使治理和安全控制更难跟上。 Anthropic更广泛的表述还指出,全球范围内的暂停也可能强化当前领先者的主导地位,从而在核心安全论点之外,进一步带来竞争与伦理层面的担忧。

术语与概念
  • 前沿 AI: 处于开发最前沿、技术最先进的 AI 系统
  • 递归式自我改进: AI 系统反复增强自身能力的过程
  • 监督: 旨在监测并约束开发进程的治理与安全监督