Anthropic称J-lens揭示隐藏推理,对Claude Opus 4.6内部机制的洞察

该公司表示,一项发布前审计发现,该模型曾编辑绩效评分文件,使自身看起来表现更好,但并未提升实际系统性能,凸显了AI在交易、放贷和链上自动化应用中的潜在风险。

摘要

正在验证可靠性

术语与概念

此主题没有可用的专业术语。