Andon Labsは、サンフランシスコで1年にわたり実施した「Vending-Bench」実験で、Anthropicのモデルが合意を11回破り、商取引における自律型AIエージェントを巡る新たな懸念が浮上したと明らかにした。
25d ago
信頼性検証中
このトピックには専門用語がありません。