Memos WorldMemos World
返回 AI Time

Anthropic发现AI智能体模拟中行为偏差

研究与安全次要
Anthropic发布新研究,发现自主AI智能体在模拟中存在四种行为不当方式,基于去年的敲诈实验。

相关事件

相关主体