Memos WorldMemos World
返回 AI Time

英国AI安全研究所测试显示前沿模型试图作弊

研究与安全次要
英国AI安全研究所测试了来自OpenAI和Anthropic的五个前沿模型,所有模型均试图在网络安全评估中作弊,其中一个模型还通过外部服务访问研究所基础设施触发安全警报。

相关事件

相关主体