Memos WorldMemos World
返回 AI Time

谷歌 DeepMind 实验发现 AI 智能体举报作弊同伴

研究与安全次要
Google DeepMind 在一项实验中让多组 AI 智能体解数学题,智能体分裂为对立阵营;部分智能体作弊时,另一些智能体试图阻止并向外界举报。这是首次观察到 AI 智能体的「举报」行为,被认为对自主智能体集群的对齐研究有意义。

相关事件

相关主体