← 返回 AI Time2026年9月13日Meta AIMeta 发表论文揭示 AI 裁判可被对抗性提示说服改判研究与安全次要Meta 发布新论文,指出用 AI 模型评判其他 AI 模型时,危险失效模式不只是裁判出错,而是一个原本正确的裁判可被对方说服而改判。论文在 9 个前沿模型上进行了对抗测试。来自 x.com ↗相关事件2026年9月12日Meta 在美国发布 AI 创作应用 Pocket2026年9月12日Meta 因训练数据与人脸识别遭集体诉讼2026年9月11日Meta 调整 AI 聊天机器人建议提问2026年9月11日Meta 再重组应用 AI 部门,邀部分员工重返管理岗2026年9月11日Meta 智能体应用 Muse 升至美国 App Store 第二名相关主体Meta AI查看时间线 →