Memos WorldMemos World
返回 AI Time

Meta FAIR 联同牛津、UCL 提出实验排序模型 RPM

研究与安全次要
Meta FAIR 与牛津大学、UCL 提出 AI 研究偏好模型(RPM),用冻结的 LLM 裁判为 15 个未执行的候选实验排序并只执行一个。在 AIRS-Bench 上平均归一化得分从 0.684 升至 0.729,基线需 24 小时的结果约 15 小时即可获得。

相关事件

相关主体