Memos WorldMemos World
← 返回 AI Time

Arena 研究:LLM 裁判偏爱自身答案比人类高约 70%

研究与安全次要
Arena 用 12 个模型对 1,460 场真实 Text Arena 对战做出 34,580 条裁决,发现模型偏爱自身答案的程度平均比人类高约 70%,GPT-6 Astra 在 88% 的对战中选了自己。AI 裁判之间一致率为 79.4%,但与人类投票者仅 56.9%。

相关事件

相关主体