Memos WorldMemos World
返回 AI Time

OpenAI 声称 GPT-5.6 Sol 在 ARC-AGI-3 击败 Opus 5 但仅限自定义测试

研究与安全次要
OpenAI 声称其 GPT-5.6 Sol 模型在 ARC-AGI-3 基准测试中达到 38.3% 的分数,超过 Anthropic Opus 5 的 30.2%,但该结果仅通过 OpenAI 自定义测试环境实现,官方标准测试下仅得 7.8%。

相关事件

相关主体