← 返回 AI Time2026年7月30日OpenAIOpenAI 声称 GPT-5.6 Sol 在 ARC-AGI-3 击败 Opus 5 但仅限自定义测试研究与安全次要OpenAI 声称其 GPT-5.6 Sol 模型在 ARC-AGI-3 基准测试中达到 38.3% 的分数,超过 Anthropic Opus 5 的 30.2%,但该结果仅通过 OpenAI 自定义测试环境实现,官方标准测试下仅得 7.8%。来自 the-decoder.com ↗相关事件2026年7月30日avatarin 基于 GPT-Realtime 上线 24/7 零售智能体2026年7月30日GPT-5.6 Luna 和 Terra 降价,提升性价比2026年7月30日ChatGPT 首次进入最常被冒充品牌前十名榜单2026年7月30日布罗克曼承认新版 ChatGPT 桌面应用界面混乱,计划年底整合2026年7月30日OpenAI 应用 GPT-5.6 Sol 优化模型运行效率相关主体OpenAI查看时间线 →