← 返回 AI Time2026年8月18日AppleGRPO超越英语:非英语与多语言环境下的大规模GRPO研究模型发布Apple开展大规模非英语与多语言GRPO研究,验证可验证奖励强化学习在提升语言模型推理能力方面超出英语场景的效果。来自 machinelearning.apple.com ↗相关事件2026年8月18日MVICAD2:含延迟与膨胀的多视图独立成分分析2026年8月18日超越英语的 GRPO:非英语与多语言环境下 GRPO 的大规模研究2026年8月18日MVICAD2:带延迟和膨胀的多视图独立成分分析2026年8月18日GRPO超越英语:非英语和多语言环境下的大规模研究2026年8月18日苹果宣布调整欧盟区应用业务条款相关主体Apple查看时间线 →