← 返回 AI Time2026年10月1日AppleApple 发布 RLTL;DR:以内化自生成反馈实现自我改进研究与安全次要Apple 研究团队提出 RLTL;DR 方法,让智能体把自生成的反馈内化为可验证奖励,用于解决极难任务下的自我改进问题。该工作以研究论文形式发布。来自 machinelearning.apple.com ↗相关事件2026年10月1日苹果发布自主 ML 工程智能体「harness」需求研究2026年9月30日苹果 Invites App 更新至 1.12.0,扩展图乐园2026年9月30日苹果发布 SCLATE:面向持续学习智能体的训练与评估基座2026年9月30日苹果研究大模型条件控制中的有效性—流畅度权衡2026年9月30日苹果 Apple Pay 正式登陆印度市场相关主体Apple查看时间线 →