← 返回 AI Time2026年9月4日星尘智能星尘发布SmoothRL,让在线强化学习跟上大模型的异步推理模型发布次要星尘智能基座模型团队发布可异步执行的在线强化学习框架SmoothRL,用于大模型异步推理场景。来自 qbitai.com ↗相关事件2026年9月2日前字节强化学习专家孙鹏博士加盟星尘智能,完善Physical AI全栈技术布局相关主体星尘智能查看时间线 →