Memos WorldMemos World
返回 AI Time

星尘发布SmoothRL,让在线强化学习跟上大模型的异步推理

模型发布次要
星尘智能基座模型团队发布可异步执行的在线强化学习框架SmoothRL,用于大模型异步推理场景。

相关事件

相关主体