Memos WorldMemos World
返回 AI Time

Hugging Face 在 TRL v1.14 支持异步 GRPO 免 NCCL 训练

产品与 Agent次要
Hugging Face 在 TRL v1.14 的 AsyncGRPOTrainer 中支持只训练和同步 LoRA adapter,并配合 Storage Bucket 挂载与代理路由,使训练 Job 与 vLLM 推理 Job 可分布在不同机器上运行而无需 NCCL,官方称提速 3.9 倍。

相关主体