← 返回 AI Time2026年9月10日Hugging FaceTRLHugging Face 在 TRL v1.14 支持异步 GRPO 免 NCCL 训练产品与 Agent次要Hugging Face 在 TRL v1.14 的 AsyncGRPOTrainer 中支持只训练和同步 LoRA adapter,并配合 Storage Bucket 挂载与代理路由,使训练 Job 与 vLLM 推理 Job 可分布在不同机器上运行而无需 NCCL,官方称提速 3.9 倍。来自 huggingface.co ↗相关主体Hugging Face查看时间线 →