Hugging Face:Blog(RSS)· Amine Dirhoussi·· 28 天前精选AI 评分61
Hugging Face 用 LoRA 与 Storage Bucket 在 HF Jobs 上跑异步 GRPO,免 NCCL 并提速 3.9 倍
Async GRPO with LoRA across HF Jobs: a bucket, a proxy, and no NCCL
AI 导读
Hugging Face 在 TRL v1.14 的 AsyncGRPOTrainer 中支持只训练和同步 LoRA adapter,配合 Storage Bucket 挂载与代理路由,让训练 Job 和 vLLM 推理 Job 在不同机器上运行而无需 NCCL。
推荐理由
Hugging Face 官方用五个实验展示了如何在 Jobs 上分离训练与推理跑异步 GRPO,并通过逐项定位瓶颈把运行提速 3.9 倍,方法可迁移。
整理与数据来源:AIHOT
来源:Hugging Face:Blog(RSS) · huggingface.co