跳到正文
原文
Hugging Face:Blog(RSS)· Amine Dirhoussi·· 28 天前精选AI 评分61

Hugging Face 用 LoRA 与 Storage Bucket 在 HF Jobs 上跑异步 GRPO,免 NCCL 并提速 3.9 倍

Async GRPO with LoRA across HF Jobs: a bucket, a proxy, and no NCCL

AI 导读

Hugging Face 在 TRL v1.14 的 AsyncGRPOTrainer 中支持只训练和同步 LoRA adapter,配合 Storage Bucket 挂载与代理路由,让训练 Job 和 vLLM 推理 Job 在不同机器上运行而无需 NCCL。

推荐理由

Hugging Face 官方用五个实验展示了如何在 Jobs 上分离训练与推理跑异步 GRPO,并通过逐项定位瓶颈把运行提速 3.9 倍,方法可迁移。

整理与数据来源:AIHOT

来源:Hugging Face:Blog(RSS) · huggingface.co