跳到正文
原文
Hugging Face:Blog(RSS)·· 2026-09-03AI 评分55

Hugging Face 教程:用 GRPO 微调 LFM2.5-350M,100 步提升结构化输出通过率至 29.7%

Fine-tuning a 350M Model for Better Structured Outputs in 100 GRPO Steps

AI 导读

Hugging Face 发布完整教程,使用 TRL 库以 GRPO 微调 LiquidAI/LFM2.5-350M,约 500 样本、100 训练步即可在免费级 Colab 或 Kaggle GPU 上完成,训练后模型在 IFStruct 基准上从 22.6% 提升至 29.7%。

整理与数据来源:AIHOT

来源:Hugging Face:Blog(RSS) · huggingface.co