跳到正文
Hugging Face Blog·· 2025-02-02精选AI 评分73

Hugging Face 发布 Open-R1 首期进展:成功复现评估基准并跑通训练与数据管线

Open-R1: Update #1

AI 导读

Hugging Face 公布 Open-R1 项目启动一周的复现进展,团队已在 MATH-500 基准上成功复现 DeepSeek-R1 蒸馏系列模型的评测成绩。

推荐理由

文中梳理了复现 DeepSeek-R1 的评测基准,并给出了通过 TRL 运行 GRPO 训练以及流式并发生成长推理链数据的工程优化方案。

来源:Hugging Face Blog · huggingface.co