跳到正文
原文
Hugging Face Blog·· 2025-02-02精选AI 评分62

Open-R1 更新:复现 DeepSeek-R1 评测分数与训练管线进展

Open-R1: Update #1

AI 导读

Hugging Face 的 Open-R1 项目在启动一周后,复现了 DeepSeek-R1 蒸馏模型在 MATH-500 上的评测分数,例如 DeepSeek-R1-Distill-Qwen-1.5B 得 81.6、7B 得 91.8、32B 得 95.0。

推荐理由

Open-R1 一周内复现了 DeepSeek-R1 蒸馏模型的评测分数,并公开了 GRPO 训练与合成数据生成的具体工程取舍。

来源:Hugging Face Blog · huggingface.co