跳到正文
原文
Hugging Face Blog·· 2025-02-02精选AI 评分77

Hugging Face 发布 Open-R1 进展:复现 DeepSeek R1 训练与数据生成

Open-R1: Update #1

AI 导读

Hugging Face 发布 Open-R1 项目进展,报告了复现 DeepSeek R1 训练管线与合成数据的最新成果。团队在 MATH-500 基准上验证了复现结果,并分享了利用 TRL 库集成 GRPO 算法及通过 vLLM 优化长文本推理吞吐量的工程经验。

推荐理由

Hugging Face 团队公开了复现 DeepSeek R1 的训练进展与合成数据生成方案,为社区提供了可验证的参考路径。

来源:Hugging Face Blog · huggingface.co