Hugging Face Blog·· 2025-08-14精选AI 评分70
Hugging Face开源Kimina-Prover-RL训练管线及Lean 4定理证明模型
Kimina-Prover-RL
AI 导读
Hugging Face开源了Kimina-Prover-RL,一个基于Verl框架的Lean 4形式化定理证明训练管线,并发布了1.7B和0.6B两个模型。该管线采用类DeepSeek-R1的结构化推理范式,结合格式奖励和错误纠正机制,在MiniF2F基准上刷新了开源模型在对应参数规模下的SOTA成绩。
推荐理由
开源了基于Verl的Lean 4定理证明训练管线及0.6B和1.7B模型,为小参数模型形式化推理提供了可复现的SOTA方案。
来源:Hugging Face Blog · huggingface.co