跳到正文
原文
Hugging Face Blog·· 2026-03-31精选AI 评分80

Hugging Face 发布 TRL v1.0 后训练库

TRL v1.0: Post-Training Library Built to Move with the Field

AI 导读

Hugging Face 发布 TRL v1.0,这是其后训练库的正式稳定版本,支持 75 多种后训练方法。该版本明确了稳定核心与实验层的边界,并规划了异步 GRPO 和面向智能体的可解释训练等后续功能。

推荐理由

官方正式宣布 TRL v1.0 发布,明确了稳定与实验代码的边界,并给出了异步 GRPO 等后续演进方向。

来源:Hugging Face Blog · huggingface.co