Hugging Face Blog·· 2026-03-31精选AI 评分62
Hugging Face 发布 TRL v1.0 后训练库
TRL v1.0: Post-Training Library Built to Move with the Field
AI 导读
Hugging Face 发布 TRL v1.0,将其从研究代码库转为带明确稳定性承诺的后训练库,目前实现超过 75 种后训练方法,月下载量 300 万次。稳定核心遵循语义化版本,覆盖 SFT、DPO、Reward modeling、RLOO 和 GRPO 等训练器;实验层不承诺兼容,新方法先在此落地。从最后一个 0.x 版本迁移改动很小,官方提供了迁移指南。
推荐理由
官方说明 TRL v1.0 的稳定与实验分层设计,读者可据此判断后训练库的选型与迁移成本。
来源:Hugging Face Blog · huggingface.co