精选75Hugging Face 博客(RSS)产品发布/更新
Hugging Face 发布 TRL v1.0 后训练库
Hugging Face 发布 TRL v1.0:后训练库
Hugging Face 正式发布 TRL(Transformer Reinforcement Learning)库的 v1.0 版本。TRL 是一个用于语言模型后训练的开源库,支持强化学习(如 PPO)、直接偏好优化(DPO)等技术。v1.0 版本带来了更稳定的 API、更好的文档和示例,以及性能优化。该库旨在简化从预训练模型到对齐模型的流程,适用于 RLHF 等场景。
更进一步:量化金融体系
看懂新闻只是起点——沿量化金融路径,把它变成能交付的工程能力