跳到主内容
@wquguru
精选80Hugging Face 博客(RSS)模型发布/更新

Open-R1 项目更新:发布数据集与训练配方

Open-R1 项目更新 #1

原文
发到 X

Hugging Face 发布 Open-R1 项目首次更新,公开了用于复现 DeepSeek-R1 的完整数据集、训练配方和代码。项目旨在通过开源方式复现 DeepSeek-R1 的推理能力,目前已完成数据生成、训练流程和评估基准的构建。更新内容包括:1)发布包含 60 万条推理轨迹的合成数据集;2)开源基于 GRPO 的强化学习训练脚本;3)提供从零训练 R1 风格模型的详细配方。项目仍处于早期阶段,后续将优化数据质量和训练效率。

更进一步:量化金融体系

看懂新闻只是起点——沿量化金融路径,把它变成能交付的工程能力

进入量化体系 →

相似阅读

另一事件,读法相近