跳到主内容
@wquguru
精选80Hugging Face 博客(RSS)模型发布/更新

Open R1 项目第四期更新

原文
发到 X

Hugging Face 发布 Open R1 项目第四期更新,重点包括:1)完成对 DeepSeek-R1 蒸馏数据的复现,并开源了 1.5B、7B、8B、14B、32B 和 70B 共 6 个尺寸的模型权重;2)发布了完整的训练代码和数据处理流程,支持从原始数据到模型训练的端到端复现;3)在数学推理(MATH-500)和代码生成(HumanEval)等基准测试上,复现模型性能达到原版 DeepSeek-R1 的 95% 以上;4)改进了分布式训练框架,支持更大规模集群的并行训练。该项目旨在通过完全开源的方式复现 DeepSeek-R1 的推理能力,降低社区参与门槛。

更进一步:量化金融体系

看懂新闻只是起点——沿量化金融路径,把它变成能交付的工程能力

进入量化体系 →

相似阅读

另一事件,读法相近