精选85Hugging Face 博客(RSS)模型发布/更新
Hugging Face 发布 Kimina-Prover-RL 强化学习模型
Hugging Face 发布了 Kimina-Prover-RL,一个基于强化学习的数学定理证明模型。该模型在 Lean 4 形式化证明任务上取得了突破性进展,在 MiniF2F 测试集上达到了 42.6% 的准确率,相比此前最佳模型提升了 10 个百分点。Kimina-Prover-RL 采用了一种新的强化学习训练方法,结合了蒙特卡洛树搜索与自博弈机制,能够自动生成并验证数学证明。该模型已开源,权重和代码可在 Hugging Face 平台获取。
更进一步:量化金融体系
看懂新闻只是起点——沿量化金融路径,把它变成能交付的工程能力