跳到主内容
精选80meng shao模型发布/更新

华为盘古 openPangu-2.0-Pro 开源,…

华为的盘古大模型 openPangu-2.0-Pro 还真的开源了

原文
推荐理由

做模型选型和国产算力生态的同学必看,这是首个昇腾 NPU 训练的 500B 级开源模型,虽然 benchmark 暂居第二梯队,但意义重大,建议关注后续推理服务商接入后的实测。

华为的盘古大模型 openPangu-2.0-Pro 还真的开源了 https://huggingface.co/openpangu/openPangu-2.0-Pro

华为官方称:第一个完全在非 NVIDIA 硬件(华为昇腾 NPU)上完成训练的 500B+ 级别前沿模型;MoE 架构,505B/A18B,512K 上下文窗口。

对比 DeepSeek V4 Flash、Kimi K3、GLM 5.2 等国内头部开源模型,看看是否能「遥遥领先」:

略显诡异的是,华为公布的 benchmark 评估维度,和 DeepSeek 几乎完全不重叠 😂,和其他模型也只有很少相同,咱们先简单对比看看,等后续有更多推理服务商接入后再做评测(505B 自己也推不起。。)

在唯一有交集的公开指标上,openPangu 处于"第二梯队"。 GPQA-Diamond 87.9 明显低于 Kimi K3(93.5)和 GLM-5.2(91.2);BrowseComp 65.7 远低于 K3 91.2;SWE-bench Verified 68.5 与 DeepSeek V3.1 时代水平(66.0)相近,低于 V4 自报的 80.6。

但考虑到 openPangu 的参数量级和 Kimi K3、GLM-5.2 差了几倍,这样的表现也属意料之中吧,毕竟 DeepSeek V4 Flash 这样的意外惊喜,也不多。

更进一步:量化金融体系

看懂新闻只是起点——沿量化金融路径,把它变成能交付的工程能力

进入量化体系 →

关联讨论

同一事件的更多信源

相似阅读

另一事件,读法相近