跳到主内容
@wquguru
精选70Chaofan Shou行业动态

GLM5.2 在 64 卡昇腾 910B4 上实现 1M 上下文部署

Optimized and deployed GLM5.2 @ 1M context on 64x Ascend 910B4. Decode cost effe…

原文
发到 X

在64块昇腾910B4上优化并部署了GLM5.2,支持1M上下文。即使没有政府补贴,解码成本效益也与H200相当。

更进一步:量化金融体系

看懂新闻只是起点——沿量化金融路径,把它变成能交付的工程能力

进入量化体系 →

相似阅读

另一事件,读法相近