跳到主内容
精选70上海证券报股市多源精选 ×5

智谱高开8.25%,GLM-5.3-Flash开源,国产芯片支撑

智谱高开!“牛来”大模型身份曝光

原文

8月27日,“全球大模型第一股”智谱高开8.25%,报1115港元/股。截至发稿,涨超6%。

消息面上,8月26日,智谱上线并开源GLM-5.3-Flash(320B-A18B),这是GLM-5系列的首个原生多模态模型。该模型在Artificial Analysis Intelligence Index(AA综合智能指数)中取得57分,进入全球前沿模型能力区间,与Anthropic最受欢迎的模型Claude Opus 4.8得分持平。

正式发布前,该模型以匿名模型Ox-Alpha(中文社区称作“牛来”)在OpenCode和OpenRouter上进行了大规模测试。Ox-Alpha迅速成为当周最受欢迎的模型,创下双平台调用量新高。

高性价比是GLM-5.3-Flash另一优势,其定价为1/10的GLM-5.3,限时折扣内为1/20的GLM-5.3,为Opus 4.8的1/40。

GLM-5.3-Flash在各项基准测试和实际使用中,全面超越参数量高出一倍的GLM-5.2,为何定价却仅为后者的1/10?

智谱方面表示,这得益于其全新模型架构。GLM-5.3-Flash的架构专为极低成本而设计,总参数量与GLM-4.5相当(355Bvs.320B),但激活参数量(32B→18B)与层数(92→45)几乎减半。结合智谱最新的30T Token多模态预训练语料,GLM-5.3-Flash能够以更少的计算资源实现更强的性能。

同时,GLM-5.3-Flash进行了多项架构升级,是首个采用稀疏注意力与线性注意力混合架构的开源前沿模型,在保持精准长上下文能力的同时,大幅降低长上下文服务成本;并采用流形约束超连接(Manifold-Constrained Hyper-Connections,mHC)提升模型Scaling能力。

GLM-5.3-Flash也是智谱首次在大规模流量中尝试用大国产芯片集群提供服务,在此前匿名测试中,其全部线上流量由10万张国产芯片承载。其此前以匿名身份在OpenRouter、OpenCode两大海外平台测试,迅速登顶并刷新双平台历史纪录,Token调用量高达62T,并且这些请求流量全部由国产芯片提供算力支持。

智谱认为,与同一硬件上的初始基线相比,端到端服务性能提升了3倍,硬件效率和单token成本已达到与主流GPU相当的水平。这证明国产芯片完全可以在大规模场景下高效、经济地支撑前沿模型的推理需求。

作者:孙小程

作者: 上海证券报

查看原文 →

更进一步:量化金融体系

看懂新闻只是起点——沿量化金融路径,把它变成能交付的工程能力

进入量化体系 →

关联讨论

同一事件的更多信源

相似阅读

另一事件,读法相近