跳到主内容
精选70IT之家(RSS)行业动态多源精选 ×8

摩尔线程完成智谱 GLM-5.3-Flash 适配,Day-0 支持

Day-0 支持:摩尔线程官宣完成智谱 GLM-5.3-Flash 极速适配

原文

IT之家 8 月 27 日消息,智谱近日上线并开源 GLM-5.3-Flash (320B-A18B)。摩尔线程官方今日宣布,基于 AI 训推一体智算卡 MTT S5000 及 MUSA 软件栈,Day-0 支持,实现了对该模型的极速适配与高效运行。

据介绍,作为 GLM-5 系列的首个原生多模态模型,GLM-5.3-Flash 总参数为 320B,激活参数仅 18B,在全球权威的 Artificial Analysis Intelligence Index(AA 综合智能指数)中取得 57 分,进入全球前沿模型能力区间,与 Anthropic 最受欢迎的模型 Claude Opus 4.8 得分持平。在自研 Z.ai Code Bench 体感评估中,其编程表现与 Claude Opus 4.8 相当。

此前,该模型以代号 Ox-Alpha(社区昵称“牛来”)在 OpenCode 和 OpenRouter 进行匿名公测,凭借出色的推理速度与智能表现,迅速成为当周最受欢迎的模型,创下双平台调用量新高。

GLM-5.3-Flash 发布当日,摩尔线程工程团队完成模型架构拆解、核心技术分析与典型算子梳理。针对其混合架构中线性注意力采用的 KDA 机制,团队基于 MATE 算子优化引擎,快速完成了状态矩阵更新、分块并行扫描等全新算子形态的定制实现与深度调优,并与 SGLang-MUSA 缓存管理体系深度协同、无缝打通,释放了 KDA 在长上下文推理中的效率优势。

IT之家附 GLM-5.3-Flash 开源地址:

  • https://huggingface.co/zai-org/GLM-5.3-Flash

更进一步:量化金融体系

看懂新闻只是起点——沿量化金融路径,把它变成能交付的工程能力

进入量化体系 →

关联讨论

同一事件的更多信源
GLM 5.3 Flash 18B 激活参数 MoE
Teortaxes▶️ (DeepSeek 推特🐋铁粉 2023 – ∞)原文
智谱确认匿名模型Ox Alpha为GLM-5.3-Flash
华尔街见闻(RSS)原文
智谱发布 GLM-5.3-Flash 模型
Hacker News Best(web_list)原文
Ox Alpha 实为 GLM-5.3-Flash
Przemek Chojecki | PC原文
GLM-5.3-Flash 上线 OpenRouter
OpenRouter原文

相似阅读

另一事件,读法相近