跳到主内容
@wquguru
精选75IT之家(RSS)产品发布/更新多源精选 ×2

智谱上线 GLM-5.3-FlashX 模型,推理速度最高达 200

智谱 GLM-5.3-FlashX 模型上线,更快、更流畅

原文
发到 X

IT之家 9 月 18 日消息,智谱今日宣布推出 GLM-5.3-FlashX(最高 200 tokens/s),为企业与开发者带来更快、更流畅的模型体验。

智谱官方表示,GLM-5.3-Flash 此前以“Ox Alpha”之名与全球开发者见面,获得海内外开发者的广泛认可,调用量持续攀升。面对快速增长的需求,智谱在 10 万张国产芯片提供的推理算力基础上,进一步加大对 Infra 侧的投入与推理优化。GLM-5.3-Flash 长期保持同尺寸最强智能水平,本次提速进一步形成智能、价格、速度的全面竞争力。

GLM-5.3-FlashX API 现已上线,Model Key:GLM-5.3-FlashX。

IT之家附 API 调用方法:

https://docs.bigmodel.cn/api-reference/模型-api/对话补全

更进一步:量化金融体系

看懂新闻只是起点——沿量化金融路径,把它变成能交付的工程能力

进入量化体系 →