跳到主内容
@wquguru
精选70Chubby♨️模型发布/更新

GLM-5.3 登陆 Hugging Face,公布本地运行硬件配置

GLM-5.3 is officially live on Hugging Face.

原文
发到 X

GLM-5.3 is officially live on Hugging Face.

GLM-5.3 已在 Hugging Face 上正式发布。

What should run it locally:

本地运行它需要什么配置:

  • FP8: 10–12× H100 or 8× H200 - 4-bit/NVFP4, roughly 390–430GB: one 512GB Mac Studio or 4× DGX Spark - Aggressive 2-bit, roughly 230–250GB: one 256GB Mac Studio or 2× DGX Spark, with quality and context tradeoffs
  • FP8:10–12× H100 或 8× H200 - 4位/NVFP4,约 390–430GB:一台 512GB Mac Studio 或 4× DGX Spark - 激进2位,约 230–250GB:一台 256GB Mac Studio 或 2× DGX Spark,需权衡质量与上下文长度

The first GGUF and NVFP4 quants are already appearing.

首批 GGUF 和 NVFP4 量化版本已开始出现。

Have fun with SOTA local AI

享受最先进的本地 AI 带来的乐趣吧

更进一步:量化金融体系

看懂新闻只是起点——沿量化金融路径,把它变成能交付的工程能力

进入量化体系 →

相似阅读

另一事件,读法相近