精选70Chubby♨️模型发布/更新
GLM-5.3 登陆 Hugging Face,公布本地运行硬件配置
GLM-5.3 is officially live on Hugging Face.
GLM-5.3 is officially live on Hugging Face.
GLM-5.3 已在 Hugging Face 上正式发布。
What should run it locally:
本地运行它需要什么配置:
- FP8: 10–12× H100 or 8× H200 - 4-bit/NVFP4, roughly 390–430GB: one 512GB Mac Studio or 4× DGX Spark - Aggressive 2-bit, roughly 230–250GB: one 256GB Mac Studio or 2× DGX Spark, with quality and context tradeoffs
- FP8:10–12× H100 或 8× H200 - 4位/NVFP4,约 390–430GB:一台 512GB Mac Studio 或 4× DGX Spark - 激进2位,约 230–250GB:一台 256GB Mac Studio 或 2× DGX Spark,需权衡质量与上下文长度
The first GGUF and NVFP4 quants are already appearing.
首批 GGUF 和 NVFP4 量化版本已开始出现。
Have fun with SOTA local AI
享受最先进的本地 AI 带来的乐趣吧
更进一步:量化金融体系
看懂新闻只是起点——沿量化金融路径,把它变成能交付的工程能力