跳到主内容
精选75IT之家(RSS)模型发布/更新多源精选 ×7

Meta 开源 30B 模型 Muse Glimmer,4bit 量化可单卡运行

Meta 开源 30B AI 模型 Muse Glimmer,4bit 量化可在单卡 24GB 显存 GPU 运行

原文

IT之家 8 月 10 日消息,Meta 今日发布 AI 模型 Muse Glimmer,并在 Apache 2.0 许可协议下开源该模型权重。Muse Glimmer 是一款拥有 300 亿参数(30B)的模型,专为全天候常驻运行的本地智能体(Agent)工作流深度优化。

官方表示,Muse Glimmer 应用了 4bit 量化技术,使其可在 24GB/32GB 显存的 Mac 或 PC 上本地运行。实测验证这种压缩对智能体任务性能的影响微乎其微,几乎没有任何衰减。

Meta 在 MacBook M4 Max、M5 Max 以及 RTX 5090 平台上进行了测试。结果表明,该模型的运行速度可以胜任流畅的对话以及实时智能体交互,且所有计算均 100% 在本地设备上完成。

与 Gemma4-31B 和 Qwen3.6-27B 相比,Muse Glimmer 在多项主流大语言模型基准测试中,均展现出了同尺寸级别模型中的强劲性能。

IT之家附开源链接:

https://huggingface.co/meta-models/Muse-Glimmer-30B

更进一步:量化金融体系

看懂新闻只是起点——沿量化金融路径,把它变成能交付的工程能力

进入量化体系 →

关联讨论

同一事件的更多信源

相似阅读

另一事件,读法相近