跳到主内容
精选80小互模型发布/更新多源精选 ×4

PrismML 将 27B 模型压缩至 3.9GB,手机端运行保留 90% 性能

PrismML 将 27B 模型塞进你的 iPhone 里

原文

PrismML 将 27B 模型塞进你的 iPhone 里 而且智商几乎没怎么缩水

PrismML公司基于Qwen3.6-27B模型,将约 54GB 的 27B 模型压到约 3.9–5.9GB

使其能在手机上运行

在「高强度思考模式」下用 15 项测试对比原版:

Ternary 版本(5.9GB 电脑版):保留了原版 95% 的战斗力!

1-bit 版本(3.9GB 手机版):也保留了 90% 的战斗力!

在电脑(RTX 5090)上最快能达到每秒 163 个字;在苹果 M5 Max 芯片上也能达到每秒 87 个字。

更进一步:量化金融体系

看懂新闻只是起点——沿量化金融路径,把它变成能交付的工程能力

进入量化体系 →

关联讨论

同一事件的更多信源

相似阅读

另一事件,读法相近