跳到主内容
@wquguru
精选60WquGuru模型发布/更新多源精选 ×5

DeepSeek V4.1 Flash KV Cache成本大幅降低

DeepSeek V4.1 Flash KV Cache成本竟然只有前代的一小部分了,这应该是降价的一个核心因素,而非训练完成后释放了部分GPU资源。具体数据:…

原文
发到 X

DeepSeek V4.1 Flash KV Cache成本竟然只有前代的一小部分了,这应该是降价的一个核心因素,而非训练完成后释放了部分GPU资源。具体数据:对 HBM 的需求减少到 1/4,对 SSD 的需求减少到 1/8,相比 DeepSeek-V1,KV Cache Per Token 更是达到了惊人的1/400。

更进一步:量化金融体系

看懂新闻只是起点——沿量化金融路径,把它变成能交付的工程能力

进入量化体系 →