跳到主内容
@wquguru
精选90Mistral AI News(RSS)模型发布/更新

Mistral发布Mixtral 8x7B MoE模型

原文
发到 X
推荐理由

MoE架构的实用化标杆,推理效率与性能兼得,做模型选型和部署的同学建议立即测试。

Mistral AI发布了Mixtral 8x7B,这是一个基于混合专家(MoE)架构的稀疏专家模型。该模型拥有46.7B总参数量,但每个token仅激活12.9B参数,推理成本与12.9B模型相当。Mixtral 8x7B在多项基准测试中表现优异,在数学、代码生成和语言理解等任务上超越Llama 2 70B和GPT-3.5。模型采用8个专家网络,每个token由2个专家处理,支持32k上下文窗口。Mistral同时发布了针对指令微调的版本Mixtral 8x7B Instruct,在MT-Bench上达到8.30分。模型以Apache 2.0许可开源,可通过Hugging Face和Mistral的API获取。

更进一步:量化金融体系

看懂新闻只是起点——沿量化金融路径,把它变成能交付的工程能力

进入量化体系 →

相似阅读

另一事件,读法相近