跳到主内容
精选88云头条模型发布/更新多源精选 ×8

阿里开源 Qwen3.8-Flash:6B 激活超越 Opus4.6

阿里突发 Qwen 3.8-Flash:性能超 Opus 4.6,百万 Token 输入仅 1 元

原文
推荐理由

做模型选型和 Agent 应用的同学必看,6B 激活就能打平 Opus4.6,成本还砍到 1 元/百万 Token,赶紧去 Hugging Face 拉权重实测你的长上下文和 Agent 链路。

2026 年 8 月 26 日,阿里发布并同步开源千问最新模型 Qwen3.8-Flash。

Qwen3.8-Flash 采用全新下一代架构,千亿总参数仅激活 60 亿(6B)即可获得超越 Claude Opus4.6 的前沿性能,创下模型效率的全球新基准。

Qwen3.8-Flash 得益于架构和训练的全面革新,训练成本较 Qwen3.7-Plus 骤降近 90%,推理成本同样大幅下降,每百万 Tokens 输入仅 1 元,输出 3 元,价格最低至 DeepSeek-V4-Flash 的 1/3,将全球模型性价比“斩杀”至极致新水平。

Qwen3.8-Flash 今晚将首发上线“千问办公”,开发者和企业也可通过千问 AI 平台获取新模型 API 服务。

Qwen3.8-Flash 是一个多模态混合专家(MoE)模型,采用了下一代(Next)模型架构,Transformer 参数 125B 仅激活 6B,性能表现超越 Opus4.6、接近 Opus4.8。

仅完成预训练的 Qwen3.8-Flash 基座(Base)模型,在通用(SuperGPQA)、数学推理(GSM8K)、编程(SWEBench-Pretrain)等基础能力上超过了 3 倍其大小的 Qwen3.7-Plus 基座模型。

经后训练后,Qwen3.8-Flash 性能实现跃迁:

在考验智能体编程的 SWE-bench Pro 评测中领先 Opus4.6 多达 9.1 分;

在长程专业任务 CoWorkBench、真实工具调用 Toolathlon Verified 等智能体任务中均超越了 DeepSeek-V4-Flash,在专业工作任务 JobBench 智能体评测中超出 Opus4.6 近 20 分。

多模态能力方面,在模拟手机操作的移动端智能体 AndroidWorld 评测中,Qwen3.8-Flash 比 Opus4.6 高出 22.5 分,在以视觉推理解决数学问题的 MathVision 任务中超出 25.1 分,具身智能 ERQA 任务领先 31.5 分,Qwen3.8-Flash 的整体多模态能力显著更强。

Qwen3.8-Flash 出色的模型能力得益于其革新的模型架构和训练方案。

模型采用了与此前所有千问大模型完全不同的全新架构:

在注意力方面,引入独特的 QSA(Qwen Sparse Attention)机制,形成与 GDN 高效融合的混合注意力架构,可显著降低计算开销,在高缓存命中的 1M Tokens 长上下文实际场景中可提速 8 倍以上,又准又快。

在模型内部信息传递方面,引入自研的 Gated Residual 方法,将传统 Transformer 的 1 条信息主通道拆分并拓展为 4 条,让模型可根据需求动态决定读写信息,信息传递更高效,训练也更稳定。

在模型参数扩展方面,引入 51B 的 N-gram Embedding 参数,为模型 Transformer 参数提供更高效的查表寻址,在每次 token 计算时无需参与,以极少的资源消耗“外挂”了一个大规模的“记忆指南手册”,模型参数扩展效率更高;

在模型优化方面,模型结构和训练优化协同进行,收敛效率和训练吞吐大幅提升。

Qwen3.8 系列技术创新,直接带来了训练和推理的成本大幅下降。

Qwen3.8-Flash 性能与上一代 Qwen3.7-Plus 接近,但仅用九分之一的资源便完成了训练,训练成本大降 90%。

推理时,Qwen3.8-Flash 每百万 Tokens 输入低至 1 元,输出 3 元,是 Claude Opus4.6 的 3%,是 DeepSeek-V4-Flash 闲时价格的 2/3、忙时价格的 1/3。

Qwen3.8-Flash 擅长处理智能体编程、专业办公、长程任务等,同时 Qwen 团队和“千问办公”团队对模型和 Harness 框架协同联合优化,Agentic 能力进一步提升。

现在,千问办公“标准模式”内置了 Qwen3.8-Flash,可完成 95% 的日常办公任务。

据了解,Next 新架构将是全新一代千问大模型 Qwen4 的雏形,Qwen3.8-Flash-Next 模型权重已在 Hugging Face、魔搭社区全面开源,交由全球 AI 开源社区检验,以更好打造 Qwen4 模型。

模型结构:

截至目前,Qwen3.8 已开源发布 2.4T 参数量的 Qwen3.8-Max、Qwen3.8-27B 及 Qwen3.8-Flash 三大尺寸模型,Qwen 模型全球下载量突破 30 亿次,衍生模型数超 30 万个,全尺寸、全模态的全面开源正在全球掀起新一轮中国模型浪潮。

云头条声明:如以上内容有误或侵犯到你公司、机构、单位或个人权益,请联系我们说明理由,我们会配合,无条件删除处理。

作者: 云头条

查看原文 →

更进一步:量化金融体系

看懂新闻只是起点——沿量化金融路径,把它变成能交付的工程能力

进入量化体系 →

关联讨论

同一事件的更多信源

相似阅读

另一事件,读法相近