Qwen3.8-Flash 发布,Flash-Next 开源预览 Qwen4
Qwen3.8-Flash 正式发布,
Qwen 新旗舰发布,Flash-Next 以 1/3 参数和算力追平甚至超越上一代,还开源了 Qwen4 架构预览,做推理框架和 Agent 的同学建议立刻跟进适配。
Qwen3.8-Flash 正式发布, Qwen3.8-Flash-Next 正式开源!
Qwen 官方把 Qwen3.8-Flash-Next 定义为 Qwen4 架构的早期预览,提前开源的目的,是让 vLLM、SGLang 等推理框架和基础设施开发者在 Qwen4 正式家族发布前完成适配。 https://qwen.ai/blog?id=qwen3.8-flash-next
效率方面:相对上一代旗舰 Qwen3.7-Plus(397B/A17B),Flash-Next 以 1/3 激活参数、1/3 训练 token、约 1/9 训练 FLOPs,在 14 个预训练基准上 8 个领先、其余最多落后 2.6 分。
稳定性方面:报告给出了可复现的压力测试方法(恒定学习率加倍模拟大规模失稳):在 4 倍最优学习率下,旧架构(AdamW + Qwen3.5 结构)频繁 loss 尖峰,而新配方(Muon + 门控残差)零尖峰;生产级训练全程未使用 qk-clip 之类的显式裁剪手段。
后训练模型的官方基准 对比对象为 Qwen3.7-Plus、DeepSeek-V4-Flash、Claude Opus 4.6 Max 等。 · 智能体编程:DeepSWE 1.1 得 58.7(Qwen3.7-Plus 仅 16.5,DeepSeek-V4-Flash 54.4);SWE-bench Pro 62.5;SWE-bench 多语言版 81.0 · 长程办公/Agent:CoWorkBench 73.9、JobBench 55.7、Toolathlon 73.5,均明显领先对比模型 · 通用:GPQA Diamond 91.7、LiveCodeBench v6 91.9、IFBench 81.3 · 多模态:AndroidWorld 84.5、MathVision 带代码解释器 95.7、OSWorld 2.0 部分 52.3、长视频 LVBench 76.6
更进一步:量化金融体系
看懂新闻只是起点——沿量化金融路径,把它变成能交付的工程能力