跳到主内容
@wquguru
精选60Lonely产品发布/更新

Qwen-3.8 实测:长任务执行流畅,速度优于竞品

Qwen-3.8 发布两天,实测体验来了。

原文
发到 X

Qwen-3.8 发布两天,实测体验来了。

第一时间订阅了 Token Plan,并在 Qwen Code 环境下进行了对比测试。

📊 实验对照:

第一次(弱提示):仅给出一句话模糊需求,生成效果较为平庸、模式化。

第二次(强结构):清晰梳理功能模块、交互逻辑、图片规则及页面结构。模型对长任务的指令遵循度表现极佳,最终成功交付了一个完整的可操作系统。

核心体验: 1. 推理与生成速度:即便面对超长 Prompt 和多页面构建,整个生成过程依然流畅,耗时17分钟,等待延迟相比 kimi k3(52分钟)、grok 4.5(26分钟) 小很多。

2. 长任务执行力:后加的交互细节与模块划分,基本都高水准地落到了最终成品中。

最后:还是那句话,模型能力固然重要,但想让模型稳定交付复杂任务,需求本身也得足够清楚。

把目标、模块和规则拆明白,Qwen 3.8 确实能把复杂任务推进得又快又完整。

越来越期待它接下来的开源评测了!

以上。

附上两次生成过程和最终效果👇

更进一步:量化金融体系

看懂新闻只是起点——沿量化金融路径,把它变成能交付的工程能力

进入量化体系 →

关联讨论

同一事件的更多信源

相似阅读

另一事件,读法相近