精选90小互模型发布/更新多源精选 ×8
Qwen3.8-Max发布:2.4T参数,下周开源
Qwen3.8-Max 正式发布
推荐理由
Qwen Max系列首次开源,2.4T参数旗舰模型,能力跃升明显,做Agent和编程的从业者必看,下周开源后建议立即测试。
Qwen3.8-Max 正式发布
不仅在编程、办公、长任务执行和多模态理解上实现了巨大跃升
还具备“长周期自主工作”和“自我进化迭代”的能力
而且将于下周开源,这是Qwen Max系列首次开源
- 总参数量高达 2.4 万亿(2.4T),激活参数 95B
- 无人自主编程:在 oh-my-cli 项目中完全自主运行 16 天
- 24 小时击败 87% 人类选手:在真实电商多模态意图识别竞赛中,自主搭建并调优多个文本与视觉模型进行集成投票,提交 45 次,准确率从 0.60 提高到 0.853,击败了 458 支人类队伍。
- 365 天模拟电商经营:在真实数据构建的模拟电商环境(E-Commerce Bench)中,面对季节波动、博弈议价和供应商欺诈陷阱,实现了 4.16 倍的资金回报(净赚超 10 万元),高居榜首。
- 复现科研论文并超越:花了 5 天(约 125 小时)从零编写 7,600 行代码,不仅完整复现了一篇最新的 AI 训练数据选择论文,还通过自主迭代设计了 18 种改进方案,在数学基准 AIME24 上把成绩反超了原论文 2.71 分。
数百种高价值职业提效:
法务合规:1 小时审完数百份合同并精确标出 1,284 条相关条款(人工团队通常需一周)。
UI/UX 设计:一次性生成 8 个页面的高保真 App 原型,无需人工二次修改。
量化研究员:仅凭一句任务需求,自主搭建数据系统、编写因子并跑回测;还能并行调度约 330 个子 Agent,完成 6,000 次回测挖掘优质因子。
视觉与多模态:边做、边看、边纠错
超长文档与视频处理:支持阅读 200+ 页财报/PDF,以及分析 100+ 小时超长视频并建立“视频 Graph 记忆”。
视觉原生反馈闭环:模型在执行任务时不仅把视觉当输入,还会看自己生成的产物/操作界面。如果发现界面布局错位或效果不理想,能像人类一样“看结果 ➔ 找问题 ➔ 重新调整”。
Hybrid Agent(编程 + GUI 界面操作):可以通过编写代码和直接操控软件界面相结合的方式,在黑盒环境下全自主复刻桌面/移动端应用。
https://best.xiaohu.ai/article/qwen3-8-max/
更进一步:量化金融体系
看懂新闻只是起点——沿量化金融路径,把它变成能交付的工程能力