03:44meng shao关联 3 源
FLUX 3 发布:定位真实世界模型
Black Forest Labs 发布 FLUX 3,定位为“真实世界模型”,融合图像、视频、音频于同一架构,用于内容生成和具身动作预测。Video 产品已开放 Early Access,最长约 20 秒、原生音频;Image 随后数周推出;Action 通过伙伴通道提供。
每早八时出报
AI · 模型 · 产业
新闻枢纽 · 日报
中文 AI 资讯
NEWSHUB DAILY
今日美股科技七巨头因财报不及预期单日市值蒸发7970亿美元,市场担忧AI巨额投入回报率,指数创4月以来最大跌幅。与此同时,英特尔财报显示AI需求前所未见,大幅上调资本开支;英伟达等25家公司联署支持开放权重AI,行业分化加剧。国内方面,国产世界模型登顶李飞飞团队榜单,蚂蚁发布百灵Ling-3.0-flash,Anthropic发布Claude Opus 5等新品密集涌现。
17:42Anthropic Newsroom(web_list)关联 9 源
Anthropic 发布 Claude Opus 5,在 Frontier-Bench、GDPval-AA 等基准上达到新 SOTA,但网络安全任务仍落后于 Mythos 5。Opus 5 在编码和知识工作方面表现出色,例如在 Frontier-Bench v0.1 上性能是 Opus 4.8 的两倍以上,且每任务成本更低。在 CursorBench 3.2 上,最大努力设置下性能接近 Fable 5 的峰值,但成本减半。该模型还具备更强的自我验证和迭代能力,即日起成为 Claude Max 的默认模型和 Claude Pro 的最强模型。
03:44meng shao关联 3 源
Black Forest Labs 发布 FLUX 3,定位为“真实世界模型”,融合图像、视频、音频于同一架构,用于内容生成和具身动作预测。Video 产品已开放 Early Access,最长约 20 秒、原生音频;Image 随后数周推出;Action 通过伙伴通道提供。
13:57IT之家(RSS)
蚂蚁集团旗下百灵大模型发布新一代原生混合推理模型Ling-3.0-flash,总参数量124B,激活参数仅5.1B,能力对标上一代1T级旗舰Ring-2.6-1T。该模型采用原生混合线性注意力架构(5:1交替堆叠KDA与MLA),升级KDA细粒度对角门控与1/64稀疏MoE。在Agent场景中扩展10,000+可交互训练环境,接入SGLang HiCache+Mooncake分级缓存架构,长输入下TTFT降低60%-80%。即日起在OpenRouter与百灵官方平台开放限时免费API调用,免费期至8月3日,模型权重将在免费期结束后开源。
14:19量子位(RSS)
国产世界模型在由李飞飞团队主导的榜单中登顶,该模型适配国产昇腾算力,代码和权重已全部开源。模型能够根据单张图片生成完整的3D场景,展现了在空间智能领域的突破。此次登顶标志着国产模型在视觉生成与理解方面达到国际领先水平,且完全基于国产算力平台,降低了硬件依赖。开源策略有助于推动社区研究和应用发展。
02:24meng shao
Together Compute 团队在 DeepSWE 基准上对比 Kimi K3 max 和 GPT-5.6 Sol max。pass@1 GPT 72.7%,Kimi 68.5%;pass@2 Kimi 反超至 82.0%;pass@4 Kimi 89.4% 领先。成本上 Kimi 单价 $4.65/rollout,Sol $8.37;每 $100 Kimi 解 14.7 题,Sol 5.3 题。时延 Sol 中位 17 分钟,Kimi 66 分钟。两模型任务相关约 0.46,组合覆盖 95.6%。推荐级联:先 Kimi,验证不过再 Sol,解题率 85.6%,成本 $7.30/任务。
00:43宝玉
ChatGPT桌面端(原Codex App)今日新增语音控制功能,macOS和Windows用户可通过语音指令操控电脑、启动Codex写代码、调度ChatGPT Work执行任务,全程无需打字。该功能基于GPT-Live全双工语音模型,能同时听和说,复杂推理任务交由后台GPT-5.5处理。macOS用户还支持Appshots功能,语音对话时ChatGPT可查看当前最前窗口内容以提供上下文相关回答。iPhone用户可通过远程配对用iOS语音操控桌面端Codex,Android支持待上线。功能面向Plus、Pro、Business、Edu和Enterprise用户,免费用户暂不可用。
18:10华尔街见闻(RSS)关联 5 源
英伟达、微软、Meta等25家美国科技公司联名致信,警告政策制定者不应对开放权重AI模型实施过早限制。英伟达CEO黄仁勋与微软CEO纳德拉均在个人社交媒体上转发该公开信,马斯克亦表示完全支持。信中强调开放权重模型有助于强化竞争,确保AI技术红利广泛共享,并反驳了开放即不安全的论断。OpenAI和Anthropic未参与联署,但OpenAI CEO奥特曼表示乐见该表态,并希望美国在开源和专有AI领域均取得胜利。
02:49IT之家(RSS)关联 2 源
据《华尔街日报》援引知情人士消息,海外支付巨头 Stripe 正与全球最大 AI 聚合平台 OpenRouter 洽谈收购事宜。OpenRouter 估值可能接近 100 亿美元,而今年 5 月其融资时估值仅为 13 亿美元。OpenRouter 成立于 2023 年,聚合数百种开源与闭源模型,定位为 AI 开发商与企业用户之间的中间平台。Stripe 成立于 2011 年,提供在线支付处理、开发者支付 API 及财务管理软件。谈判仍存变数,交易可能破裂,也不排除其他竞购方加入。
00:11华尔街见闻(RSS)关联 2 源
英特尔公布二季度财报,营收161亿美元,连续第七个季度超预期,AI驱动业务同比增长超70%。CEO陈立武表示,产品需求远超供应,行业面临史上最严峻的供应短缺,涵盖先进逻辑芯片、硅晶圆、存储器及基板。公司大幅上调2026年资本开支至200亿美元以上,并预告2027年将更高。18A制程良率超预期,已量产多款产品;14A制程进展顺利,计划2028年高产量量产。数据中心业务营收63亿美元,同比增59%;PC业务面临下半年消费市场下滑挑战。公司正加速向AI优先转型,并积极扩充ASIC设计服务。
09:33经济观察报
据《科学》与撤稿观察联合披露,2025年3月一名6岁女童在上海交通大学医学院附属新华医院接受基因编辑IIT治疗后死亡。女童患有CHD3基因突变导致的Snijders Blok–Campeau综合征,治疗三天后出现发烧、肾损伤,一周内死亡。医院内部评估认为死因与治疗相关。家属筹集约86万美元资助试验。2026年2月仇子龙团队在《自然》发表相关小鼠研究,未提及该死亡事件。《自然》表示审稿时不知情。上海有关部门对医院罚款约3600美元。目前涉事方未公开回应。
00:18华尔街见闻(RSS)
7月23日周四,美股“科技七巨头”(Mag 7)单日市值合计蒸发7970亿美元,指数跌幅达4.8%,创2025年4月“关税风暴”以来最大单日跌幅。导火索是Alphabet和特斯拉发布的财报:Alphabet二季度资本支出450亿美元,全年上限上调至2050亿美元,自由现金流首次转负;特斯拉利润率和每股收益大幅低于预期,股价暴跌15%。苹果跌幅最小,因未跟风大规模资本支出。市场担忧AI巨额投入的回报率,叠加中东战事推高油价至100美元/桶,美联储加息概率上升,宏观压力加剧。Mag 7指数较5月底高点已累计下跌11%,蒸发市值达2万亿美元。
14:43The Verge AI(RSS)
特朗普政府于周四公布了首批“创世纪任务”资助,拨款50亿美元用于数百个AI驱动的科学项目,白宫称其“紧迫性和雄心堪比曼哈顿计划”。同时,特朗普的科学顾问Michael Kratsios在国会兜售“美国科学新黄金时代”的承诺,将优先发展人工智能、机器人和核能,而弱化生命科学。这两项公告清晰展示了特朗普重塑美国科学的计划。
13:29Chubby♨️
据WSJ报道,中国正在建设可替代英伟达的国产AI芯片堆栈。2021年中国约90%的AI芯片依赖进口,到2025年这一比例已降至60%以下,摩根士丹利预计2030年可能降至25%。华为在无法获得先进EUV光刻机的情况下,通过结合旧款生产工具与先进封装、芯片堆叠及大规模集群技术,其昇腾芯片已能在部分AI任务中替代英伟达硬件。目前英伟达最强芯片算力约为华为最强芯片的4倍,中国仍依赖外国设备,但完全芯片自主已不再遥不可及。
09:20职场Bonus
据《新智驾》消息,小鹏汽车AI基础架构部负责人陆思渊即将离职,下一站为OpenAI,参与具身智能机器人研发。陆思渊在小鹏构建了统一AI底层基座,覆盖模型训练框架、GPU集群管理、自研芯片编译器、数据处理、模型量化优化及车端推理部署,支撑自动驾驶、人形机器人IRON、飞行汽车三大业务。其离职后,团队预计拆分为三个以上独立团队。小鹏近三年核心人才持续流失,包括2023年吴新宙离职加入英伟达,2025年李力耘卸任,2026年加入众擎机器人任CTO,以及机器人业务负责人米良川等陆续离职。OpenAI于2026年6月成立内部机器人事业部,由Aditya Ramesh统筹,走仿真先行的差异化路线。
01:12宝玉
《Clean Code》作者鲍勃大叔(Robert C. Martin)表示,他不看AI生成的代码,因为人类读代码太慢,逐行审查会丧失AI生产力。他的做法是给AI Agent设置层层关卡:单元测试、Gherkin测试、QA流程、代码质量指标、变异测试、测试覆盖率等。他今年早些时候公开了具体实践:一套四个Agent组成的流水线,分别负责需求规格化、编码、重构和架构审查,每个阶段更形式化,人工干预更少。他通过测试覆盖率、依赖结构、圈复杂度、模块大小等指标推断代码质量。他认为AI时代高质量的测试覆盖比代码本身更有价值,并在O'Reilly和Clean Coders平台推出了相关课程。