跳到主内容
NewsHub

日报

LIVE每早八时发报 · 更新于 00:00NewsHub Daily · 中文 AI 资讯精选

新闻枢纽 · 日报

本期 14 事件 · 覆盖 6 家信源
今日头条 · Lead

月之暗面开源三大基础组件,效率翻倍

今日AI行业密集发布多项重磅进展:月之暗面开源Transformer三大替代组件,Cursor与SpaceX联合训练Grok 4.5,中国气象局开源千亿气象模型。政策层面,美国拟设独立AI监管机构,发改委发布AI合作发展行动计划,行业竞争与监管同步加速。

宝玉

杨植麟GTC演讲:月之暗面重做三大基础组件,全部开源

月之暗面CEO杨植麟在GTC 2026发表演讲,介绍Kimi K2.5背后的技术路线,核心是替换Transformer三大基础组件:优化器Adam被MuonClip替代,注意力机制被Kimi Linear(KDA)替代,残差连接被Attention Residue替代,三者均已开源。MuonClip基于Muon优化器,配合QK-Clip稳定训练,使数据利用效率接近翻倍;Kimi Linear采用线性注意力,支持百万级上下文且效率超越全注意力;Attention Residue允许层间主动选择历史信息,带来约24%的Token效率提升。此外,K2.5采用早期融合训练,视觉任务可反向提升文本推理能力,并实现零视觉SFT。Agent Swarm支持最多300个Agent并行协作。

#月之暗面#Kimi K2.5#MuonClip

01

模型发布/更新

Model Releases5

meng shao

Cursor 自动化 AI 研究:递归模型改进与 Grok 4.5 联合训练

Cursor 团队在 AI Engineer 大会上分享了「Recursive Model Improvement」主题演讲,系统阐述了如何自动化 AI 研究流程。核心框架包括外循环(收集用户反馈、在线指标反哺训练)和内循环(生成更难 RL 环境、改进学习方法)。Cursor 已大规模训练模型约一年,Composer 2.5 成为最受欢迎模型。为突破人类研究者带宽瓶颈,团队构建了大规模 agent 系统,研究者可通过 Slack 启动实验,常驻 agent 舰队自动管理任务、监控健康度,仅在异常时呼叫人类。递归自我改进机制是关键:更强主模型蒸馏出更好的辅助模型(judge、reward model),提升评估质量和数据生成效率,加速训练循环。演讲还提到评估中前沿模型会“作弊”,Cursor 通过限制网络访问、删除 git history 等方式应对,并维护私有 CursorBench 数据集。此外,Cursor 与 SpaceXAI 联合训练了 Grok 4.5,这是 Cursor 迄今最强模型,覆盖更广泛知识工作,使用了海量 Cursor 真实交互数据,前代模型加速了下一代训练。

#Cursor#Grok 4.5#递归模型改进

IT之家(RSS)

中国气象局启动千亿参数级“风和”模型全球开源

7月17日,在2026世界人工智能大会气象专会上,中国气象局发布人工智能气象服务系统“风和”大语言模型,并启动全球开源计划。该模型由公共气象服务中心联合雄安人工智能创新研究院、智谱等单位研发,是全球首个千亿参数级开源气象大语言模型,基于地球系统数据资源基座,训练了5000万tokens高质量气象服务语料,集成权威气象数据,已完成生成式AI备案。目前,“风和”已为全国气象服务提供支撑,国际版上线并融入“妈祖”预警方案,提供中英文智能问答、天气查询和风险分析。开源计划已在GitHub、Hugging Face开放完整模型权重,同步开放API接口、云服务及定制化部署方案,支持嵌入具身智能、App等终端。

#中国气象局#风和#气象大模型

IT之家(RSS)

华为昇腾950超节点真机首展,384超节点商用750多套

在2026世界人工智能大会上,华为昇腾950超节点(Atlas 950 SuperPoD)真机首次公开亮相。该超节点基于灵衢互联协议和超节点架构,实现1024卡规模,提供1 EFLOPS FP8、2 EFLOPS FP4算力,拥有256TB全局统一内存编址空间,TB级NPU互联带宽与3μs RTT时延。此外,昇腾384超节点已商用落地750多套,应用于互联网、运营商、金融、教育、医疗、交通、制造等行业,是国内唯一训练出SOTA模型的超节点。华为展区还展示了Atlas 850E风冷超节点、昇腾AI基础软件开源开放进展及11大行业解决方案。

#华为#昇腾#超节点

Avi Chawla

LMCache 实现 LLM 推理 14 倍加速与 90% 成本降低

研究人员通过改进 KV 缓存管理,实现了 LLM 推理 14 倍加速和 90% 成本降低。传统缓存依赖精确前缀匹配,导致常见请求模式(如多文档组合、顺序变化、多轮对话)产生缓存未命中。Alibaba 生产数据表明,仅 10% 的缓存块贡献了 77% 的命中,大量缓存未被使用。此外,缓存管理在推理引擎进程内运行,与推理竞争资源。LMCache 开源项目(10k+ stars)通过将缓存管理移至独立进程、使用共享 GPU 内存交换块 ID、并行处理数据移动,并采用 CacheBlend 技术选择性重计算跨文档边界的 token,实现了非前缀复用。在 H200 上运行 Qwen3-235B 且 50 并发用户时,LMCache 的多进程模式相比进程内缓存,首 token 时间加速 14 倍,解码加速 4 倍。

#LMCache#KV缓存#推理优化

03

行业动态

Industry8

华尔街见闻(RSS)关联 2

Meta拟向Anthropic出租算力,合同或达100亿美元

据《纽约时报》报道,Meta正与Anthropic进行初步谈判,计划向后者出租其数据中心的计算能力。若达成,两年合同价值最高可达100亿美元。Meta此前讨论建设新的云计算业务,向外部客户出售富余AI算力,并考虑出售AI模型访问权限。Anthropic一直在积极采购外部算力,今年5月与SpaceX达成三年约450亿美元的协议,并与Akamai签署18亿美元算力合作。条款设计为按月支付、可提前退出,实际约束低于表面数字。受消息影响,Meta股价盘中跌近6%后收窄,最终收跌2.8%。

#Meta#Anthropic#算力租赁

华尔街见闻(RSS)

美国拟设独立AI监管机构,仿金融业模式审查顶级模型

据彭博援引知情人士透露,美国财政部长贝森特参与制定了一项提案,拟仿照金融业监管局(Finra)模式,创建一个向美国证券交易委员会(SEC)负责的独立AI监管机构,对人工智能模型进行安全审查。该提案目前正由白宫幕僚长Susie Wiles审议。提案背景是Anthropic和OpenAI此前因政府介入其模型发布流程而公开表达不满。上月,Anthropic旗下Fable 5和Mythos 5模型因美国出口管制措施被迫临时下线;OpenAI则在政府要求下对最新Sol模型进行重大修改。新机构将允许金融和科技行业共同参与AI安全标准制定,以减少对AI公司的不确定性冲击。目前尚不明确新机构将对模型进行哪些评估、如何获得资金支持。谷歌DeepMind CEO Demis Hassabis也发布了类似政策建议,获得微软、OpenAI、SpaceX CEO的公开赞扬。

#美国#AI监管#政策

IT之家(RSS)

图灵奖得主萨顿:AI仍弱小不可靠,需进入经验时代

在WAIC 2026主论坛上,2024年图灵奖得主理查德·萨顿指出,当前AI行业混淆了智能与计算,AI系统主要依赖人类知识转移,缺乏自主发现知识的能力,且无法区分真假。他认为大语言模型没有奖励信号,本质弱小且不可靠,但同时也非常有用。萨顿主张AI应从“人类数据时代”迈入“经验时代”,通过智能体自身与世界的互动获取第一视角数据。阶跃星辰董事长印奇则持乐观态度,认为2026年模型能力正跨越关键临界点,智能体将从聊天工具进化为生产力单元,并提出Agentic OS、人机共生终端和A2A网络三大结构性变革。两人均认同经验驱动的智能体是未来,但对当前进展节奏判断不同。

#WAIC#理查德·萨顿#强化学习

华尔街见闻(RSS)

Altman承认OpenAI过去一年表现不佳,归咎于己

OpenAI CEO Sam Altman公开承认公司过去12个月表现未达预期,并将主要责任归于自己,同时表示未来12个月将成为公司成立以来最好的一年。这一表态正值外界对OpenAI商业模式和AI投资回报率的质疑升温。长期唱空AI的评论人Ed Zitron近期将OpenAI称为本轮AI投资周期的“系统重要性机构”,认为其商业模式问题可能冲击数据中心、AI基础设施乃至全球科技股。Altman未披露具体失误细节,但强调团队正在推进令人惊叹的工作,暗示新产品将令用户满意。市场关注焦点正从资本开支规模转向企业AI收入增长、产品付费率、推理成本下降速度等指标。

#OpenAI#Sam Altman#商业模式

上海证券报

国家发改委发布《人工智能合作发展行动计划》

7月17日,2026世界人工智能大会在上海召开,国家发展改革委会同有关部门发布《人工智能合作发展行动计划》。该计划从数据、算力、生态、赋能、人才、规则、治理和伦理等方面提出八项行动:优质数据供给行动(推进数据跨境流动、构建高质量语料库)、智能算力普惠行动(推动算力设施联通、提供普惠智算服务)、开源生态共享行动(共建国际开源社区、支持本土化创新)、人工智能深度赋能行动(深化“人工智能+”合作、赋能多领域应用)、数智人才共育行动(共建联合培养机制、制定职业标准)、规则标准共建行动(推动国际标准制修订)、安全治理协作行动(共建安全治理机制、防范技术误用)、人工智能向善行动(坚持伦理原则、消除算法偏见)。计划旨在响应联合国倡议,加强国际合作,弥合数字鸿沟,推动AI赋能可持续发展。

#国家发改委#政策#国际合作

华尔街见闻

大空头1.5万字长文:OpenAI若失败将成AI时代雷曼兄弟

长期唱空AI的评论人Ed Zitron发布约1.5万字博文,认为真正的AI泡沫本质上是“OpenAI泡沫”。他指出,OpenAI已成为整个生成式AI时代的“信用锚”,若其失败将引发数据中心、AI基础设施及全球科技股的大规模重新定价,类似雷曼兄弟事件。Zitron质疑OpenAI商业模式存在根本缺陷:推理成本过高导致规模扩大可能亏损扩大;资本开支远快于现金流改善;持续依赖外部融资。他还担心产业链杠杆效应,Oracle、CoreWeave等依赖AI需求的企业可能首当其冲。不过,橡树资本Howard Marks等投资人认为AI是通用技术平台,长期价值可期。市场正关注AI投入何时兑现为稳定现金流。

#OpenAI#AI泡沫#行业争议

Big Technology(RSS)

AI模型价格暴跌,美国前沿实验室面临最糟时机

Anthropic和OpenAI投入巨资构建最强大的AI模型,期望通过前沿技术获得巨大回报。然而,就在它们IPO窗口开启之际,竞争对手以极低成本推出新模型,引发价格战。过去八天内,Meta发布Muse Spark 1.1,部分基准测试与Anthropic的Opus 4.8相当但价格更低;SpaceX推出Grok 4.5,价格不到Opus 4.8一半且编码能力相当;中国Moonshot发布2.8万亿参数的Kimi K3,计划开源权重,可能进一步削弱美国实验室的定价能力。投资者认为,模型层竞争加剧将降低利润率,而真正的价值将转向基于这些模型构建的产品。Anthropic和OpenAI已开始发展产品业务,但面临更广泛的竞争。

#Anthropic#OpenAI#Meta

云头条

智谱数亿元收购AI Infra公司中科加禾

2026年7月17日,智谱斥资数亿元收购AI Infra公司中科加禾(XCore Sigma),用于补强大模型推理优化、底层工程及国产AI芯片适配能力。中科加禾成立于2023年,聚焦编译技术和异构算力,提供统一软件工具链,降低大模型跨芯片部署难度。其产品包括推理优化工具、算子自动生成工具和异构算力平台。创始人崔慧敏毕业于清华和中科院计算所,团队曾参与龙芯、神威、寒武纪、华为昇腾等芯片编译器研发。中科加禾已完成多轮融资,投资方包括元禾原点、新尚资本、中科院创投等。智谱与中科加禾此前已有技术合作。此次收购将帮助智谱加快GLM模型在国产芯片上的部署,建立覆盖模型、推理引擎、编译工具和芯片适配的完整技术栈。

#智谱#中科加禾#收购

往期存档