跳到主内容

日报

LIVE每早八时发报 · 更新于 08:00NewsHub Daily · 中文 AI 资讯精选

新闻枢纽 · 日报

本期 20 事件 · 覆盖 6 家信源
今日头条 · Lead

华为发布全球首款韬定律芯片麒麟9050 Pro

华为正式发布Mate XT 2与麒麟9050 Pro,后者为全球首款落地韬定律的旗舰芯片,晶体管密度较前代提升55%;Mate XT 2首发支持端侧MoE全模态大模型。同日,OpenAI发布GPT-6 Astra,长鑫LPDDR6量产商用,三星内存库存告急,存储与AI算力供应链成市场焦点。

18:32华尔街见闻(RSS)关联 2

华为发布Mate XT 2搭载首款韬定律芯片麒麟9050 Pro

9月7日,华为正式发布Mate XT 2三折叠手机,搭载全新麒麟9050 Pro芯片。该芯片是全球首款落地“韬定律”、采用逻辑折叠技术的旗舰芯片,通过内部逻辑单元分层排布与垂直互联通道,实现晶体管密度较前代提升约55%。整机性能提升42%,NPU功耗下降66%,GPU功耗下降58%。作为首款支持端侧MoE全模态大模型的手机,其原生盘古30B-A2B大模型可在无网环境下运行。售价19999元起,全球发货量已超100万台。

#华为#麒麟9050 Pro#端侧AI

01

模型发布/更新

Model Releases7

21:12云头条

英矽智能AI新药Rentosertib临床现逆龄信号,启动III期试验

2026年9月7日,英矽智能(Insilico Medicine)在《Nature Biotechnology》发表研究,其AI设计的小分子药物Rentosertib在特发性肺纤维化(IPF)IIa期临床试验的蛋白质组分析中,显示患者预测生物年龄下降约3至4年。该药靶点TNIK由AI发现,分子由生成式AI设计。目前Rentosertib已正式启动针对IPF的III期临床试验,计划在中国招募约320名患者。英矽智能披露2026年上半年收入约1.06亿美元并实现盈利,累计合作合同价值约110亿美元。

#Insilico Medicine#AI制药#Rentosertib

19:14IT之家(RSS)

宇树科技发布UnifoLM-X2-1.0实现世界模型驱动人形机器人全自主格斗

9月7日,宇树科技宣布全球首次实现由世界模型实时驱动的全自主人形机器人格斗。官方公布的UnifoLM-X2-1.0大模型突破了瞬时规划、决策和动态交互执行等瓶颈,使机器人能在高动态强对抗场景中自主完成预测与行动,不再依赖预设程序或人工遥控。此次突破验证了世界模型驱动的人形机器人大规模落地部署的基础可行性。相比此前进博会上的表演,该版本核心在于利用世界模型在内部建立对物理世界的预测性表征,在抽象空间中对未来状态进行推演,标志着具身智能从演示走向自主决策的关键进展。

#宇树科技#世界模型#人形机器人

10:27上海证券报

SK海力士与三星电子股价大涨,OpenAI发布GPT-6 Astra

9月7日日韩股市集体高开,韩国存储双雄SK海力士盘中涨超6%,三星电子涨逾4%。消息面上,OpenAI正式发布新一代旗舰模型GPT-6 Astra,该模型可自主操作软件、完成编程及金融建模等长周期多步骤任务。中信证券(香港)研报指出,受持续AI资本开支与采用率提升支持,预计2027至2028年存储需求增长将超过供应,供需紧平衡支撑高位利润。华泰证券认为监管靴子落地后韩股走势取决于半导体基本面。

#OpenAI#GPT-6 Astra#SK海力士

04:51Rohan Paul

Cartesia Sonic-3.6与Ink-2刷新语音AI延迟纪录

Cartesia发布Sonic-3.6文本转语音模型,端到端延迟低至90毫秒;同时推出Ink-2语音转文字模型,流式转录延迟为100毫秒。这两项技术将语音的听与说路径整合进智能体执行循环,旨在解决语音交互中微小延迟对体验的显著影响。目前这两款模型在各自领域均保持最低延迟表现,被视为语音AI架构向低延迟实时交互演进的重要趋势。

#Cartesia#语音AI#低延迟

03:18MarkTechPost(RSS)

OpenBMB发布MiniCPM5-2B:端侧部署与工具调用能力突出

OpenBMB发布MiniCPM5-2B,为MiniCPM5系列第二版,参数量2.52B,原生支持131K上下文。采用标准Llama架构,权重Apache 2.0开源,兼容vLLM等主流推理引擎。在34项基准测试中平均得分53.9,超越Qwen3.5-4B(51.1)。该模型在代码推理、工具调用及长文本检索上表现优异,但在通用知识领域弱于更大参数模型。训练流程包含400B token深度思考SFT、基于JustRL II算法的强化学习及在线策略蒸馏(OPD),并同步开源Ultra-FineWeb等全套数据集及中间检查点,便于复现验证。

#OpenBMB#MiniCPM5-2B#模型发布

21:51IT之家(RSS)

字节正开发实时空间视频生成模型,张一鸣督导最快下月发布

据彭博社报道,字节跳动正在研发一款基于 Seedance 的实时空间视频生成 AI 模型,由创始人张一鸣亲自督导。该模型计划最早于下月发布,旨在支持直播、短剧和游戏场景下的交互式虚拟世界创建。技术层面,模型可在每秒 20 帧下以约 50 毫秒延迟按需生成视频流,支持空间计算与人机交互。架构上,它将内容生成任务转移至云端,降低 VR 头显算力需求与硬件成本。字节将该模型定位为驱动生态的“飞轮”,串联自研 AI、云计算与 Pico 硬件终端,竞争重心有望从硬件参数转向大模型、算力及平台能力。

#字节跳动#Seedance#空间视频

13:00MarkTechPost(RSS)

IFM发布K2 Horizon:0.9B至375B六款Apache 2.0模型

MBZUAI旗下前沿实验室IFM发布K2 Horizon系列,包含0.9B至375B共六款基于统一架构的开源大模型,采用Apache 2.0协议。所有模型均在约20万亿token上预训练,其中17%为显式推理轨迹,支持vLLM、SGLang等主流部署工具。技术亮点包括将专家路由引入注意力的MoVA机制,以及通过扩散蒸馏实现的Uno LoRA适配器,可在无损前提下提升约3倍解码速度。375B-A23B在Terminal-Bench 2.1得分70.2,小模型在SWE-bench Verified等基准表现优异。

#IFM#K2 Horizon#模型发布

03

行业动态

Industry6

16:36上海证券报关联 2

工信部印发信息通信行业十五五规划,明确启动6G商用

工业和信息化部近日印发《信息通信行业发展“十五五”规划》,提出到2030年全面建成新一代通信网。规划首次明确适时启动6G商用,部署新建5G-A基站50万个、有序部署万卡及十万卡以上智算集群,并探索太空算力技术。网络方面推进城市热点区域向双万兆演进,农村实现乡乡通千兆、村村通5G;算力方面构建多层次设施体系,加大力度适配国产芯片。此外,规划还提出加快发展智能体互联网络,打造智网融合基础设施,并列出13项主要指标,包括行业收入达4.1万亿元、智能算力规模达9800EFLOPS等。

#工信部#政策监管#6G

15:09Serenity关联 2

三星内存库存告急,明年AI算力成本占比将大幅上升

韩国媒体今日报道,三星电子的库存已降至不足10天的供应量,预测明年可能出现严重短缺。KB证券指出,明年内存市场将面临“史上最严峻”的供应状况,并预计内存占AI基础设施成本的份额将从今年的40%升至明年的57%,TrendForce预测甚至高达68%。受此影响,相关股票过去三个月从高点下跌38%,市盈率降至约三倍。此外,群联电子也预期2027年NAND供应极度紧张,尽管部分中国消费模组厂因价格飙升清库存,但整体短缺趋势难改。

#三星#内存短缺#AI基建

15:46IT之家(RSS)

最高法发布首部涉人工智能司法裁判规则

最高人民法院发布《关于依法审理涉人工智能纠纷案件的意见》,这是首部由国家最高审判机构发布的涉人工智能司法裁判规则文件。该意见共24条,聚焦AI换脸拟声、大数据杀熟、仿冒名人带货、自动驾驶及知识产权保护等社会关注问题。意见明确未经同意利用AI生成可识别虚拟形象或合成声音构成对人格权益侵害;规制利用AI实施隐私侵犯行为;认定算法不合理差别待遇及欺诈性带货的侵权责任;厘清自动驾驶与辅助驾驶事故中生产者、销售者与驾驶人的责任分担,为AI行业合规提供清晰指引。

#中国#政策监管#最高法

17:35上海证券报

长鑫科技半年报营收1503亿扭亏,LPDDR6量产分红引关注

9月7日,长鑫科技召开2026年半年度业绩说明会。上半年公司实现营收1503.10亿元,同比增长873.64%;归母净利润776.05亿元,同比扭亏为盈。总经理赵纶表示,全球首款商用LPDDR6内存芯片已量产并由小米18 Fold首发搭载,HBM按既定路线迭代。财务负责人黄丹阳指出,下半年DRAM供给紧缺格局延续,上半年毛利率升至84.84%。针对股东回报,独立董事称公司将视盈利能力适时启动分红论证。目前公司与阿里云、腾讯等核心客户深度合作,总市值约3.97万亿元。

#长鑫科技#财报#LPDDR6

16:33IT之家(RSS)

三星将半数4纳米产能投入HBM4基础裸片生产

据韩国媒体 ZDNet Korea 报道,三星电子旗下三星晶圆代工部门正在为 HBM4 基础裸片的生产预留大量产能。在 HBM4 生产中,三星采用内部称为 SF4 的 4nm 工艺制造基础裸片,该产线约一半的整体产能将用于此目的。目前客户要求在基础裸片中加入定制逻辑电路,如内存控制器和 PHY,以减少主计算 Chiplet 上的占用面积。随着市场需求增长,三星在平泽园区 P2 和 P3 厂线的 SF4 芯片生产需求不断增加。数据显示,2026 年第二季度,三星按营收计算的 HBM 市场份额达到 38%,较一年前的 15% 大幅提升;

#三星#HBM4#半导体制造

22:31上海证券报关联 2

长鑫LPDDR6量产商用,首发搭载小米18 Fold

9月7日,长鑫存储宣布其自主研发的LPDDR6芯片实现量产商用,首发搭载于小米18 Fold折叠旗舰手机,成为全球范围内LPDDR6首次在旗舰手机端落地商用。该芯片容量16GB,最高传输速率12800Mbps,与SoC搭配速率10667Mbps,带宽较LPDDR5X提升60%,功耗降低20%。LPDDR6采用双子通道架构、双轨DVFS及动态效率模式,并采用高导热塑封料使热阻下降40%。同日晚,小米发布小米18 Fold,定义为“中折叠”产品,售价10999元起,首次实现自研玄戒O3芯片与长鑫LPDDR6同步首发及联合调优。雷军透露,小米另两款自研AI芯片O100与D100将于明年上半年商用。

#长鑫存储#LPDDR6#小米

04

论文研究

Research1

06:26Rohan Paul

ArcticSwarm:通过搜索隔离解决多智能体过早共识问题

论文指出多智能体研究中,若允许智能体过早交流,易导致“过早共识”,即一旦某智能体找到看似合理的答案,其他智能体会盲目跟随而非探索不同路径。ArcticSwarm 通过隔离搜索阶段来解决此问题:在审查前禁止智能体互相读取搜索结果,待各自独立搜索完成后才汇总对比。在 BrowseComp-Plus 数据集上使用 Qwen 3.5-27B 模型测试,该方法准确率达 82.6%;移除隔离机制后降至 78.8%,同时移除审查系统则进一步降至 74.5%。相比之下,40 个独立单智能体多数投票法仅达 63.5%。

#ArcticSwarm#Multi-Agent#Research

05

技巧与观点

Tips3

19:12meng shao

Impeccable:用61条Rust规则根治AI前端设计Slop

作者pbakaus基于Anthropic frontend-design skill开发Impeccable,旨在解决AI生成前端代码同质化问题。该工具通过三层架构应对:一是包含23个子命令的Skill文本层,提供标准化设计词汇表;二是核心创新点,即61条由Rust实现的确定性检测规则,分为32条识别AI口癖和29条检查质量指标,支持CI集成且无LLM依赖;三是流程契约层,通过Hook拦截、隔离评审及强制探索机制防止模型退化。工程上采用静态分发与多引擎复用策略,并建立从设计稿到代码的门控流水线,以二进制测量替代模型自我评估,确保高保真还原。

#Impeccable#前端工程#AI Slop

05:20Rohan Paul

Agent Skills为何有效:将混乱经验蒸馏为可执行流程

研究对比了两种历史轨迹呈现方式:保留详细执行细节的Workflow Memory与蒸馏后的SKILL.md。结果显示,使用Skill版本的Agent性能提升了6.06个百分点,且并未增加经验总量,仅因包装更优。轨迹分析表明,65.7%的成功源于程序化锚定(明确步骤、工具选择与避坑指南),仅4.5%源于补充缺失知识。这表明Skills主要优化执行层面的确定性,但在错误场景或过度僵化使用时可能产生负面影响。结论指出,自进化Agent的核心在于经验的蒸馏与应用机制,而非单纯扩大记忆库规模。

#Agent#Skills#经验蒸馏

17:18Avi Chawla

生产级大模型编码 Token 位置的 6 种策略解析

基础 Transformer 缺乏内置的 Token 顺序感知,需依赖位置编码。本文梳理了生产环境中常见的六种位置编码策略:Sinusoidal(正弦固定编码)、Learned(可学习嵌入)、RoPE(旋转位置编码,通过 Query-Key 旋转引入相对距离信息)、ALiBi(注意力线性偏置,对远距离 Token 施加惩罚)、YaRN(基于 RoPE 的频率重缩放与温度调整以支持长上下文)以及 NoPE(仅靠因果掩码的结构不对称性隐式学习位置)。文章指出有效的计算不等于有效行为,例如 RoPE 虽能计算极远位置但模型可能无法检索,且长上下文伴随高昂的计算与内存成本。

#LLM#Positional Encoding#RoPE

往期存档