跳到主内容
NewsHub

日报

LIVE每早八时发报 · 更新于 00:00NewsHub Daily · 中文 AI 资讯精选

新闻枢纽 · 日报

本期 16 事件 · 1 一手信源 · 覆盖 5 家信源
今日头条 · Lead

阿里千问发布首个原生语言世界模型

阿里千问推出 Qwen-AgentWorld,旨在以原生语言模型模拟七大智能体交互环境,超越 GPT-5.4 等竞品。同日,OpenAI 与博通发布 LLM 推理芯片 Jalapeño,高通宣布全面进军 AI 数据中心,行业领袖黄仁勋、孙正义等强调 AI 需求爆发与智能体时代到来。

IT之家(RSS)

阿里千问发布首个原生语言世界模型 Qwen-AgentWorld

阿里巴巴千问大模型发布 Qwen-AgentWorld,官方称其为首个原生语言世界模型,能够在七大领域(MCP、Search、Terminal、SWE、Web、OS、Android)中模拟智能体交互环境。该模型提供 35B-A3B 与 397B-A17B 两种规模,环境建模从继续预训练(CPT)阶段起即为训练目标,贯穿 CPT → SFT → RL 全流程。同步发布的还有 AgentWorldBench 评测基准,覆盖七大领域,每条测试样本均配备真实环境执行所得的真实观测数据。在 AgentWorldBench 评测中,Qwen-AgentWorld-397B-A17B 取得最高整体模拟质量,超越 GPT-5.4、Claude Opus 4.8 与 Gemini 3.1 Pro。模型与评测基准可从 Hugging Face 和 ModelScope 获取。

#阿里#千问#Qwen-AgentWorld

02

产品发布/更新

Products1

华尔街见闻(RSS)关联 3

豆包专业版上线,三级阶梯定价最高年费6000元

字节跳动旗下AI助手豆包于6月24日正式推出专业版付费订阅服务,实行三级阶梯定价:标准套餐连续包月68元,加强套餐200元,高级套餐500元。专业版基于豆包2.1系列大模型,面向需要处理复杂工作和生产力场景的专业用户,新增办公任务模式,支持操作本地电脑、使用浏览器、调用技能和定时任务,内置Office办公套件,并可生成分享应用网站。免费版功能不变且将持续迭代。豆包表示,此次收费为增值订阅服务,旨在将高算力消耗用户从免费池中分离。据媒体报道,豆包日均算力消耗达数千万元,日活超2亿但日收入不足百万元。摩根士丹利分析指出,豆包标准版定价清晰指向创作者和知识工作者,而非广泛大众群体。

#字节跳动#豆包#付费订阅

03

行业动态

Industry8

华尔街见闻(RSS)关联 3

谷歌AI人才流失加剧,两名Gemini核心研究员转投Anthropic

据彭博社报道,谷歌在AI领域的人才流失进一步深化,继诺贝尔奖得主John Jumper和明星研究员Noam Shazeer出走后,参与Gemini模型核心开发的两名研究员Jonas Adler与Alexander Pritzel也将投奔竞争对手Anthropic。Adler主导谷歌AI编程方向,Pritzel深度参与模型训练流程,两人均被视为Gemini的关键贡献者。此轮人才出走发生在Jumper与Shazeer消息公布后数日内,引发投资者对谷歌竞争力的质疑。Anthropic正处于上市前夕,最新估值达9650亿美元,考虑今年秋天启动IPO,为人才提供“上市前入场券”。谷歌方面表示对人才市场地位有信心,但分析人士认为短期密集高端人才流出难以忽视。内部资源分配矛盾也是离职原因之一,Shazeer项目算力曾被重新调配至伦敦团队。Jumper预计因非竞争协议要到明年才能开始在Anthropic工作。

#谷歌#Anthropic#人才流失

华尔街见闻(RSS)

高通全面进军AI数据中心,Meta签CPU大单微软部署HBC芯片

高通在2026投资者日上宣布全面进军AI数据中心市场,发布Dragonfly产品家族,包括Dragonfly C1000数据中心CPU、AI300加速器及互联方案。Meta已签署覆盖多个产品世代的战略合作协议,将采用Dragonfly CPU;微软Azure将部署高通HBC平台(搭载AI250加速器),预计2027年年中商业采样。高通预计数据中心业务2027财年贡献数十亿美元收入,定制芯片业务从2027财年Q1开始贡献实质性营收。此外,高通以约39亿美元收购AI软件公司Modular,补齐软件生态。

#高通#Meta#微软

宝玉

Anthropic谈判代表换人,Fable 5解禁现转机

据WIRED报道,Anthropic联合创始人Tom Brown取代CEO Amodei,成为与特朗普政府就Fable 5模型解禁谈判的主要代表。6月12日,美国商务部以国家安全为由对Anthropic的Fable 5和Mythos 5模型实施出口管制,禁止外国公民访问,导致Anthropic被迫关闭这两款模型。导火索是亚马逊研究团队声称找到绕过Fable 5安全护栏的方法。白宫与Anthropic多轮谈判后,因Amodei沟通困难,改由Tom Brown和公共政策负责人Sarah Heck接替。Amodei此前曾因拒绝删除Claude合同中的限制条款,导致Anthropic被国防部列为供应链风险。国会两党四名众议员已致信商务部长,要求解释出口管制依据及恢复访问标准,回复截止日期为6月26日。Fable 5重新上线尚无明确时间表。

#Anthropic#Fable 5#出口管制

华尔街见闻(RSS)关联 2

360周鸿祎:AI正重新定价漏洞,推中国版Mythos

在第十四届互联网安全大会上,360集团创始人周鸿祎指出,AI正在改变网络安全行业,漏洞挖掘的速度、数量、成本和门槛均发生质变。他提到Anthropic的Mythos智能体已能自主寻找漏洞并构造攻击代码,将漏洞发现时间压缩至分钟级,成本降至不到1000美元。360推出自动化漏洞挖掘智能体“图龙锋”,已累计挖掘3000多个漏洞,并计划发布自动化防御系统“仪天阵”。周鸿祎还警告,美国组建“Glasswing”联盟对关键基础设施进行AI漏洞排查,中国企业被排斥在外,可能导致中国网络安全面临“第二次单向透明”。此外,他建议企业将智能体视为组织重构工具,而非单点效率工具,并指出开放式推理智能体在企业内网存在安全风险,B端更可能转向受限工作流型智能体。

#360#周鸿祎#网络安全

华尔街见闻(RSS)关联 2

孙正义:AI没泡沫,软银已量产机器人,驳马斯克太空数据中心

软银创始人孙正义在年度股东大会上为AI投资热潮背书,宣布软银已启动机器人批量生产,并设定未来十余年净资产价值目标为1000万亿日元。他驳斥AI泡沫论,称其为“对AI的亵渎”,认为AI潜力刚刚开始释放。孙正义正面回应马斯克的轨道数据中心构想,认为制胜关键在地球而非太空,太空数据中心成本高、延迟大。他还透露软银正在敲定俄亥俄州数据中心意向书,并持续推进“星际之门”项目。孙正义表示不打算退休,计划带领公司奋斗到70岁,实现“人工超级智能”。

#软银#孙正义#AI投资

华尔街见闻(RSS)

美光CEO:内存成AI时代战略资产,机器人或催生超级周期

美光科技公布2023财年第三季度财报,营收415亿美元创纪录,同比增长346%,毛利率84.9%。CEO Sanjay Mehrotra在业绩电话会议上表示,AI已结构性改变存储行业,内存成为战略资产。美光已与数据中心、消费端和汽车市场客户签署16项战略客户协议(SCA),多为五年期照付不议合同,按最低价格计算未来保底收入达1000亿美元,预计将收到220亿美元现金存款及相关财务承诺,其中约180亿美元为现金押金。Mehrotra预计,由于AI需求驱动及结构性供应限制,内存紧缺将持续到2027年以后,即使2028年供应逐步改善,仍无法看清何时能赶上需求。美光HBM4 12hi量产速度是HBM3E 12hi的两倍,HBM4收入已超10亿美元。此外,人形机器人内存需求是L2+级汽车的10倍,预计本十年后半段开启持续数十年的需求周期。

#美光#存储#HBM

华尔街见闻(RSS)

黄仁勋:AI工厂时代来临,智能体重塑计算格局

在英伟达年度股东大会上,CEO黄仁勋宣告智能体时代正式到来,并将此轮计算范式转变定性为60年来规模最大的行业重置。他指出,AI已从“有趣”跨越到“有用”,智能体商业落地成为新一轮增长核心逻辑。英伟达国际市场收入超300亿美元,同比增逾三倍,近40个国家正在部署AI工厂。黄仁勋将Vera Rubin平台定位为英伟达历史上最重要的产品发布之一,其Vera CPU专为智能体设计,已进入全面量产。CUDA X库被称为“皇冠珠宝”,支持逾7000个应用。关于中国市场,H200芯片出口获批但尚未产生收入。黄仁勋还罕见公开回应芯片走私问题,称英伟达已多次成功拦截走私案例。

#英伟达#黄仁勋#AI工厂

04

论文研究

Research1

MarkTechPost(RSS)

DFlash:块扩散推测解码,Blackwell上吞吐量提升15倍

UC San Diego团队提出DFlash,一种基于块扩散模型的推测解码方法。传统推测解码使用自回归草稿模型,速度提升仅2-3倍。DFlash的草稿模型在单次前向传播中生成整个token块,然后由目标模型并行验证。该方法将目标模型的隐藏特征注入草稿模型的每一层KV缓存,使接受长度随草稿深度扩展。实验表明,在Qwen3-8B上,DFlash实现最高6.08倍无损加速,平均4.86倍,远超EAGLE-3的1.76倍。在NVIDIA Blackwell GPU上,针对gpt-oss-120b模型,在固定交互性目标下吞吐量提升达15倍。DFlash使用仅5层的轻量草稿模型,避免了此前扩散方法使用7B草稿模型导致的瓶颈。代码和模型权重已开源,支持vLLM和Transformers后端。

#DFlash#推测解码#推理加速

往期存档