跳到主内容
NewsHub

日报

LIVE每早八时发报 · 更新于 00:00NewsHub Daily · 中文 AI 资讯精选

新闻枢纽 · 日报

本期 15 事件 · 覆盖 8 家信源
今日头条 · Lead

智谱市值破万亿,开源模型逼近闭源前沿

智谱股价突破万亿港元,其开源模型GLM-5.2在编程基准上超越GPT-5.5,距Anthropic Opus 4.8仅差1个百分点,开源与闭源差距缩至约6.8个月。同期Anthropic旗舰模型因出口管制被关闭,凸显闭源模型可获得性风险。

Interconnects(RSS)关联 3

GLM-5.2 发布:开源智能体能力跃迁

Z.ai 于 6 月 13 日向 GLM Coding Plan 会员发布 GLM-5.2 模型,6 月 16 日公开 MIT 许可权重与技术博客。该模型在 Arena 智能体排行榜上成为唯一能与 OpenAI 和 Anthropic 最新模型竞争的开源模型,在 Design Arena 上甚至超越 Claude Fable。社区反馈积极,多位知名 AI 评论员和研究员给予高度评价。GLM-5.2 在编码工具链中作为通用智能体表现出色,是首个达到此水平的开源模型。其发布距 Claude Opus 4.5 仅 204 天,将开源与闭源模型的能力差距缩短至约 6.8 个月。该模型对开源推理服务商(如 Fireworks、Together)构成重大利好,并可能对 Anthropic 等闭源厂商形成定价压力。

#Z.ai#GLM-5.2#开源模型

01

模型发布/更新

Model Releases4

华尔街见闻(RSS)关联 3

日本AI实验室Sakana推出编排模型Fugu,超越Claude和GPT-5.5

日本AI实验室Sakana推出颠覆性编排框架模型Fugu,通过协调多个前沿模型而非暴力扩参,在SWE-Bench Pro测试中得分73.7,超越Claude Opus 4.8的69.2和GPT-5.5的58.6。Fugu作为动态调度器,通过单次API调用将任务路由至最适配模型并行处理,整合输出优于任何单一模型。同时,AI服务器租赁成本持续走低,高盛分析师Rich Privorotsky认为这挑战了算力稀缺性叙事。智谱GLM-5.2在FrontierSWE基准上得分74.4,接近Anthropic Opus 4.8的75.1,定价低72%-82%,开源与闭源差距收窄。

#Sakana#Fugu#模型编排

IT之家(RSS)

百川发布医疗增强大模型M4,多项评测超越GPT-5.5

百川智能与清华大学联合发布新一代医疗增强大模型 Baichuan-M4。该模型在 OpenAI 提出的医疗评测 HealthBench 上综合得分 68.6,位列世界第一,领先第二名 GPT-5.5 超过 10 分;在 Hard 子集上领先 15.9 分。M4 采用 OSCE 方法构建动态问诊评测体系 SCAN-bench,初诊 79.0、复诊 74.7,均领先 GPT-5.5 等模型。模型具备全病程记忆能力,长上下文临床记忆评测得分 86.9,较上一代提升 21.1 分。首创证据锚定,循证引用精度达 90.0,远超 GPT-5.5 的 54.7。模型已覆盖 200 余种疾病的临床路径单元。

#百川智能#医疗大模型#Baichuan-M4

IT之家(RSS)

京东开源实时视频视觉语言交互模型 JoyAI-VL-Interaction

京东宣布开源实时视频视觉语言交互模型 JoyAI-VL-Interaction,这是全球首个全栈开源的 interaction 模型和系统,获得 vLLM-Omni 的 day-0 原生支持。该模型能持续观察视频流,自主判断何时响应,支持实时视频输入(摄像头、直播流、监控流等)和语音输入输出,具备后台任务委派能力,可调用其他大模型或 Agent 处理复杂任务。在 58 个真人盲评案例中,对比豆包视频通话助手胜率 77.6%,对比 Gemini 视频通话助手胜率 87.9%。代码、模型和数据集已开源。

#京东#开源#实时视频

MarkTechPost(RSS)

MoonMath AI 开源 AMD MI300X 注意力内核,全面超越 AITER v3

MoonMath AI 团队开源了一个针对 AMD MI300X GPU 的 bf16 前向注意力内核,采用 HIP 编写(非手写汇编),基于 MIT 许可。该内核在测试的所有形状和舍入模式下均超越 AMD 官方优化内核 AITER v3,几何平均加速比达 1.08×-1.18×,最高 1.26×。核心技巧包括:使用单指令 asm 包装器让编译器分配寄存器而开发者控制操作码;将 K 矩阵放入 LDS、V 矩阵常驻 L1、Q 和累加器放入寄存器。该内核已通过 PR 集成到 SGLang 中,在 Wan2.1 视频扩散模型上实现 1.23× 端到端加速,无质量损失。内核仅支持 MI300X(gfx942),固定头维度 128,无因果掩码、GQA 或变长批处理。

#MoonMath AI#AMD#MI300X

03

行业动态

Industry8

华尔街见闻(RSS)关联 2

智谱市值破万亿港元,GLM-5.2开源模型性能逼近闭源前沿

本周一,港股智谱盘中总市值突破1万亿港元,年内涨幅超1900%。中国开源大模型GLM-5.2发布,在FrontierSWE编程基准上得分74.4,与Anthropic Opus 4.8的75.1仅差约1个百分点,超越GPT-5.5的72.6,成为评分最高的开源权重模型。GLM-5.2参数规模753B,采用MoE架构,支持1M token上下文窗口,以MIT协议开源。定价较Opus 4.8低72%-82%,但较前代GLM-5.1实际涨价。几乎同时,Anthropic旗舰模型Fable 5和Mythos 5因美国商务部出口管制被关闭全球访问权限,引发闭源模型可获得性风险担忧。市场呈现替代性交易特征,资金集中涌入中国资产,而非恐慌式清仓。摩根大通将行情定性为替代交易,认为前沿能力升级仍可支撑溢价。

#智谱#GLM-5.2#Anthropic

Rohan Paul关联 3

SpaceX与AI创企Reflection达成每月1.5亿美元算力租赁协议

据CNBC报道,SpaceX与开源AI初创公司Reflection达成一项算力租赁协议。Reflection将从2026年7月起,以每月1.5亿美元的价格租用英伟达GB300 GPU集群,若协议持续至2029年,总支付额将达约63亿美元。协议可在首三个月后由任何一方提前90天通知取消。SpaceX正像云服务商一样出售其GPU容量,利用Colossus数据中心为外部客户提供基础设施。Reflection的商业模式是B2B/B2G前沿开放权重AI:构建强大模型,然后向政府、国家实验室和企业销售访问、定制和受控部署服务。Reflection需要SpaceX的GB300集群来训练前沿级基础模型,并针对科学和国家安全客户进行适配。Anthropic切断对Fable和Mythos的访问,使Reflection的销售论点更加有力:关键AI客户不应将核心工作流建立在可被供应商撤销、更改或限制的封闭模型上。

#SpaceX#Reflection#算力租赁

MIT Technology Review AI(RSS)

Anthropic与政府最新冲突:三个值得关注的问题

Anthropic 开发了名为 Mythos 的 AI 模型,因其出色的代码能力被认为可能构成全球网络安全威胁。公司向少数网络安全专家开放访问后,于6月9日发布了更安全的修改版 Fable。联邦政府随后以国家安全为由对 Fable 实施出口管制,Anthropic 数小时内撤回了两个模型的访问权限。亚马逊 CEO Andy Jassy 向政府通报了 Fable 的危险性(亚马逊同时投资 Anthropic 并开发竞争模型)。此举引发连锁反应:欧洲政客呼吁加强本土 AI 建设,但中国开源模型(如智谱)因低成本、无限制而更具吸引力;网络安全专家警告切断模型访问可能削弱防御能力;美国立法者面临压力,需明确 AI 监管规则。白宫对 AI 态度反复,从特朗普时期的放松管制到如今两次将 Anthropic 列为国家安全风险。

#Anthropic#政府监管#出口管制

Chubby♨️

五眼联盟警告:前沿AI数月内将大幅升级网络攻击

五眼联盟(Five Eyes)网络安全机构警告称,能够大幅升级针对政府和企业的网络攻击的前沿AI模型可能只需数月而非数年即可实现。该警告发布之际,美国已阻止外国公民访问Anthropic的Fable模型,担心Mythos和Fable等系统可能改变进攻性和防御性网络安全。五眼联盟机构表示:“前沿AI模型预计将超出当前行业预期,从根本上改变进攻和防御网络能力。时间线不是数年,而是数月。”

#五眼联盟#AI安全#网络攻击

Latent Space(RSS)

Gray Swan 联合创始人谈 AI 红队测试与安全新范式

本期 Latent Space 播客邀请 Gray Swan 联合创始人 Zico Kolter(OpenAI 董事会安全委员会成员)和 Matt Fredrikson(CMU 教授)深入探讨 AI 安全。他们指出 AI 系统与传统软件存在本质差异,需要全新的安全思维。重点讨论了提示注入(prompt injection)作为 Agent 的新漏洞类别,以及自动化红队工具 Shade(Anthropic 用于评估编码环境鲁棒性)如何超越人类发现模型弱点。Gray Swan 还推出了 Cygnal 护栏产品和全球最大 AI 红队竞技场。嘉宾认为,随着 Agent 和计算机使用(computer-use)的普及,AI 安全将成为保险与合规的一部分,而首次重大提示注入攻击可能不可避免。

#Gray Swan#AI安全#红队测试

华尔街见闻(RSS)

谷歌股价大跌超7%,AI人才流失加剧

谷歌股价周一大幅下挫,一度下跌7.2%,创下自2月以来最大盘中跌幅。此前,Google DeepMind副总裁、2024年诺贝尔奖得主John Jumper宣布离职加入Anthropic。这是继上周知名研究员Noam Shazeer转投OpenAI后,谷歌再次流失AI领军人物。Jumper是谷歌AI编程开发团队核心成员,其离职正值谷歌在AI编程工具推广方面遭遇困难,而Anthropic和OpenAI在该领域增长强劲。分析人士指出,OpenAI和Anthropic正成为美国AI前沿领域的主导公司,与谷歌、Meta和xAI的差距逐渐拉大。

#谷歌#Anthropic#OpenAI

IT之家(RSS)

欧洲启动史上最大规模AI超算建设,35台英伟达HPC惠及超300万研究人员

英伟达宣布欧洲启动有史以来最大规模年度超算扩建,35台AI HPC超级计算机正式建设,覆盖国家级超算中心、AI工厂和高校科研机构。建成后,超过300万研究人员将获得下一代算力基础设施,用于气候科学、医疗、清洁能源、量子计算等领域。所有系统采用英伟达全栈AI基础设施,包括GB300 NVL72、GB200 NVL4等系统,以及Quantum InfiniBand网络、CUDA-X库、NIM微服务和AI Enterprise软件。具体项目包括巴塞罗那超算中心AI工厂(训练20 EFLOPS,推理33 EFLOPS)、BavariaAI Blue Swan(训练11 EFLOPS,推理22 EFLOPS)、IT4LIA(训练82 EFLOPS,推理164 EFLOPS)、HammerHAI(训练8 EFLOPS,推理15 EFLOPS)和Mimer AI工厂(训练4 EFLOPS,推理7 EFLOPS)。自去年以来,欧洲已部署或宣布部署800 EFLOPS AI算力。

#英伟达#欧洲#超算

05

技巧与观点

Tips2

meng shao

现代浏览器内部机制全面指南:Chromium/Gecko/WebKit 对比

Addy Osmani 发布深度文章,面向 Web 开发者全面解析现代浏览器内部机制,以 Chromium 为主线,对照 Gecko (Firefox) 与 WebKit (Safari)。内容涵盖页面加载完整管线、V8 JavaScript 引擎内部、模块加载与 Import Maps、多进程架构与安全、三大引擎对比,以及面向开发者的实践要点,包括优化网络、结构化 HTML/CSS、批量 DOM 更新、合成友好动画、警惕长任务、拥抱安全特性、善用 DevTools 等。

#浏览器#Chromium#V8

meng shao

前Meta/微软主任工程师的Agentic工程工作流

前Meta/Microsoft/Atlassian主任工程师Kun Chen Gui分享了一套高效的Agentic工程工作流,核心原则是“你是船长,agent是你的船员”。工作流分为四层:终端中心主义(全终端工作,工具栈为WezTerm+tmux+Neovim)、船员入职培训(通过Memory和Skills让agent学习偏好,Memory需精简,Skills避免无谓token消耗)、与单个船员协作(语音输入使用OpenSuperWhisper,AXI标准优化工具效率,Lavish交互式规划工件)、并行指挥(treehouse管理worktree,First Mate元agent自动拆分子任务)。验证环节采用no-mistakes流水线,在隔离worktree中执行对抗式review和E2E测试,避免逐diff审查成为瓶颈。长时间运行通过good-night-have-fun机制设置停止条件。工作流强调时间分配:开头澄清需求、结尾质量把关,中间全交给AI。

#Agentic工程#工作流#Kun Chen Gui

往期存档