跳到主内容
NewsHub

日报

LIVE每早八时发报 · 更新于 00:07NewsHub Daily · 中文 AI 资讯精选

新闻枢纽 · 日报

本期 15 事件 · 8 一手信源 · 覆盖 10 家信源
今日头条 · Lead

Anthropic发布最强模型后紧急暂停

Anthropic发布了突破性的Claude Fable 5与Mythos 5模型,在多项测试中达到最先进水平,并在网络安全和自主科研上展现惊人能力。然而仅三天后,Anthropic突然宣布暂停访问以修复问题。这一事件凸显了前沿AI能力与安全风险之间的紧张博弈。

Anthropic Newsroom(web_list)关联 10

Anthropic发布Claude Fable 5与Mythos 5模型

Anthropic于2026年6月9日发布Claude Fable 5和Claude Mythos 5模型。Fable 5是Mythos级别的安全通用模型,在软件工程、知识工作、视觉、科学研究等基准测试中达到最先进水平,定价为每百万输入token 10美元、每百万输出token 50美元,低于Mythos Preview。Mythos 5是同一基础模型但解除部分安全限制的版本,通过Project Glasswing与美国政府合作部署,具备全球最强的网络安全能力。Anthropic表示,Fable 5在Stripe的5000万行Ruby代码库中一天内完成原本需团队两个月的迁移;在Hebbia金融基准测试中得分最高;视觉能力可仅凭截图重建Web应用源码;在Slay the Spire游戏中,持久记忆能力使其表现提升三倍。Mythos 5在蛋白质设计、分子生物学假设、基因组学研究中展现自主科研能力。但6月12日,Anthropic宣布暂停对Fable 5和Mythos 5的访问,以修复问题并尽快恢复。

01

模型发布/更新

Model Releases3

NVIDIA 博客(RSS)关联 5

NVIDIA加速Google DeepMind DiffusionGemma,本地AI文本生成快4倍

Google DeepMind 发布 DiffusionGemma,一种实验性开放模型,采用扩散方式并行生成文本,而非传统的逐 token 自回归生成。该模型基于 Gemma 4 的 260 亿参数混合专家架构,每步仅激活 38 亿参数,可同时去噪最多 256 个 token。NVIDIA 对其进行了优化,使其在 GeForce RTX GPU、RTX PRO 平台和 DGX Spark 系统上运行更快。在单块 H100 GPU 上可达 1000 tokens/s,DGX Spark 上 150 tokens/s,DGX Station 上最高 2000 tokens/s,约为同等自回归模型的 4 倍。模型以 Apache 2.0 许可证开放权重,支持 Hugging Face Transformers、vLLM 和 Unsloth,可本地运行,无需云端或按 token 付费。

Hugging Face 每日论文(json_list)

MiniMax 提出稀疏注意力 MSA,百万上下文加速 14 倍

MiniMax 提出 MiniMax Sparse Attention (MSA),一种基于分组查询注意力 (GQA) 的块级稀疏注意力机制。MSA 通过轻量级索引分支对键值块进行评分,并为每个 GQA 组独立选择 Top-k 子集,实现组特定的稀疏检索;主分支仅对所选块执行精确的块稀疏注意力。MSA 与 GPU 执行路径协同设计,使用无指数 Top-k 选择和 KV 外部稀疏注意力来改善张量核心利用率。在 109B 参数的多模态模型上,MSA 在 1M 上下文下将每 token 注意力计算量减少 28.4 倍,在 H800 上实现 14.2 倍预填充和 7.6 倍解码加速。推理内核已开源,基于 MSA 的多模态模型 MiniMax-M3 已公开发布。

Google DeepMind 博客(RSS)

DiffusionGemma:文本生成速度提升4倍

Google DeepMind 发布 DiffusionGemma,一种基于扩散模型的新型文本生成模型,在保持生成质量的同时,将文本生成速度提升至传统自回归模型的4倍。该模型采用非自回归架构,通过迭代去噪过程并行生成文本,显著降低了推理延迟。实验表明,在多个基准测试中,DiffusionGemma 在速度与质量之间取得了良好平衡,尤其适用于需要低延迟的实时应用场景。

03

行业动态

Industry8

Anthropic Newsroom(web_list)

Anthropic完成650亿美元H轮融资,估值9650亿

Anthropic宣布完成650亿美元的H轮融资,公司估值达到9650亿美元。本轮融资由多家知名投资机构参与,资金将用于加速AI模型研发、扩大计算基础设施及全球市场拓展。此次融资是AI领域迄今最大规模之一,凸显市场对前沿AI安全与能力的持续信心。

ElevenLabs 博客(web_list)

ElevenLabs 完成5亿美元D轮融资,估值110亿美元

ElevenLabs 宣布完成5亿美元D轮融资,由 Sequoia Capital 领投,Andreessen Horowitz 和 ICONIQ 等跟投,估值达110亿美元,较一年前增长超过3倍。公司2025年ARR超3.3亿美元,企业客户包括 Deutsche Telekom、Square、乌克兰政府和 Revolut 等。资金将用于强化 ElevenAgents 企业语音对话平台,升级语音代理的响应速度和表现力,并扩展情感对话模型、配音和音频通用智能研究。同时,公司将在全球多个城市设立本地化团队,推动企业采用。

Ars Technica AI(RSS)

德国法院裁定谷歌对AI概览虚假陈述负责

德国慕尼黑法院裁定,谷歌需为其AI概览(AI Overviews)中的虚假陈述承担法律责任。该案源于两家出版商发现谷歌的AI概览错误地将它们与诈骗等不当商业行为关联,并做出肯定性陈述,如“是的,[它]以可疑商业行为闻名,常被视为骗局”。谷歌在收到停止函后未纠正误导性输出。法院驳回了谷歌关于用户理解AI输出需验证的辩护,指出“没有人需要AI来搜索互联网”。此裁决可能影响所有AI搜索引擎和聊天机器人,要求它们对来源链接的转述准确性负责。

The Verge AI(RSS)

微软因数据保留问题内部限制Claude Fable 5

Anthropic 昨日发布了其首个 Mythos 级 AI 模型 Claude Fable 5,但已引发微软内部的担忧。据 The Verge 报道,由于 Anthropic 新的数据保留要求,微软正在限制员工使用 Claude Fable 5。虽然微软已迅速将该模型部署到 GitHub Copilot 和 Foundry 客户中,但内部员工使用的 GitHub Copilot 版本中并未提供该模型。其他 Claude 模型因遵循零数据保留规则,仍可在微软内部使用。

IT之家(RSS)

OpenAI 明年内上市,GPT-5.6 模型即将发布

据 The Information 报道,OpenAI CEO 萨姆·奥尔特曼在致员工内部邮件中预估公司将在“明年内”上市,但具体时间表具有灵活性。此前 OpenAI 已于 6 月 8 日秘密提交 IPO 申请。奥尔特曼表示,技术发展速度可能影响 IPO 时机,尤其是递归自我改进(RSI)的可能性,若 RSI 起飞速度越快,推迟 IPO 越有利。同时,OpenAI 正在洽谈租赁俄亥俄州一座 10 吉瓦数据中心园区,可能需要英伟达资金支持。此外,内部消息透露 OpenAI 正准备推出一款代号为 5.6 的全新 AI 模型,首席科学家 Jakub Pachocki 称该模型将比 GPT-5.5 有“显著改进”。

Gary Marcus(RSS)

德国里程碑判决:谷歌须为AI幻觉承担法律责任

德国法院作出里程碑式判决,认定谷歌的AI概览(AI Overviews)内容属于谷歌自身言论,因此谷歌需对AI生成的错误答案承担法律责任。这一判决可能对生成式AI行业产生深远影响,尤其是如果其他国家效仿类似裁决。该判决由Gary Marcus在其Substack中引用并评论,认为这可能成为AI责任认定的重要先例。

Gary Marcus(RSS)

Gary Marcus:OpenAI 或成 AI 界 WeWork,银行拒收其股权抵押

Gary Marcus 在 Substack 发文,引用与《大空头》原型 Steve Eisman 的访谈,分析 AI 泡沫破裂的可能路径。他指出,OpenAI 烧钱最快、信任度下降,Anthropic 和 Google 正在抢占市场。近期两大信号:一是 tokenmaxxing 模式终结,LLM 提供商无法继续提供不限量服务,客户也不愿按 token 付费,导致收入承压;二是软银试图以 OpenAI 股权为抵押获取 60 亿美元保证金贷款,遭银行拒绝,软银股价下跌 9%。Marcus 认为,银行不认可 OpenAI 当前估值,若其 IPO 受阻或被迫降低估值,将无法履行约 6000 亿美元的义务,进而冲击英伟达、甲骨文等关联公司,甚至波及银行体系和退休计划。他重申 OpenAI 可能成为“AI 界的 WeWork”。

Anthropic Newsroom(web_list)

Anthropic发布AI网络威胁年度分析报告

Anthropic发布年度分析报告,基于2025年3月至2026年3月间832个因恶意网络活动被封禁的账户,映射到MITRE ATT&CK框架。主要结论:恶意行为者使用AI使其更危险,尤其在攻击后期阶段;网络攻击日益自主化,传统风险区分方法失效;MITRE ATT&CK框架未能完全捕捉AI赋能攻击者的危险行为。报告发现,67.3%的账户使用AI编写恶意软件,6.5%使用AI进行横向移动。攻击者使用AI从初始访问转向内部活动,AI辅助账户发现上升8.9%,钓鱼下降8.6%。高风险攻击者设计架构使模型能自主链式执行攻击阶段。Anthropic已部署网络防护措施,并与MITRE讨论框架演进。

04

论文研究

Research1

The Decoder(RSS)

Anthropic研究:AI数小时内即可从安全补丁构建漏洞利用

Anthropic安全团队研究发现,其Mythos Preview AI模型能在数小时内将Firefox和Windows内核的安全补丁转化为可工作的漏洞利用代码,成本仅需数千美元,且无需专业知识。在微软自动更新到达任何设备之前,该模型已完成8条完整的攻击链。Anthropic认为,传统的补丁节奏已经过时。

往期存档