跳到主内容
NewsHub

日报

LIVE每早八时发报 · 更新于 00:00NewsHub Daily · 中文 AI 资讯精选

新闻枢纽 · 日报

本期 21 事件 · 1 一手信源 · 覆盖 7 家信源
今日头条 · Lead

Anthropic Fable 5回归,Meta进军云计算

Anthropic修复安全漏洞后重新部署Claude Fable 5,并联合科技巨头制定越狱评估框架。Meta筹划进军云计算,出售过剩AI算力,挑战算力稀缺叙事。同时,AI价格下降刺激需求激增,杰文斯悖论再现,企业AI支出转向成本控制。

MarkTechPost(RSS)

Anthropic 重新部署 Claude Fable 5,新增安全分类器

Anthropic 于 7 月 1 日重新部署其最强通用模型 Claude Fable 5,此前美国出口管制已解除。该模型与 Claude Mythos 5 于 6 月 12 日因政府指令暂停,原因是 Amazon 研究人员发现了一种绕过 Fable 5 安全防护的方法,可诱导模型识别软件漏洞并生成利用代码。Anthropic 测试表明,该漏洞并非 Fable 5 独有,其他模型如 Claude Opus 4.8、GPT-5.5 等也能复现。为修复问题,Anthropic 训练了改进的安全分类器,可阻止超过 99% 的特定技术,被阻止的请求将路由至 Claude Opus 4.8 而非直接拒绝。此外,Anthropic 正与 Amazon、Microsoft、Google 等合作起草行业通用的越狱严重性评分框架,基于能力增益、广度、武器化难易度和可发现性四个维度。Fable 5 定价为每百万输入 token 10 美元、输出 token 50 美元,支持 Claude 平台、API、Claude Code 等。

#Anthropic#Claude Fable 5#模型发布

01

模型发布/更新

Model Releases2

Avi Chawla

谷歌与Anthropic在检索架构上达成共识:独立服务化

谷歌和Anthropic在检索架构上达成一致:将检索从应用中剥离,转变为智能体调用的独立服务。Anthropic的MCP将检索作为工具暴露给智能体;谷歌的RAG Engine同样作为Gemini智能体平台下的独立服务。传统RAG将检索内嵌于单一应用,导致嵌入陈旧(索引与源数据漂移)和基础设施耦合(不同应用重复构建连接器、分块和嵌入)。新架构通过持续摄入(基于内容哈希同步,仅重新嵌入变更数据)和统一API解耦了摄入与查询,使聊天机器人和智能体共享同一索引。智能体在循环中调用检索层:推理、搜索、读取结果、优化查询。然而,检索单元仍是文本块,缺乏语义边界、版本和来源信息,可能截断表格或论点。作者同事提出结构化单元方案,将原始块替换为携带来源和版本的结构化块,使语料库缩小40倍,向量相关性提升2.3倍。

#Google#Anthropic#RAG

MarkTechPost(RSS)

英伟达开源Nemotron-Labs-TwoTower扩散语言模型

英伟达发布Nemotron-Labs-TwoTower,一种基于预训练自回归骨干的扩散语言模型,采用开放权重(NVIDIA Nemotron Open Model License)。该模型将文本生成中的去噪任务分离为两个塔:冻结的自回归上下文塔和训练过的去噪塔。在2×H100 GPU上,以默认配置(γ=0.8, S=16)实现2.42倍生成吞吐量,同时保留自回归基线98.7%的聚合质量。去噪塔基于约2.1T tokens训练,骨干网络使用25T tokens。模型支持扩散、模拟自回归和自回归三种解码模式。总参数量约60B,每token激活参数约3B每塔。在MMLU、ARC-Challenge等基准测试中,通用知识保持接近基线,代码和数学任务略有下降。

#NVIDIA#Nemotron#扩散语言模型

02

产品发布/更新

Products2

华尔街见闻(RSS)

Anthropic Claude Fable 5 重新上线 GitHub Copilot

美东时间7月1日,GitHub 宣布 Anthropic 旗下 Mythos 模型系列的首款产品 Claude Fable 5 已在 GitHub Copilot 中重新启用并全面上线。该模型专为长周期自主编程设计,能够理解庞大代码库上下文并自主执行多步骤编程任务。此前,因安全审查,该模型于6月12日被下架。此次重新上线标志着 Anthropic 完成安全修复,并确立 GitHub Copilot 作为其核心分发渠道,旨在加速复杂知识工作任务的商业化。

#Anthropic#GitHub Copilot#Claude Fable 5

量子位(RSS)

英伟达开源机器人技能库,Jim Fan称范式变了

英伟达开源了一个机器人技能库,旨在推动具身智能领域的持续学习。该技能库包含多种预训练技能,支持机器人通过持续学习不断积累新能力。英伟达科学家Jim Fan表示,这一开源举措改变了机器人学习的范式,使得机器人能够像人类一样逐步掌握复杂技能。该技能库的发布为具身智能研究提供了重要基础资源。

#英伟达#具身智能#机器人技能库

03

行业动态

Industry8

Anthropic Newsroom(web_list)关联 9

Anthropic 恢复 Fable 5 全球访问,出口管制解除

6月12日,美国政府因一份亚马逊研究人员报告(发现Fable 5安全防护可被绕过,模型识别了软件漏洞并生成利用代码)对Anthropic最新模型Claude Fable 5和Mythos 5实施出口管制,要求限制外国国民访问。Anthropic立即暂停了两款模型的访问。6月30日,出口管制解除。Fable 5将于7月1日起面向全球用户恢复,在Claude平台、Claude.ai、Claude Code和Claude Cowork上可用。Pro、Max、Team及部分Enterprise计划用户可在7月7日前每周使用最多50%的配额,之后通过使用积分访问。AWS、Google Cloud和Microsoft Foundry的访问将尽快恢复。Mythos 5已根据6月26日政府批准恢复对部分美国组织开放,Anthropic正与政府协调扩大Glasswing项目合作伙伴的访问权限。Anthropic还改进了安全分类器,针对报告中的绕过方法实现了99%以上的拦截率,并联合亚马逊、微软、谷歌等Glasswing合作伙伴制定行业统一的越狱评估框架,同时深化与美国政府在预发布测试、信息共享和研究方面的合作。

#Anthropic#Claude#出口管制

数字生命卡兹克关联 3

Anthropic在Claude Code中植入隐写术识别中国用户

近日,大量中国Claude用户遭遇封号。有开发者逆向Claude Code后发现,Anthropic在其中植入了隐蔽的检测机制:通过读取本地时区(如Asia/Shanghai)和ANTHROPIC_BASE_URL环境变量(与内置的147个域名列表比对),判断用户是否来自中国。检测结果通过隐写术嵌入系统提示词中——将单引号替换为特定Unicode字符、日期分隔符改为斜杠——随请求发送至服务器,从而在不暴露额外数据的情况下标记中国用户。该行为引发社区强烈质疑,认为其违背了软件透明原则。

#Anthropic#Claude Code#隐私

华尔街见闻(RSS)关联 3

Meta筹划进军云计算市场,出售富余AI算力

据彭博社援引知情人士消息,Meta正筹划进军云计算基础设施市场,计划通过出售其过剩的AI计算能力和模型访问权限,将庞大的AI基础设施投资转化为新的创收渠道。Meta正在制定一项全新的云业务计划,旨在向外部客户出售计算资源,直接与亚马逊AWS、微软Azure和谷歌云等巨头竞争。潜在计划包括类似AWS Bedrock的服务,允许开发者访问Meta自有的Muse Spark等模型,以及出售原始计算能力。该计划由Meta基础设施主管Santosh Janardhan、AI部门高管Daniel Gross和总裁Dina Powell McCormick共同领导。Meta发言人拒绝置评,相关计划仍在制定中。消息公布后,Meta股价盘前涨逾5%,而亚马逊、微软、英伟达等股价承压。高盛分析师警告,算力稀缺叙事面临挑战,算力供应增加和租赁价格走低可能冲击硬件领域。

#Meta#云计算#AI算力

云头条关联 2

硅基流动冲刺港股上市,阿里华为押注AI推理平台

北京硅基流动科技股份有限公司于2026年6月30日在港交所递交上市申请。公司成立于2023年8月,定位为开放、独立的Token供应平台,连接算力资源、AI模型与下游应用,提供公有云服务和本地部署解决方案。截至2026年4月,平台注册用户超1000万,日均词元吞吐量约5785亿次,服务超1.3万家企业客户,支持超170个模型。财务方面,2025年收入5533万元,同比增长653.2%,但销售成本达6863.2万元,导致毛损1330.2万元,毛利率为-24.0%。2023年至2025年净亏损分别为1222.3万元、8191.5万元和3.45亿元。公司已完成七轮融资,投后估值达77.4亿元,投资方包括阿里巴巴、华为哈勃、智谱、美团等。2026年6月,硅基流动收购OneFlow知识产权组合,以增强AI基础设施技术能力。

#硅基流动#IPO#AI推理

云头条

字节跳动巴西建1GW算力中心,投资2650亿元

据Bloomberg报道,字节跳动已选定巴西东北部Ceará州Pecém港区的出口加工区建设大型数据中心园区,规划容量最高接近1GW,总投资约390亿美元(2650亿元人民币)。项目由Pátria支持的Omnia平台参与开发,能源侧由Casa dos Ventos提供风电支持,双方已签署20年、约20亿美元的供电协议。一期IT负载目标约200MW,初期运营预计2027年启动。项目将服务TikTok本地业务及海外算力需求,但面临环境、原住民权益和数据安全方面的质疑。TikTok巴西表示该设施仅服务TikTok应用,不用于其他字节跳动产品或AI训练,且不服务巴西、美国、欧洲或中国市场。

#字节跳动#数据中心#算力

华尔街见闻(RSS)

AI越便宜,芯片越贵:杰文斯悖论再现

6月30日,Anthropic发布Claude Sonnet 5,中端模型在SWE-bench Pro上得分63.2,接近旗舰Opus 4.8的69.2,GPQA-AAA v2上甚至反超。优惠期内定价为输入2美元/百万token、输出10美元,仅为Opus 4.8的40%-60%,性能却达九成以上。自2022年以来,GPT-4级别API成本下降约1000倍,但全球企业生成式AI支出从2024年的115亿美元飙升至2025年的370亿美元,增长320%。Uber、AT&T等企业token消耗量激增,存储芯片价格一年内上涨六倍。高盛预测2026-2031年全球AI基础设施累计资本支出约7.6万亿美元。这一现象呼应杰文斯悖论:效率提升反而刺激需求增长,算力需求不降反升。

#Anthropic#Claude Sonnet 5#AI成本

华尔街见闻(RSS)

Meta筹划进军云计算,AI基础设施股重挫

据报道,Meta计划进军云基础设施市场,通过新成立的“Meta Compute”组织,出售其数千亿美元投资下过剩的AI算力与模型访问权限。此举挑战了市场“算力稀缺”的底层叙事,拖累英伟达等硬件同行周三盘前走低。高盛指出,市场逻辑正转向奖励削减资本支出的企业,恐导致硬体资本支出周期反身性停滞。AI基础设施股重挫,盘中闪迪、CoreWeave跌超10%,市场开始担心算力过剩。

#Meta#云计算#AI算力

Rohan Paul

UBS:约60%大企业放缓AI支出,转向成本控制

瑞银报告指出,约60%的大企业正在放缓AI支出。CFO和CTO高度关注不断上升的账单,而投资回报率仍不均衡。高管们正在增加护栏、削减工具并强制实施更严格的使用规则。企业AI正从试验阶段转向工程预算问题,新纪律是在不损害输出质量的前提下将任务路由到更便宜的模型。这一转变可能首先给OpenAI和Anthropic带来压力,因为其基于使用量的收入依赖规模。开源和中国模型可能在需要成本控制而非峰值推理的任务中占据份额。上周摩根大通研究显示,中国AI模型每token成本比美国模型低50倍。报告称,到2026年4月,中国公司在AI聚合平台OpenRouter上的流量占比从2024年底的不到2%升至超过45%。谷歌已推出Gemini 3.5 Flash作为更快、更注重效率的模型。Anthropic的Claude Sonnet 5也迎合了买家对能力强、成本低的自主性的需求。

#UBS#企业AI#成本控制

04

论文研究

Research1
05

技巧与观点

Tips2

meng shao

吴恩达详解AI产品成功的三个循环

吴恩达提出AI产品成功取决于三个循环:第一层Agentic coding loop,AI根据规格自动写代码、测试、修bug,实现工程执行自动化;第二层Developer feedback loop,开发者角色上移至产品判断、体验设计,利用上下文优势校准方向;第三层External feedback loop,通过用户测试、A/B测试、数据分析等获取真实反馈。三个循环速度不同,共同驱动产品迭代。

#吴恩达#AI产品#循环工程

meng shao

如何编写高质量AI Skill:可预测工作流指南

来自知名工程师 Matt Pocock 的 Skill 编写指南,强调 Skill 的核心目标是实现过程可预测,而非知识库或提示词堆叠。指南区分了模型自动触发(model-invoked)和用户触发(user-invoked)两种 Skill,指出 description 应作为触发条件而非简介。提出三层信息结构:主步骤、参考、外部文件,实现渐进式披露。强调每个步骤需有明确完成标准以防止过早完成。建议通过拆分 Skill 控制模型注意力,并引入 leading word 概念压缩行为要求。还总结了常见失败模式:过早完成、重复、沉积、扩散、无操作。

#Skill编写#最佳实践#工作流设计

往期存档