跳到主内容
NewsHub

日报

LIVE每早八时发报 · 更新于 00:00NewsHub Daily · 中文 AI 资讯精选

新闻枢纽 · 日报

本期 9 事件 · 覆盖 4 家信源
今日头条 · Lead

美国科技企业转向中国AI模型,Coinbase采用GLM与Kimi

美国科技企业悄然转向中国开源AI模型,Coinbase将GLM 5.2和Kimi 2.7设为默认模型,AI成本减半。与此同时,BIS警告万亿美元AI资本支出或引发泡沫,谷歌对Meta实施Gemini算力上限,苹果因AI服务器需求导致内存涨价申请从中国长鑫存储采购DRAM。中国开源模型在IDOR检测等任务上超越Claude Code,性价比优势凸显。

云头条

GLM-5.2 在 IDOR 检测中 F1 39% 超过 Claude Code 32%

Semgrep 使用同一套 IDOR 漏洞检测数据集和提示词测试多款模型,结果显示智谱 AI 的开放权重模型 GLM-5.2 在无端点发现、上下文筛选等专用脚手架支持的情况下,F1 分数达到 39%,超过 Claude Code 的 32%,且每发现一个漏洞成本约 0.17 美元。GLM-5.2 是 MoE 模型,总参数约 7500 亿,每 token 激活约 400 亿,上下文扩展至 100 万 token,在 Terminal-Bench 2.1 得分 81.0,SWE-bench Pro 得分 62.1。Semgrep 的多模态流水线(含 harness)F1 为 53%-61%,仍领先。实验表明,harness 比模型本身更重要,但开放权重模型已跨过值得关注的门槛。

#智谱AI#GLM-5.2#IDOR检测

01

模型发布/更新

Model Releases1

Rohan Paul

Owl Alpha 实为美团 LongCat-2.0-Preview,1.6T 参数 MoE

据消息,OpenRouter 上增长最快的 Agent 模型“Owl Alpha”实际上是美团 LongCat-2.0-Preview。该模型采用 1.6T 参数的 MoE 架构,激活参数约 48B,动态激活范围 33B-56B,原生支持 1M token 上下文窗口。Owl Alpha 已在 OpenRouter 上低调测试近两个月,成为全球使用量最高的 Agent 模型之一。OpenRouter 数据显示,该模型在 Hermes Agent 中排名第一,在 Claude Code 中排名第二,在 OpenClaw 中排名第三;月处理 token 量达 10.1T,日处理 559B,月增长 242%。

#OpenRouter#美团#LongCat-2.0

02

产品发布/更新

Products2

宝玉

Anthropic 发布 Claude Tag,Slack 内 @Claude 派活

Anthropic 上周以 beta 形式面向 Team 和 Enterprise 用户发布 Claude Tag,允许团队在 Slack 频道中 @Claude 并指派任务。Claude 可访问配置好的频道、工具、数据源和代码库,在后台拆解执行后通过线程回复结果。Andrej Karpathy 称这是 LLM 交互的第三次重大重新设计,从网站到桌面应用再到持久异步的团队实体。Gergely Orosz 指出,真正突破在于云端 AI 接入公司内部系统,Slack 只是入口,背后是云端执行环境、持久记忆、工具集成和组织级权限。该功能对已配本地环境的工程师吸引力有限,但能帮助新员工、非工程师和不熟悉代码库的开发者。Claude Tag 面临 GitHub Copilot、OpenAI Codex 和 Salesforce 的竞争,其差异化在于频道级共享身份、持久记忆和异步执行,但集成难度是兑现愿景的关键。

#Anthropic#Claude Tag#Slack

IT之家(RSS)

特斯拉Cybercab救援指南披露L4自动驾驶等多项技术细节

特斯拉发布了Cybercab应急救援人员操作指南,披露了多项技术实锤信息。指南明确将Cybercab的自动驾驶系统归类为SAE 4级,车辆在限定运行设计域内可全程独立完成全部动态驾驶任务,无需人类介入。量产营运版通常不配备方向盘、刹车踏板和加速踏板,而工程测试车为SAE 2级。指南还透露了车辆外观标识、安全配置(如10个以上安全气囊、主动式引擎盖)、应急通信与断电拉环、充电口位置、运行设计域(涵盖公共道路、私人道路等)、全天候运行能力(轻中度降水可运行,极端天气靠边停车)等细节。Cybercab配备外部麦克风和扬声器,可响应急救人员手势信号,并支持临时地理围栏。

#特斯拉#Cybercab#L4自动驾驶

03

行业动态

Industry5

华尔街见闻(RSS)

BIS警告AI泡沫:万亿美元资本支出或引发漫长崩盘

国际清算银行(BIS)在年度经济报告中警告,科技巨头主导的AI投资热潮可能演变为“漫长投资崩盘”,动摇全球金融市场并损害世界经济。报告指出,全球五大超大规模云计算企业预计2025-2026年资本支出合计超1万亿美元,若实际回报不及预期,投资者可能迅速收紧融资,导致资本支出繁荣急转直下,演变为持久投资萧条。BIS援引1830年代运河热、1840年代铁路热及1990年代末互联网泡沫等历史先例,认为真实技术突破同样可能催生泡沫。当前家庭股票敞口扩大,股市调整影响面更广;AI公司大规模债务融资也放大系统性风险。此外,美伊战争及霍尔木兹海峡通道关闭引发的能源冲击尚未充分消退,通胀影响已显现,与AI泡沫风险共同构成全球经济多重威胁。

#BIS#AI泡沫#资本支出

Rohan Paul关联 4

苹果因AI服务器需求致内存涨价,申请从中国长鑫存储采购DRAM

据英国《金融时报》报道,苹果公司正向美国政府申请许可,从被列入黑名单的中国供应商长鑫存储(CXMT)采购DRAM芯片。原因是AI服务器需求激增导致普通设备内存价格大幅上涨。DRAM是iPhone、Mac和iPad中的短期工作内存,而HBM是用于AI加速器的堆叠式更快内存,AI基础设施建设正在将工厂产能从消费设备转向服务器。苹果主要依赖美光、三星和SK海力士,而长鑫存储可提供来自中国国家支持的更廉价供应。但长鑫存储被美国国防部列入中国军事公司名单,这本身不阻止苹果采购,但表明国家安全担忧,若被商务部加入实体清单则后果更严重。苹果市值已蒸发2630亿美元,部分原因是内存成本压力迫使MacBook和iPad涨价。

#苹果#长鑫存储#DRAM

华尔街见闻(RSS)关联 2

谷歌对Meta实施Gemini算力上限,内部项目受阻

据知情人士透露,谷歌约于今年3月告知Meta,无法满足其全部Gemini算力需求,并对这家社交媒体巨头实施了使用上限,至今仍未解除,导致Meta多个内部AI项目遭到干扰和延误。受此影响,Meta已要求员工提高AI算力使用效率,在内部推行对AI token的精打细算。谷歌与Meta均拒绝就此置评。这一局面迫使谷歌加快扩容步伐,本月与SpaceX签订每月9.2亿美元的算力租赁协议。Meta并非孤例,其他谷歌企业客户同样受到程度不一的限制。Meta正加快向自研模型迁移,近期已开始优先推广其新推出的Muse Spark模型。

#谷歌#Meta#Gemini

上海证券报关联 3

SpaceX获FTC批准收购光通信公司Mesh

据美国联邦贸易委员会(FTC)最新文件,马斯克已获得收购Mesh Optical Technologies的反垄断审批许可。Mesh由前SpaceX工程师创立,为AI数据中心开发光学网络技术,利用光在服务器间传输数据,旨在提高能效、降低延迟。该技术将满足AI算力集群数百万光连接需求,并有助于SpaceX的轨道数据中心计划。Mesh今年2月获Thrive Capital领投超5000万美元融资。SpaceX在收购xAI后,AI算力成为重要业务板块,已部署全球最大AI训练集群COLOSSUS和COLOSSUS II,合计约1GW算力。接下来Colossus II将追加超400 MW算力,新增超22万颗GB300芯片。SpaceX已与Anthropic、谷歌等签署算力合作协议,直接与亚马逊云、微软Azure等竞争。分析认为,FTC许可表明该机构不会以竞争为由质疑交易,但交易尚未完成交割。

#SpaceX#Mesh Optical Technologies#光通信

华尔街见闻(RSS)

美国科技企业转向中国AI模型,Coinbase采用GLM与Kimi

美国科技企业正悄然将中国开源AI模型纳入生产基础设施。Coinbase首席执行官Brian Armstrong在X平台发文称,公司已将智谱GLM 5.2和月之暗面Kimi 2.7通过内部LLM网关设为工程师的默认模型。结合路由优化与缓存改进,AI支出削减近一半,而token使用量仍指数增长。Armstrong指出,91%的工程师未触及原有使用上限,因此转向更便宜的默认模型,而非降低上限。对于复杂任务,工程师仍可选用前沿模型。代码审查采用多模型并行策略,相互校验输出。成本削减手段包括:智能路由(根据缓存命中率和定价自动分发任务)、积极缓存(缓存命中率从5%升至60%)、精简上下文(减少浪费的token)。Armstrong强调,此举旨在扩大AI采用规模,而非限制使用,工程师仍可自由使用任意模型和token,但用量与业务影响挂钩。

#Coinbase#智谱#月之暗面

往期存档