跳到主内容
NewsHub

日报

LIVE每早八时发报 · 更新于 00:00NewsHub Daily · 中文 AI 资讯精选

新闻枢纽 · 日报

本期 10 事件 · 覆盖 4 家信源
今日头条 · Lead

全球首个AI勒索行动曝光,全程自动入侵加密数据库

安全公司Sysdig披露了一起由大语言模型驱动的AI代理完成的勒索攻击,从入侵、侦察到加密数据库形成完整攻击链,无需人工干预。这标志着AI安全威胁从数据窃取升级为自主勒索,对防御体系提出全新挑战。

MarkTechPost(RSS)

NVIDIA 提出 ASPIRE 机器人框架,零样本长任务达 31%

NVIDIA 联合密歇根大学、UIUC、UC Berkeley 和 CMU 提出 ASPIRE(Agentic Skill Programming through Iterative Robot Exploration),一个持续学习的机器人编程框架。ASPIRE 采用协调器-执行器架构,通过逐原语多模态轨迹定位失败原因,将验证后的修复策略蒸馏为可复用的技能库,并利用进化搜索避免局部修复。在 LIBERO-Pro 上整体成功率 72%(基线 18%),零样本长任务 31%(基线约 4%);Robosuite 双手递物从 20% 提升至 92%;BEHAVIOR-1K 收音机拾取从 56% 升至 88%。模拟学到的技能可迁移至真实机器人,减少调试成本。

#NVIDIA#ASPIRE#机器人

01

模型发布/更新

Model Releases1

MarkTechPost(RSS)

NVIDIA HORIZON:硬件设计自主Agent,RTL基准100%完成

NVIDIA Research 推出 HORIZON,一个用于硬件设计的免干预 Agent 框架。它将硬件设计视为仓库级代码演化,通过结构化 Markdown 描述(包含目标、领域知识、评估器规范和验收谓词)生成项目包,然后由 Agent 在隔离的 Git 工作树中迭代编辑、运行评估器,仅当可执行验收门通过时才提交版本。在 ChipBench、RTLLM-2.0、Verilog-Eval 及 CVDP 等多个 RTL 基准套件上,HORIZON 均达到 100% 完成率(唯一缺失由规范缺陷导致)。首次迭代平均通过率为 47.8%,不同类别收敛迭代次数差异大(从 2 次到 82 次)。总 token 消耗约 2.1 亿,其中 91% 为缓存输入。研究团队明确指出,Agent 硬件设计尚未解决,token 效率是当前最需改进的指标。

#NVIDIA#HORIZON#硬件设计

02

产品发布/更新

Products2

DAIR.AI(RSS)关联 8

Claude Sonnet 5、Grok语音Agent构建器发布

本期AI Agents Weekly涵盖多项重要更新:Anthropic发布Claude Sonnet 5,具备更强的自主规划、工具使用和浏览器/终端操作能力,性能接近Opus 4.8,定价更低,已作为默认模型上线。xAI推出Grok Voice Agent Builder,无代码创建语音Agent,每分钟0.05美元。美团开源1.6T参数LongCat-2.0模型。X推出托管MCP服务器。Cursor发布iOS端始终在线Agent。Claude Science应用进入Beta测试。此外还有Google TabFM、Bridgewater专家判断模型、OpenAI GeneBench-Pro、NVIDIA 30B扩散模型拆分等研究动态。

#Anthropic#Claude Sonnet 5#xAI

MarkTechPost(RSS)关联 4

Anthropic 发布 Claude Science Beta:面向科学家的多智能体工作台

Anthropic 本周发布了 Claude Science 的 Beta 版本,这是一款面向科学家的 AI 工作台应用,基于现有的 Claude 模型运行,而非新模型。该应用针对需要处理数据库、笔记本和集群终端的研究人员,能够执行多步骤研究并记录每个结果的生成过程。Beta 版面向 Pro、Max、Team 和 Enterprise 计划用户。Claude Science 集成了研究人员最常用的工具和包,可分析文献、执行多步骤研究并生成详细产物,支持通过自然语言与一个通用协调智能体交互,该智能体可访问超过 60 个预配置的技能和连接器,覆盖基因组学、单细胞、蛋白质组学、结构生物学和化学信息学领域。应用可在 macOS 或 Linux 本地运行,也可通过 SSH 或 HPC 登录节点在远程机器上工作。每个输出都附带可审计的生成历史。多智能体架构包括一个通用协调智能体、可自建的专业智能体以及一个独立的审查智能体,后者在管道执行过程中逐步检查输出,标记不正确的引用、无法追踪的数字以及不匹配的图表,并进行自我修正。Claude Science 原生支持 3D 蛋白质结构、基因组浏览器轨迹、化学结构等可视化,并记录生成图表的确切代码、环境、描述和完整消息历史,以确保可重复性。计算方面,应用可在本地、HPC(SSH)或 Modal 上运行,从单 GPU 扩展到数百 GPU。领域覆盖方面,它整合了 UniProt、PDB、Ensembl 等 60 多个数据库,并使用了 NVIDIA BioNeMo Agent Toolkit 的技能,连接 Evo 2、Boltz-2 和 OpenFold3 等模型。Beta 用户已成功运行单细胞 RNA 测序分析、CRISPR 筛选设计、蛋白质结构预测和化学信息学任务。Claude Science 可通过 MCP 连接器扩展,并支持将现有管道保存为可复用的技能。

#Anthropic#Claude Science#科学工作台

03

行业动态

Industry6

云头条关联 2

全球首个AI勒索行动曝光:全程自动入侵加密数据库

安全公司Sysdig披露了一起名为JADEPUFFER的攻击行动,称其为首个已记录的“智能体勒索软件”案例。攻击由大语言模型驱动的AI代理完成,从入侵、侦察、凭证收集、横向移动,到接管配置服务、加密数据库和留下勒索信息,形成完整攻击链。入口为暴露在公网的Langflow实例,利用CVE-2025-3248代码注入漏洞(CVSS 9.8)获得初始访问。随后枚举系统信息、扫描环境变量和配置文件,重点寻找AI服务API Key、云凭据、加密货币钱包等。攻击目标转向一台运行MySQL和阿里巴巴Nacos配置服务的生产数据库服务器,通过root凭据连接MySQL,并利用Nacos旧认证绕过漏洞、默认JWT签名密钥伪造等方式植入后门。勒索阶段加密了1342条Nacos服务配置项,删除原始配置表,创建勒索表。攻击代码生成的加密密钥未保存,即使支付赎金也可能无法恢复数据。Sysdig给出多项证据支持AI代理驱动判断:载荷中出现大量自然语言注释,解释每一步目标、优先级和处理逻辑;攻击过程根据失败结果实时调整参数;捕获到600多个有明确目的的载荷,更像是模型连续推理和执行。攻击未使用特别新颖的技术,但AI代理将旧漏洞、默认配置、弱凭据等串成完整勒索行动。Sysdig此前曾披露另一起LLM代理驱动的入侵事件,而JADEPUFFER从数据窃取走向了数据库加密和勒索。

#AI安全#勒索软件#Sysdig

华尔街见闻关联 3

豆包、千问将下线智能体功能,监管与商业双重压力

7月4日,豆包和通义千问宣布智能体功能将下线。豆包确认智能体功能于7月15日下线,用户被引流至猫箱App;通义千问拟人化互动类及用户自建智能体功能于7月10日下线,7月15日彻底下线后无法访问相关配置及历史记录。下线日期恰逢《人工智能拟人化互动服务管理暂行办法》正式施行日,此前上海网信办已下架违规智能体1.4万余个。两家平台均提供数据保存过渡窗口,豆包建议用户备份并迁移至猫箱App。分析认为,除监管压力外,拟人化闲聊类智能体算力消耗高、商业价值低,商业化变现困境也是调整动因。通义千问已转向B端,向企业开放Agent与Skill接入权限。

#豆包#通义千问#智能体

Chubby♨️关联 2

微软将合并消费者与企业版Copilot,新增AI编码工具

据The Information报道,微软计划将消费者和企业版Copilot合并为一个统一应用,此前已削减用户未使用的功能。内部会议中,高管Jacob Andreou向员工透露,此次改造将增加AI编码工具、付费AutoPilot代理以及Copilot Cowork等附加功能,目标在8月推出统一Copilot体验。内部传达的措辞异常直白:“赢得并尊重在客户生活中存在的权利。”截至4月,Copilot付费用户达2000万,高于1月的1500万;但ChatGPT付费用户超过5000万,消费者触达更广。微软仍拥有企业分发优势,关键在于证明Copilot不仅仅是Office中又一个30美元/座的AI层。

#Microsoft#Copilot#AI办公

21世纪经济报道

多家银行披露Token消耗数据,日均百亿级

多家银行披露Token消耗数据:招商银行日均Token消耗量达330亿,成本收入比约20%;邮储银行日均调用超600万次,Token超百亿;微众银行日均Token从2亿跃升至超50亿;兴业银行、浦发银行、民生银行日均Token分别为41亿、60亿、40亿。银行AI投入从“买卡”转向“算账”,关注ROI。招商银行引入“AI贡献比”指标,从1:13.5提升至1:9,2025年实现1556万小时人工替代。银行普遍认为Token成本将逐年下降,长期AI仍是降本抓手。

#银行#Token#AI成本

21世纪经济报道

可灵AI获百度阿里腾讯等投资,估值或达1300亿元

快手旗下视频生成大模型可灵AI完成近30亿美元融资,投资方包括百度、阿里云、腾讯等互联网巨头,以及北京、上海、重庆、苏州等地国资和中东资本BlueFive、华策影视等。可灵AI 2025年营收约11亿元,净亏损19亿元,估值有望达1300亿元。融资背后,大厂基于算力与应用互补的考量,同时应对字节跳动Seedance的竞争。可灵AI已嵌入广告、电商、影视等场景,海外收入占比约70%,B端API占比约60%。公告显示,可灵AI签有上市对赌协议,若未在2031年10月30日前完成IPO,投资者有权要求回购。

#快手#可灵AI#融资

日经中文网

日本1万亿日元支持国产AI联盟,软银牵头

日本经济产业省6月30日宣布,选定以软银、本田、NEC和索尼为核心的联盟“Noetra”作为最高可获得1万亿日元支持的项目对象,用于开发日本国产AI基础模型。项目期限为2026年度开始的5年,2026年度委托费3873亿日元,2027年度后根据成果扩大支援。联盟企业将增至44家,包括制造业、金融、物流等。模型计划2027年前建成并开始服务,目标达到阿里千问等全球主流大模型同等性能,但追赶中美最先进模型仍非易事。研发重点聚焦“物理AI”,利用日本制造业现场数据驱动机械和机器人。模型将作为开源型对外开放,政府统一管理知识产权,并补贴算力基础设施建设。日本意在摆脱对美依赖,构建AI领域“第三极”。

#日本#软银#AI基础模型

往期存档