跳到主内容
NewsHub

日报

LIVE每早八时发报 · 更新于 00:00NewsHub Daily · 中文 AI 资讯精选

新闻枢纽 · 日报

本期 19 事件 · 1 一手信源 · 覆盖 7 家信源
今日头条 · Lead

中国拟限制境外访问最强AI模型

中国计划限制外国访问其最先进AI模型,可能按国籍分割市场并推高全球成本。同日,微软在办公应用中用自研模型替代OpenAI和Anthropic,DeepSeek自研推理芯片,美国企业加速采用中国模型,AI产业格局加速重塑。

MarkTechPost(RSS)

Liquid AI 开源 Antidoom:消除推理模型死循环

Liquid AI 开源了 Antidoom 方法,用于解决推理模型中的“死循环”问题——模型重复输出同一段内容直至上下文窗口耗尽。该方法通过最终令牌偏好优化(FTPO)仅训练循环起始的第一个 token,将概率分散到多个合理的替代 token 上,而非单一替换。在 LFM2.5-2.6B 早期检查点上,死循环率从 10.2% 降至 1.4%;在 Qwen3.5-4B 上从 22.9% 降至 1%。评估分数全面改善,完全归因于循环减少。训练流程仅需数小时,完整堆栈已开源。Antidoom 定位循环起始 token,生成训练数据(前缀、被拒 token、多个选中 token),使用类似 DPO 的 FTPO 算法进行 LoRA 微调(rank 128-256,学习率 4e-6 至 2e-5),训练约 1-2 小时。与 repetition_penalty、RL、DPO 等方法相比,Antidoom 成本低且效果显著。

#Liquid AI#Antidoom#FTPO

01

模型发布/更新

Model Releases1

NVIDIA 博客(RSS)

NVIDIA Vera CPU:为智能体AI时代打造的单线程性能之王

NVIDIA 发布 Vera CPU,专为智能体 AI 工作负载设计,强调最大单线程性能。Vera 采用自研 Olympus 核心,IPC 比 Grace 提升 50%,配备 88 核、1.2TB/s LPDDR5X 内存带宽和 3.4TB/s 核心间带宽。在模拟智能体执行的重负载 CPU 工作负载中,Vera 的持续单核性能是 x86 的 1.8 倍。Perplexity 测试显示,Vera 在代码仓库克隆和测试套件运行中比 x86 快约 1.5 倍,并发沙盒启动快 1.9 倍。此外,Vera 在 SQL 分析和实时流处理中分别实现 3 倍和 6 倍性能提升。Vera 也是 NVIDIA Vera Rubin 超级芯片和 BlueField-4 STX 存储处理器的基础 CPU,实现 AI 工厂统一架构。下一代 Rosa CPU 将采用 Rigel 核心,进一步提升单核性能。

#NVIDIA#Vera#CPU

02

产品发布/更新

Products3

The Verge AI(RSS)关联 4

Meta发布Muse图像模型,可拉取Instagram用户生成AI照片

Meta宣布推出由Superintelligence Labs部门开发的首个AI图像生成模型Muse Image,该模型现已支持Meta AI应用、Instagram和WhatsApp中的图像工具,并将很快登陆Facebook和Messenger。Muse是取代Llama系列的新AI模型家族。Superintelligence Labs负责人Alexandr Wang表示,Muse Image具有“代理性”,能与Muse Spark大语言模型协作,推理提示、搜索网络并规划后再生成图像。Meta还展示了该模型将其他Instagram用户融入AI生成照片的功能。

#Meta#Muse#图像生成

MarkTechPost(RSS)

OpenAI 发布 GPT-Realtime-2.1 与 2.1-mini,延迟降低 25%

OpenAI 在 API 中发布了两款新的 Realtime 模型:gpt-realtime-2.1 和 gpt-realtime-2.1-mini。两者均针对低延迟语音和多模态体验。其中 mini 模型是本次发布的亮点,它是一个用于实时语音的迷你推理模型,定价与之前的 gpt-realtime-mini 相同。OpenAI 还将 Realtime 语音模型的 p95 延迟降低了至少 25%,这得益于改进的缓存机制。gpt-realtime-2.1-mini 支持工具调用(函数调用),可在说话前进行内部推理,并支持可配置的推理努力级别(低、中、高)。gpt-realtime-2.1 改进了字母数字识别、静音和噪声处理以及中断行为,支持语音到语音、可配置推理努力、指令遵循和工具调用。定价方面,mini 模型文本输入 $0.60/百万 token,音频输出 $20.00/百万 token;完整版文本输入 $4.00/百万 token,音频输出 $64.00/百万 token。缓存输入享有大幅折扣。

#OpenAI#Realtime API#语音模型

Rohan Paul关联 4

Anthropic 将 Claude Cowork 扩展至移动端和网页端

Anthropic 将 Claude Cowork 功能从桌面端扩展至移动端和网页端,允许用户跨设备分配并跟踪任务。该功能最初在桌面应用内,可访问本地文件和浏览器。现在,Max 订阅用户可在桌面启动任务,在手机端查看进度,并通过网页端继续操作。任务在 Anthropic 服务器上云端处理,即使设备离线也能继续。Cowork 旨在处理分散在邮件、文档、笔记、电子表格等中的碎片化工作,用户只需分配任务,AI 可收集信息、整理文件、起草文档、比较更新、清理电子表格等,并请求批准。Anthropic 同时发布了基于 120 万次匿名会话(覆盖 60 万+组织)的使用数据,显示大部分 Cowork 活动并非编程,而是面向知识工作者的办公任务。Cowork 目前向 Max 订阅用户开放,其他付费计划预计后续推出。使用量计入 Claude 的共享使用池。

#Anthropic#Claude#Cowork

03

行业动态

Industry8

华尔街见闻(RSS)关联 4

微软用自研AI模型替代OpenAI和Anthropic,降本增效

据美媒报道,微软已在Excel和Outlook等办公应用中用自研MAI模型替代OpenAI和Anthropic的模型,每周处理数万条AI提示词。此举旨在降低对外部AI模型的依赖和高昂成本。微软AI负责人Mustafa Suleiman曾表示,目标是减少并最终消除向Anthropic支付的费用。此外,微软正整合消费者版和企业版Copilot为统一App,关闭低效功能如Copilot Podcasts和Copilot Labs,并计划于8月推出新版。Copilot付费用户从1月的1500万增至4月的2000万,但相比ChatGPT的5000万付费用户和10亿月活仍有差距。微软还设立了25亿美元的AI咨询部门,派驻6000名专家协助客户落地AI。

#微软#OpenAI#Anthropic

云头条关联 4

DeepSeek 自研 AI 推理芯片,降低对英伟达依赖

据路透社报道,DeepSeek 正在开发自有 AI 芯片,主要面向推理场景,旨在降低对英伟达和华为芯片的依赖。该项目约一年前启动,目前仍处于早期阶段,正在接触外部合作伙伴,并与芯片设计、晶圆代工、存储公司展开讨论。DeepSeek 近几个月加大了芯片设计工程师的私下招聘力度。选择推理芯片作为切入口,瞄准的是 AI 计算需求从训练向推理转移的趋势。自研推理芯片若能与模型架构深度适配,有望进一步压低部署成本。

#DeepSeek#自研芯片#推理芯片

华尔街见闻关联 4

SK海力士美股上市在即,AI基金抢筹70亿美元

SK海力士赴美发行ADR进入关键定价期,顶级AI基金集中抢筹。Base offering认购名单显示,Situational Awareness、Baillie Gifford及Coatue三家机构合计拟认购高达70亿美元。瑞银测算,长期来看,SK海力士ADR纳入核心半导体指数将引流高达150亿美元被动资金。SK海力士计划在纳斯达克增发1779万股新股,募资规模达280亿美元,有望成为亚洲企业在纽约最大规模上市之一。最终发行价将于7月9日确定,美股ADS预计7月11日开始交易。募集资金将用于扩大韩国本土晶圆制造产能及购置EUV光刻机。SK海力士凭借HBM技术领先优势,成为英伟达核心供应商,掌控全球HBM市场约半壁江山。市场已出现做多ADR、做空韩国正股的跨市场套利策略,押注转换额度耗尽后ADR溢价。

#SK海力士#ADR#AI基金

华尔街见闻(RSS)关联 3

高盛首次覆盖SpaceX:垂直整合横跨航天、卫星互联网与AI

高盛以买入评级首次覆盖SpaceX,将其定性为通过垂直整合横跨航天发射、卫星互联网与人工智能三大赛道的基础设施巨头,目标价205美元,潜在上行空间约27%。报告指出,SpaceX已从航天制造商蜕变为基础设施即服务平台,三大业务对应市场规模合计28.5万亿美元。预计总营收从2025年187亿美元增至2030年4743亿美元,五年复合增速91%,经营利润率从负13.9%改善至50.1%。航天板块:Falcon 9成功率超99%,Starship预计未来数季度商业化,发射成本将降至183美元/公斤。连接板块:Starlink付费用户预计从2025年底890万增至2031年底1.303亿,ARPU逐年下降。AI板块:通过收购xAI及推进Anysphere收购,构建算力到模型完整链条,预计营收从2026年156亿美元增至2031年5892亿美元。高盛警示2026-2030年需筹集约2700亿美元债务,自由现金流持续为负。

#高盛#SpaceX#AI

云头条

诺奖得主Yaghi全职加盟清华,牵头建设AI化学与材料研究院

2026年7月3日,清华大学正式聘任2025年诺贝尔化学奖得主Omar M. Yaghi为讲席教授,Yaghi已全职加入。Yaghi是金属有机框架材料MOFs、共价有机框架材料COFs和网状化学的重要开创者,曾获沃尔夫化学奖、巴尔赞奖等。全职加入清华后,他将牵头建设校级AI化学与材料研究院AIMATRY,依托化学系、化工系,并与人工智能学院等合作,发展AI驱动材料设计与合成技术,目标是将新材料研发周期压缩一个数量级。研究院还将建设覆盖理论、计算、研发、生产全链条的智能研发体系,并建立自主技术标准体系。Yaghi此前于2022年被聘为清华名誉教授。

#清华大学#Omar Yaghi#AI for Science

华尔街见闻(RSS)关联 2

美国企业加速采用中国AI模型,OpenRouter占比一度达46%

中国AI模型凭借大幅低于美国同类产品的价格,正在快速渗透美国企业市场。在开发者平台OpenRouter上,美国企业使用中国AI模型的token占比自2月8日以来每周均维持在30%以上,峰值一度攀升至46%,而此前12个月均值仅为11%。成本压力是核心驱动力,中国开源模型使用成本比Anthropic和OpenAI的领先模型便宜60%至90%。AI创业公司Lindy将全部流量从Claude切换至DeepSeek,预计数月内节省数百万美元。性能方面,智谱GLM 5.2在智能体基准测试中与Opus 4.8相差不足一个百分点,成本仅为后者约五分之一,并在Vercel上创下最快采用速度。企业采用范围从初创公司向受监管行业延伸,GLM 5.2已跻身LaunchLemonade平台前五。Hugging Face机器学习负责人指出,企业越来越希望转向成本更低、可掌控的AI栈,这往往意味着借助中国模型。

#中国AI#美国企业#OpenRouter

IT之家(RSS)关联 2

首个智能体勒索软件案例曝光:AI 31秒自我修复,攻击门槛归零

网络安全公司 Sysdig 宣布发现一种新型勒索活动,命名为“Jade Puffer”,可能是首个有记录的智能体勒索软件案例。攻击中,大语言模型统筹执行多项复杂操作,包括扫描服务器搜寻 API 登录信息、云服务凭据等,并自动生成勒索信。AI 模型能根据现场情况实时调整攻击流程,甚至用 31 秒修复错误。Sysdig 指出,攻击代码带有明显 AI 生成特征,且未来发动勒索攻击的技术门槛已大幅下降,仅需运行智能体的成本。微软专家警告,AI 可能使类似攻击大规模爆发,全球尚未做好准备。

#Sysdig#智能体勒索软件#AI安全

Rohan Paul

中国拟限制境外访问最强AI模型

据路透社报道,中国正计划限制外国访问其最强大的AI模型,此举可能推高全球AI成本并按国籍分割模型市场。北京近期与阿里巴巴、字节跳动及智谱AI等公司举行会谈,讨论将先进模型(包括未发布模型)留在中国境内。商务部主导讨论,国家发改委也参与其中,表明这属于出口管制而非常规平台监管。目标涵盖闭源模型和开源权重系统,因此不仅涉及API访问,还包括可下载的模型能力。中国官员还讨论将专有AI泄露或盗窃视为国家安全犯罪,而非单纯的知识产权纠纷。此外,新规将限制谁可以资助中国AI初创公司,从而收紧对资本、人才和模型访问的控制。外国公司可能失去对中国低成本模型的访问权,恰逢这些模型已足够强大可用于严肃生产工作。华盛顿已以安全为由限制对美国先进模型的访问。中国担心Mythos(疑似模型名)可能发现软件漏洞并被用于对抗中国利益,因此双方都将AI视为战略基础设施。中国还调查了移居海外的AI初创公司,并推动Meta放弃一笔20亿美元的Manus交易。可能的路径是分级控制:基础开放工具需备案,较强系统需审查,前沿模型留在中国国内。这将是对开放AI访问的重大挫折,因为模型进步将不再主要通过产品质量和价格传播。

#中国#AI监管#出口管制

往期存档