跳到主内容
NewsHub

日报

LIVE每早八时发报 · 更新于 00:00NewsHub Daily · 中文 AI 资讯精选

新闻枢纽 · 日报

本期 21 事件 · 1 一手信源 · 覆盖 7 家信源
今日头条 · Lead

GPT-5.6获准全面部署,美国AI审批松动

今日,OpenAI旗舰模型GPT-5.6获得美国监管部门批准全面商业化部署,标志美国前沿AI审批制首次松动。同时,SpaceXAI宣布Grok 4.5明日公开发布,中国AI模型使用量在Anthropic暂停期间迅猛增长。全球AI竞争格局正在重塑。

Elon Musk关联 5

Grok 4.5 明日公开发布,性能对标 Opus

Elon Musk 宣布,基于 Beta 测试客户的积极反馈,SpaceXAI 将于明日公开发布 Grok 4.5。该模型为 Opus 级别,但速度更快、token 效率更高且成本更低。

#SpaceXAI#Grok#模型发布

01

模型发布/更新

Model Releases7

MarkTechPost(RSS)关联 2

蚂蚁集团开源 LingBot-Vision:1B 参数边界感知视觉基础模型

蚂蚁集团旗下具身智能公司 Robbyant 开源了 LingBot-Vision,这是一系列自监督 Vision Transformer,专为密集空间感知设计。模型权重以 Apache-2.0 协议发布在 Hugging Face 上,提供 ViT-giant、large、base、small 四种尺寸,并附带技术报告和推理代码。LingBot-Vision 将边界作为原生预训练信号,而非下游输出。旗舰模型 ViT-g/16 约 1.1B 参数,采用名为掩码边界建模的新目标函数,在约 1.61 亿张图像上训练(从 20 亿网络池中筛选),无需人工标注、外部边缘检测器或预训练骨干。训练数据量比 DINOv3 的 LVD-1689M 小一个数量级,训练样本不到 DINOv3 的三分之一。在密集空间任务上,1B 模型匹配或超越 7B DINOv3 等大 7 倍的模型。例如,NYU-Depth v2 上 RMSE 0.296(7B DINOv3 为 0.309),KITTI 上为 2B 以下参数最佳。语义分割与 DINOv3 ViT-H+ 相当,视频目标分割 DAVIS-2017 达 70.0 J&F。图像级识别略逊,ImageNet-1K 线性探针 86.32。蒸馏后的 ViT-L(0.3B)在 NYUv2 深度上匹配 7B DINOv3。

#蚂蚁集团#Robbyant#LingBot-Vision

云头条关联 3

MiniMax 将开源 2.7 万亿参数大模型

据 The Information 报道,MiniMax 正在开发一款 2.7 万亿参数的新一代大语言模型,内部代号 M3 Pro,规模超过目前国内所有大模型。该模型最快于 2026 年第三季度发布,并计划开源。MiniMax 强调其重点在于更强的 Agent 执行能力和复杂任务拆解能力,而非仅堆叠上下文长度、多模态或代码能力。参数规模上,2.7 万亿总参数显著高于国内主流开源模型,如 DeepSeek-V3(6710 亿总参数)、阿里 Qwen3 最大 MoE 版(2350 亿总参数)和月之暗面 Kimi K2(1 万亿总参数)。消息公布后,MiniMax 股价有所波动。

#MiniMax#模型发布#开源

华尔街见闻(RSS)关联 2

SpaceX与Cursor最快本周三发布联合AI模型

据The Information获得的内部备忘录,SpaceX旗下AI部门SpaceXAI与编程工具公司Cursor计划最快于本周三联合发布首款共同研发的AI模型,直接挑战Anthropic和OpenAI。该模型此前因效率优化而推迟发布,预计具备快速信息处理能力,在某些指标上可与Opus 4.8及GPT-5.5抗衡。模型从零开始在xAI的Colossus数据中心训练,体现了算力整合能力。此次发布正值SpaceX以600亿美元全股票收购Cursor的交易推进中,标志着马斯克旗下AI版图加速整合。若模型性能获市场验证,将进一步强化SpaceX在AI编程工具赛道的竞争地位。

#SpaceX#Cursor#AI模型

IT之家(RSS)

蚂蚁灵波开源新一代具身基座模型 LingBot-VLA 2.0

蚂蚁集团旗下蚂蚁灵波科技正式开源新一代具身基座模型 LingBot-VLA 2.0,相比 1.0 版本在构型泛化、自由度支持和落地效率上显著提升。模型基于 6 万小时高质量数据训练,覆盖 17 个品牌 20 种机器人构型,支持单臂/双臂、双足/轮式等多种形态,并扩展了头部、腰部、末端执行器及底盘自由度。在 GM-100 评测中,LingBot-VLA 2.0 在双臂操作和移动操作任务上均领先于 π0.5 与 GR00T N1.7。后训练版本推理耗时在 RTX 4090 上低于 130 毫秒。目前已在零售、物流、工业等场景开启商业落地测试,并与乐聚、钛虎等本体厂商及国大药房等客户合作。模型权重已开源至 Hugging Face 和魔搭社区。

#蚂蚁灵波#LingBot-VLA 2.0#具身智能

MarkTechPost(RSS)

英伟达发布统一音频文本LLM Audex 30B,保留文本智能

英伟达发布 Audex(Nemotron-Labs-Audex-30B-A3B),一个统一的音频文本大语言模型,能理解和生成音频与语音,同时保留其骨干模型的文本智能。该模型为30B总参数、3B激活参数的MoE Transformer解码器,基于Nemotron-Cascade-2-30B-A3B文本MoE LLM。音频输入编码后投影到文本嵌入空间,文本和量化音频令牌统一处理,支持指令模式和思考模式,上下文长度达100万令牌。训练采用多阶段SFT和文本仅Cascade RL,避免多模态文本退化。在文本基准上,MMLU-Redux得分86.4(骨干86.3),IMO AnswerBench 81.1(骨干79.3)。语音识别OpenASR词错误率6.82,优于Step-Audio-R1.1-33B和Qwen3-Omni-30B-A3B-Thinking。音频理解在MMAU上领先,但在MMAR和MMSU上落后。模型权重以非商业许可发布,同时提供较小的Audex-2B版本。

#NVIDIA#Audex#音频文本LLM

华尔街见闻(RSS)

7月AI大模型密集发布:GPT-5.6、Grok 4.5、Gemini 3.5 Pro、DeepSeek V4

7月全球AI大模型进入密集发布期。OpenAI旗舰模型GPT-5.6 Sol将于本周四发布,搭载ultra多智能体模式与max推理强度,定价每百万Token输入5美元、输出30美元,初期仅向部分合作伙伴开放。马斯克旗下SpaceX AI宣布Grok 4.5将于明日向公众开放,基于1.5万亿参数V9模型,性能接近Claude Opus,并与Cursor联合研发新模型。谷歌Gemini 3.5 Pro将于7月17日上线,采用全新预训练底座,前端与视觉代码能力跃升,但推理仍落后对手。国内DeepSeek V4正式版计划7月中旬上线,同步引入峰谷定价策略(高峰时段价格翻倍),并联合北大发布推理加速框架DSpark,开源全栈推测性解码工具链DeepSpec,V4-Flash生成速度提升60%-85%。

#OpenAI#SpaceX AI#Google

OpenAI News(RSS)

OpenAI 推出 GPT-Live 语音模型

OpenAI 发布新一代语音模型 GPT-Live,用于实现更自然的人机交互,目前已在 ChatGPT Voice 中应用。该模型旨在提升语音对话的流畅性和真实感,支持更自然的对话节奏、情感表达和实时响应。

#OpenAI#GPT-Live#语音模型

02

产品发布/更新

Products2

MarkTechPost(RSS)关联 5

OpenAI 发布全双工语音模型 GPT-Live,推理委托给 GPT-5.5

OpenAI 今日发布新一代语音模型 GPT-Live,采用全双工架构,可同时进行听与说,支持打断、暂停、续接等自然交互。首批推出 GPT-Live-1 和 GPT-Live-1 mini 两个版本,即日起向全球 ChatGPT 用户开放。GPT-Live 将需要搜索、推理等深度任务委托给后台的 GPT-5.5 处理,同时保持对话流畅。在人类评估中,GPT-Live-1 和 mini 在愉悦度和对话流畅性上显著优于 Advanced Voice Mode。自动基准测试显示,GPT-Live-1 在 GPQA、BrowseComp 等任务上也有提升。API 计划稍后推出。视频、屏幕共享和多语言功能暂未上线。

#OpenAI#GPT-Live#语音模型

小互

Cloudflare 推出 AI 自动收费网关,按次向 Agent 收费

Cloudflare 宣布推出 Monetization Gateway,允许网站、API 和 AI 工具对 AI Agent 的访问按次收费,而非传统订阅制。当 AI Agent 请求内容时,系统会提示付款并报价,Agent 自动扣款后携带凭证再次请求,验证通过即可访问。支付基于 x402 开放协议,使用 USDC 等稳定币结算,官方称一秒内到账,验证由 Cloudflare 全球 330+ 城市服务器就近完成。此举旨在解决 AI Agent 大量爬取网页内容但无法通过广告或订阅变现的问题。

#Cloudflare#AI Agent#收费网关

03

行业动态

Industry8

云头条关联 5

微软用自研MAI模型替换GPT、Claude,先在Excel和Outlook落地

据《彭博社》报道,微软正开始在部分软件产品中用自研AI模型替代OpenAI和Anthropic的模型,包括Excel和Outlook。微软自研的MAI模型目前已在Excel和Outlook中每周处理数万条AI提示词请求,此前这些任务主要依赖外部模型。微软并非彻底切断合作,而是先在高频、成本敏感的办公场景切换模型,以降低对外部供应商的依赖。成本是核心原因之一,微软每天在Copilot等产品中消耗大量token,虽因长期合作可从OpenAI获得折扣,但内部正为价格优势可能变化做准备。微软AI负责人Mustafa Suleyman今年6月已表示,正增加MAI模型使用以减少对Anthropic的支出,目标是降低并最终消除这部分成本。微软自研模型体系也在快速补齐,6月2日发布7款MAI模型,覆盖推理、代码、图像、语音和转录等方向。其中旗舰推理模型MAI-Thinking-1在盲测中优于Claude Sonnet 4.6,拥有350亿活跃参数和256K上下文窗口;MAI-Code-1-Flash已深度集成进GitHub Copilot、VS Code。微软称,调优后的MAI模型在Excel场景中效果接近GPT 5.4,效率最高提升10倍。

#微软#MAI#OpenAI

华尔街见闻(RSS)关联 2

OpenAI获准全面部署GPT-5.6,美国前沿AI审批制松动

OpenAI 旗舰模型 GPT-5.6 获得美国监管部门正式批准,从受限发布阶段转向全面商业化部署。此前,GPT-5.6 系列仅向约 20 家可信合作伙伴开放有限预览,OpenAI 曾公开表达不满。此次放行标志着美国政府针对前沿 AI 模型的逐案审批机制首次出现实质性松动,OpenAI 成为该监管框架下首个完成全过程的案例。旗舰模型 Sol 将于本周四上线,提供 Ultra 多智能体模式和 Max 推理强度版本,API 定价为输入每百万 Token 5 美元、输出每百万 Token 30 美元,约为 Anthropic Claude Fable 5 的一半。在 Terminal-Bench 2.1 编码基准测试中,Sol Ultra 得分 91.9%,Sol 标准版 88.8%,均高于 Claude Mythos 5 的 88.0%。OpenAI 计划本月将 Sol 部署至 Cerebras 硬件平台,推理速度预计达每秒 750 Token。此次获批是否意味着美国将形成固定审查流程,仍有待观察。

#OpenAI#GPT-5.6#监管

华尔街见闻(RSS)关联 4

SK海力士美国IPO获七倍超额认购,募资规模或达245亿美元

SK海力士在美国的IPO获得强劲市场反响,据彭博社援引知情人士消息,其美国存托凭证(ADR)认购倍数已超过七倍。认购需求来自全球长线基金、科技行业专项基金、主权财富基金及亚洲主题全球投资者等机构,其中Baillie Gifford、Coatue Management和Situational Awareness Partners已表达合计高达70亿美元的认购意向。此次发行规模约合245亿美元,将成为外国公司赴美上市史上第二大交易,仅次于阿里巴巴2014年的250亿美元纪录。发行涉及1.779亿份ADR,每份ADR对应十分之一普通股,主承销商包括美国银行、花旗集团、高盛和摩根大通。ADR预计将于周五在纳斯达克以代码SKHYV启动预发行交易,7月13日正式交易后代码变更为SKHY。SK海力士近期股价承压,较6月下旬高点累计回调约30%。

#SK海力士#IPO#美国上市

华尔街见闻

Momenta港股上市,成物理AI第一股

7月8日,Momenta在港交所挂牌上市,股票代码6880.HK,成为港股“物理AI第一股”。公司已量产智驾系统搭载超过100万辆车,交付车型超100款,客户覆盖20多家车企,进入全球前十大车企中的9家供应链。2023年至2025年,收入从7.43亿元增至24.13亿元,复合增速超80%;毛利率从17.5%提升至71.6%。公开发售获约414倍超额认购,国际配售获超1000亿港元机构订单,若超额配股权全部行使,募资总额约68亿港元。Momenta CEO曹旭东表示,公司通过量产车获取真实世界数据,驱动模型迭代,并计划将能力延伸至Robovan、Robotruck、Robotaxi及更广泛的物理AI市场。

#Momenta#IPO#物理AI

TechCrunch AI(RSS)

AI芯片公司SambaNova获11亿美元融资,估值110亿

AI芯片制造商SambaNova在最新一轮融资中筹集了10亿美元,估值达到110亿美元。此次融资距离上一轮大规模融资仅过去5个月,且此前有传闻称英特尔曾试图以约16亿美元收购该公司。SambaNova专注于开发用于AI训练和推理的专用芯片及系统,本轮融资将用于扩大产能和研发。

#SambaNova#融资#AI芯片

小互

特朗普政府解除OpenAI GPT-5.6限制

据AXIOS报道,特朗普政府已解除对OpenAI的GPT-5.6模型的限制,美国商务部批准OpenAI可以广泛推出其先进的GPT-5.6模型。此举意味着该模型此前可能受到出口管制或安全审查,如今获得官方放行,将面向更广泛用户开放。

#OpenAI#GPT-5.6#政策监管

云头条

美国国会调查Airbnb和Cursor使用中国AI模型

2026年7月8日,据CNBC报道,美国众议院国土安全委员会和美中战略竞争特别委员会联合调查Airbnb和Anysphere(Cursor母公司),审查其使用中国AI模型可能带来的数据安全、内容审查和供应链风险。调查对象包括DeepSeek、阿里巴巴、月之暗面(Kimi)、MiniMax等中国公司的开源或开放权重模型。Airbnb因客服系统使用阿里Qwen模型被关注,Cursor则因Composer 2基于Kimi模型被调查。委员会要求公司说明使用原因、与中国供应商的沟通情况,并安排员工参加闭门简报。报道指出,限制中国AI模型在美国企业中的使用面临挑战,因其开源特性已在全球开发者社区流通。

#美国国会#Airbnb#Cursor

日经中文网

中国AI趁美国Anthropic模型暂停快速崛起

据日本经济新闻获取的OpenRouter数据,2025年初中国AI使用量不足美国AI一半,但2月后多次反超,6月使用量迅猛增长,6月底一周中国AI总调用量达25万亿token,比5月底翻倍,高出美国78%。美国Anthropic按政府指示暂停提供先进AI“Mythos”期间,越来越多美国企业改用中国AI。中国AI多为开源型,费用仅为Mythos的二十分之一。Coinbase等企业已大量使用智谱的GLM和月之暗面的Kimi。6月中旬问世的GLM-5.2在约9000道测试题中排名第5。6月市场份额DeepSeek以19%居首,Z.AI、小米等中国企业份额增长,谷歌、OpenAI下滑。美国方面对蒸馏等问题表示担忧,Anthropic指控阿里巴巴进行有组织蒸馏。

#中美AI竞争#开源模型#GLM

05

技巧与观点

Tips1

meng shao

Claude官方分享两种多智能体模式:Advisor与Orchestrator

Claude开发者官方分享了团队内部高频使用的两种经典多智能体模式:Advisor(顾问)模式和Orchestrator(编排者)模式,旨在发挥Fable 5最高价值并降低成本。Advisor模式中,Sonnet 5作为执行者运行主循环,遇到高层判断时通过tool call调用Fable 5获取建议,Fable 5调用频率低(约一次/任务)。在SWE-bench Pro测试中,Sonnet 5 + Fable advisor达到约84%准确率,成本约$1.40,相比Fable 5单独(91.5%,$2.25)实现了92%性能但仅需63%价格。Orchestrator模式中,Fable 5作为编排者进行规划,将任务扇出给多个Sonnet 5 worker执行。在BrowseComp测试中,Fable 5 lead + Sonnet 5 workers达到86.8%准确率,成本$18.53,相比Fable 5单独(90.8%,$40.56)实现了96%性能但仅需46%价格。两种模式分别适用于单任务高层纠偏和可并行批处理场景。

#Claude#多智能体#Advisor模式

往期存档