跳到主内容
NewsHub

日报

LIVE每早八时发报 · 更新于 00:00NewsHub Daily · 中文 AI 资讯精选

新闻枢纽 · 日报

本期 14 事件 · 覆盖 5 家信源
今日头条 · Lead

AMD发布MI455X:2nm工艺432GB HBM4

今日AMD发布基于2nm工艺、432GB HBM4的AI加速器MI455X,晶体管达3200亿,性能超越英伟达Rubin。Anthropic用Claude一个周末自动完成AMD芯片适配,标志CUDA护城河加速瓦解。谷歌Q2自由现金流首次转负,资本开支翻倍至449亿美元,AI投资激烈。行业聚焦AGI与持续学习,模型蒸馏争议再起。

18:29IT之家(RSS)关联 2

AMD 发布 MI455X:2nm 工艺、432GB HBM4

在 Advancing AI 2026 大会上,AMD CEO 苏姿丰公布下一代 AI 加速器 Instinct MI455X 细节。该 GPU 采用台积电 2nm GAA 工艺(XCD 部分)与 N3P 工艺(FCD/I/O Die),拥有 3200 亿晶体管,配备 4 个 XCD 和 2 个 FCD,通过混合键合和 CoWoS-L 封装。内存搭载 12 堆栈 HBM4,容量 432GB,带宽 23.3 TB/s,远超英伟达 Rubin 的 288GB/22 TB/s。CDNA 5 架构引入工作组处理器(WGP),波前宽度改为 32 位,缓存重构为 192MB 共享 L2。

#AMD#MI455X#AI加速器

01

模型发布/更新

Model Releases1

15:43歸藏(guizang.ai)

Black Forest Labs 发布并开源 Flux 3 视频生成模型

Black Forest Labs 发布并开源 Flux 3 视频生成模型,功能包括:文生视频、图生视频(图片作为参考或起始帧)、基于参考片段的视频生成、视频与音频延长、关键帧控制、多语言对话与多样化排版、智能剪辑、文字与动画生成、图像输出。模型为 Flux 3 Dev,目前需申请早期访问,未来几周开放 API,之后开源。

#Black Forest Labs#Flux 3#视频生成

02

产品发布/更新

Products3

01:39meng shao

Cursor推出Router:智能路由模型,成本降30-60%

Cursor团队基于60万+条真实请求训练分类器,推出Cursor Router,可根据查询内容、上下文、任务复杂度、领域自动选择模型,在保持前沿模型质量的同时降低成本30-60%。Intelligence模式满意度接近Fable,成本低约60%;Balance模式满意度高于Opus 4.8,成本低约36%。单次commit成本Intelligence为$6.76、Balance为$4.63,对比Fable 5的$12.69和Opus 4.8的$7.34。企业客户节省30-50%且质量无下降。产品面向Teams/Enterprise,支持管理员分级管控。

#Cursor#模型路由#成本优化

19:31MarkTechPost(RSS)

吴恩达发布开源桌面AI助手OpenWorker,交付成品而非对话

吴恩达宣布推出OpenWorker,一个开源、本地优先的桌面AI助手,旨在交付成品(如文档、Slack回复、日历更新)而非聊天。其架构分为四层:Tauri 2 + React 18桌面壳、基于FastAPI和uvicorn的本地代理服务器、能力与连接器层(本地工具、托管集成、MCP)、模型路由器(支持OpenAI、Anthropic、Google等30种模型,可自带密钥或本地Ollama)。权限引擎将工具调用分为四类风险(读、写本地、执行、外部),提供五种权限模式。隐私方面,模型调用直连提供商,对话、令牌和密钥均本地存储,仅OAuth握手可选云组件。项目采用MIT许可证,代码已开源。

#Andrew Ng#OpenWorker#开源

04:09Rohan Paul

研究者用GPT-5.6 Sol五天解决6个埃尔德什难题

一位研究者使用GPT-5.6 Sol在5天内解决了6个开放的埃尔德什问题。他共尝试了13个问题,成功率约46%。其提示词采用类似合同的形式,明确陈述问题、证明必须建立的内容、不接受的较弱结果,并预先列出已知陷阱和边界情况。他指示模型同时探索多种方法、保留不兼容的路径、不提前承诺,并寻找反例以淘汰无效路线。独立的对抗性代理随后尝试攻破每个存活的草稿。研究者选择数学家已有争议的问题,避免与著名猜想直接相关。Codex在数小时内保持整个搜索过程。

#GPT-5.6 Sol#数学推理#提示词工程

03

行业动态

Industry8

01:24华尔街见闻关联 6

谷歌自由现金流首次转负,上调资本开支至2050亿美元

7月22日谷歌公布二季度财报:营收1198亿美元,同比增长24%;资本开支449亿美元,主要用于AI基础设施,导致自由现金流转负至-59亿美元,为上市以来首次。公司上调2026年资本开支指引至1950-2050亿美元。Google Cloud收入247.68亿美元,同比增长82%。CEO皮查伊称AI投资处于极早期阶段,Gemini 4正在训练中。财报后盘后跌逾4%。

#Google#财报#资本开支

06:4421世纪经济报道关联 2

梁文锋闭门会:不做视频生成,聚焦AGI与持续学习

DeepSeek创始人梁文锋在四小时投资人闭门会上系统阐述战略取舍:不做3D、视频生成与世界模型,不追求用户量,无意成为下一个超级App,全部资源集中于通往AGI的技术主线。他披露下一阶段技术路线——继思维链、Agent之后,重点攻坚模型的“持续学习”能力。梁文锋将开源定性为让利,定价只取合理利润,并判断国内大模型公司最终将收敛至两三家。他认为中美AI差距主要在资源而非人才,DeepSeek目标是用几分之一算力将差距缩至3-6个月。

#DeepSeek#梁文锋#AGI

05:13数字生命卡兹克关联 3

北京发布智能体新政,十条措施解读

北京市发布《北京市关于加快智能体引领发展的若干措施》,共十条,涵盖基础模型能力提升、智能体底层技术(Harness Engineering)、原生应用与标杆场景、智能终端融合、OPC(一人公司)创新创业、Token经济、安全治理、算力保障、开源开放及保障措施。政策提出持续提升大模型实际任务完成能力,强化驾驭层工程,推动需求智能驱动的超级软件,支持智能终端与芯模云端用协同,鼓励OPC模式并配套服务,推动Token经济从消耗量计费转向价值计费,加强安全治理,实施银河算廊工程,建设开源社区与出海路径。

#北京#智能体#政策

00:05云头条关联 3

美方指控月之暗面蒸馏Anthropic模型,Kimi K3陷争议

2026年7月22日,美国总统科技顾问Michael Kratsios发文指控月之暗面在开发Kimi K3时对Anthropic的前沿模型Fable进行了大规模、隐蔽的工业级蒸馏,试图获取美国公司专有技术并破坏美国AI研究。Kratsios称此类行为不可接受。月之暗面于7月17日发布Kimi K3,拥有2.8万亿参数,支持原生多模态和100万Token上下文,定位为开放权重前沿模型。部分网友质疑指控时间线不合理,认为Fable仅短暂公开,且月之暗面训练时间有限;也有评论指出美国在模型训练数据使用上存在双重标准。

#月之暗面#Anthropic#Kimi K3

19:42华尔街见闻(RSS)

Anthropic用Claude一周末完成AMD芯片适配

Anthropic在AMD大会上披露,工程师用Claude模型一个周末自动完成AMD MI355芯片与ROCm平台适配。高管Tom Brown称计划部署2GW AMD算力,并明确青睐MI355。适配仅需一名工程师和一台机架,Claude周末自行运转,周一即获性能曲线。市场评论称“已过CUDA护城河时代”,AI自动化适配正侵蚀英伟达生态壁垒。

#Anthropic#AMD#Claude

14:39云头条

美国拟立法授权政府强制关停大型AI模型

美国两党议员提出《AI关停开关法案》,拟授权联邦政府在重大安全事件后,要求大型AI公司限制、暂停或关闭模型。覆盖年收入超5亿美元、训练成本超1亿美元的企业,如OpenAI、Anthropic等。触发条件包括造成10人死亡或1亿美元损失、模型失控等。违反者每日最高罚款2000万美元。法案尚处立法阶段。

#美国#AI监管#立法

07:31华尔街见闻(RSS)

SemiAnalysis:编程消耗近半Token,OpenAI与Anthrop…

SemiAnalysis在最新对谈中指出,编程与软件工程已成为Token消耗核心引擎,前沿实验室API收入中70%以上来自编程,重度企业用户单人年支出高达10万美元。订阅制存在严重补贴问题,200美元/月订阅可换取8000至12000美元API额度,实验室正将用量向毛利率85%+的API端引导。OpenAI凭借5.5、5.6版本及Codex重新发力,与Anthropic形成双雄争霸。谷歌因算力受限跌至第五名。强化学习取代预训练成为核心扩展定律,实验室今年数据预算将超100亿美元。

#SemiAnalysis#行业分析#编程

04:24华尔街见闻(RSS)

谷歌Q2自由现金流史上首负,AI每赚1元花2元

谷歌Q2营收1198亿美元,同比增24%,但GAAP EPS 9.11美元中6.26美元来自Anthropic和SpaceX的未实现投资收益,核心EPS 2.85美元低于预期。资本开支449亿美元翻倍,自由现金流-59亿美元,史上首次转负。Google Cloud收入248亿美元,同比增82%,营业利润率35.6%,积压订单5140亿美元。搜索营收633亿美元,同比增17%,略低于预期。公司通过发股发债融资超700亿美元,股票回购归零。CFO表示资本支出还将大幅增长。

#Google#财报#AI投资

05

技巧与观点

Tips1

08:24Avi Chawla

LLM推理瓶颈:内存带宽而非算力

文章解释为何从A100升级到H100未显著提升LLM token生成速度:原因是内存带宽瓶颈而非算力。生成每个新token需读取模型权重和KV缓存,计算快但数据加载慢。介绍了五种优化技术:Flash Attention、Paged Attention、Continuous Batching、Speculative Decoding和Kernel Fusion。最后指出这些技术假设单模型独占GPU,但生产环境常运行多个小模型导致内存浪费。

#LLM推理#内存带宽#Flash Attention

往期存档