跳到主内容

日报

LIVE每早八时发报 · 更新于 08:00NewsHub Daily · 中文 AI 资讯精选

新闻枢纽 · 日报

本期 28 事件 · 1 一手信源 · 覆盖 8 家信源
今日头条 · Lead

NVIDIA发布Cosmos 3开放世界模型

今日,NVIDIA发布Cosmos 3系列开放世界模型,以混合Transformer架构推动物理AI发展;阿里云推出Wan3.0视频生成模型,单次可生成30秒视频并支持文档输入。微软首次披露OpenAI贡献其约70%AI收入,DeepSeek官宣API涨价,定价逻辑转向价值锚定。同日,马斯克宣布启动168亿美元的AI芯片超级工厂项目,AI基础设施竞争持续升温。

21:00NVIDIA 博客(RSS)

NVIDIA 发布 Cosmos 3 开放世界模型,推动物理 AI 发展

NVIDIA 发布 Cosmos 3 系列开放世界模型,基于混合 Transformer 架构,结合视觉推理、世界生成和动作预测,可用于场景理解、合成数据生成和未来状态模拟。系列包含 Super(64B)、Nano(16B)和 Edge(4B)三款,其中 Edge 可在边缘 GPU 运行,支持 RTX、DGX 和 Jetson 平台。在基准测试中,Cosmos 3 在开放权重文生图、图生视频、世界生成和机器人策略等方面排名第一。模型采用 Linux 基金会的 OpenMDW 1.1 许可,允许团队在自有数据上后训练。

#NVIDIA#Cosmos 3#世界模型

01

模型发布/更新

Model Releases1

20:33IT之家(RSS)

阿里发布视频生成模型 Wan3.0 公测,单次可生成 30 秒视频

8 月 6 日,阿里云宣布全新一代视频生成模型 Wan3.0 开启公测。该模型单次可生成 30 秒视频,支持智能时长推荐和视频延长功能。除文本、图片、音频、视频外,首次支持 doc、xls、ppt、pdf、md 等文档格式输入,可生成教学课件、产品演示等。人像生成追求“千人千面”,全能参考任务中可精准复刻角色、道具、场景等细节。即日起在阿里云百炼、万镜一刻、万相官网和千问创作 PC 端公测,千问 APP 灰度开放。API 价格:480P/720P/1080P 分别为 0.3/0.6/1.2 元/秒。

#阿里#视频生成#Wan3.0

02

产品发布/更新

Products4

11:11Hacker News Best(web_list)关联 3

Cloudflare OS:面向代理、应用与工作的开放平台

Cloudflare 宣布开源 Cloudflare OS,这是一个面向代理、应用与工作的开放平台。该平台为每位员工提供基于公司上下文和技能的代理工作区,包含隔离运行时,代理可编写和运行代码。平台还提供新的安全与治理框架,确保代理和应用的访问安全,并支持个人可修改的应用。Cloudflare 于今年五月在内部推出首个版本,数千名员工(包括非工程人员)日常使用。新版本基于内部运行经验重建,解决了协作中的信息暴露问题,并开源供任何组织部署、连接内部系统并定制。

#Cloudflare#AI平台#开源

17:00MarkTechPost(RSS)关联 2

Prime Intellect 开源 Prime Agent 编码框架

Prime Intellect 开源了 Prime Agent,一个自改进的编码框架,基于递归语言模型(RLM)和持续框架(Continual Harness)两个抽象。它用持久 IPython 内核替代固定工具模式,子代理作为函数调用。支持订阅登录(如 Codex、Claude Pro/Max)、API 密钥(如 Anthropic、OpenAI、Google)、Azure OpenAI、Amazon Bedrock 以及自托管 vLLM、Ollama 等端点。在 ARC-AGI-3 上,使用 Opus 5 达到 95.5% RHAE Best@1,高于人类专家基线 95.4%。

#Prime Intellect#开源#Agent

00:11OpenAI Developers

OpenAI 联合多家厂商推出 Agent Plugins 开放标准

OpenAI 宣布推出 Agent Plugins,这是一个与 AWS、Cursor、GitHub、Code 和 Vercel 共同开发的开放标准,旨在让开发者一次构建插件,即可在兼容的 Agent 客户端中复用。该标准打包了 Agent Skills,并支持 MCP 服务器配置的共享格式,从而简化跨平台 Agent 插件的分发与集成。

#OpenAI#Agent Plugins#MCP

23:28IT之家(RSS)

ChatGPT 现可调用 Adobe Photoshop 等 70 多款工具

IT之家 8 月 6 日消息,Adobe 去年底借助 OpenAI 的 Apps SDK,将 Photoshop 等带入 ChatGPT。今日合作扩大,新插件几乎涵盖旗下整套创意软件。用户安装后,可直接在 ChatGPT 中调用 Photoshop、Premiere、Acrobat、Lightroom、Illustrator 和 InDesign 等 70 多款工具。在设置菜单添加插件后,输入“@Adobe”和任务即可调用。插件与 Codex 及 Work 套件配合效果最佳,不登录 Creative Cloud 也能用基本功能,登录后可保存进度并访问云端文件,还可调用 Firefly 模型。

#Adobe#ChatGPT#插件

03

行业动态

Industry8

02:36华尔街见闻(RSS)关联 2

马斯克Terafab AI芯片超级工厂启动,初期投资168亿美元

SpaceX与特斯拉将初期投资168亿美元,在得克萨斯州Grimes County建设Terafab——一座先进的人工智能半导体综合工厂,以抢占马斯克所称对其公司未来至关重要的芯片产能。该工厂旨在缩小全球芯片供应与SpaceX和特斯拉未来数年预计所需的超过1太瓦计算能力之间的差距。SpaceX周四在其官网声明中表示,未来扩建阶段可能使总投资大幅增加,并称该工厂将至少创造3000个就业岗位。马斯克表示,Terafab正将尖端制造带到美国,在得克萨斯州创造数千个高薪职位,并使我们能够大规模生产可在地球和太空使用的AI芯片。

#马斯克#SpaceX#特斯拉

22:12Rohan Paul关联 3

微软首次披露:OpenAI 贡献其约 70% AI 收入

微软在最新文件中首次披露,OpenAI 为其 AI 业务贡献了约 70% 的收入。根据预测增长及此前与 OpenAI 相关收入的披露,微软 AI 收入中大部分(241 亿美元中的大部分)来自 OpenAI 在微软数据中心训练和运行 ChatGPT 的云账单,加上模型开发成本和 OpenAI 自身销售的分成,全部计入微软收入。此外,微软已向 OpenAI 投资 119 亿美元。

#Microsoft#OpenAI#财报

19:21IT之家(RSS)关联 2

宇树科技科创板IPO发行价150.8元/股,市盈率219倍

宇树科技公告科创板IPO发行价150.80元/股,发行4044.6434万股,占发行后总股本10%,市盈率219.23倍,高于行业平均38.56倍。预计募资总额约60.99亿元,净额约59.17亿元,战略配售包括社保基金、深度求索等。网上申购日8月10日,缴款日8月12日,上市市值约609.93亿元。招股书显示2023至2025年营收分别为1.59亿、3.93亿和16.99亿元,净利润分别为-1114.51万、9547.47万和2.78亿元。2026年一季度营收约4.23亿元,同比增长68.49%,但扣非净利润同比下降。

#宇树科技#IPO#科创板

11:37华尔街见闻(RSS)关联 2

DeepSeek官宣API涨价,幅度较大,定价逻辑转向价值锚定

8月6日,DeepSeek公告计划近期整体上调API定价,预计涨幅较大,具体方案以正式通知为准。这距其7月中旬引入峰谷差异定价仅约三周,定价逻辑或从调节算力负载转向重新锚定价值中枢。公告未给出具体幅度和时间表。需求端推手明显:OpenCode披露V4 Flash单日用量达8万亿Token,超过OpenRouter全平台日均规模;Vercel平台Token处理量升至第一。创始人梁文锋曾表示当前价格区间需求几乎无弹性,为涨价提供依据。此外,公司ARR达4亿至5亿美元,V4毛利率超50%,并已重启第二轮融资,计划募资500亿元,投前估值约5000亿元。

#DeepSeek#API定价#涨价

15:39华尔街见闻(RSS)

AI数据中心电力波动损毁设备,万亿美元投资面临考验

据彭博报道,AI数据中心用电量剧烈波动导致电池、发电机等关键设备故障或提前报废。xAI的Colossus设施燃气轮机出现裂缝,英国多处数据中心轮机开裂,稳压电池数周至数月内需更换。电力波动源于GPU集群毫秒级同步启停,瞬时用电量可飙升至设计容量50%以上。设备损毁致停机,实际运行率降至约80%,未来12至24个月将冲击投资者。NERC已发三级警报,要求大型数据中心应对电网稳定性风险。产业链正寻求解决方案,包括英伟达加强合作、采用“侧边计算”平滑波动,以及美国能源部建立测试平台。

#AI数据中心#电力波动#基础设施

10:53华尔街见闻(RSS)

存储长协重构定价权:周期底部被抬至历史峰值之上

存储行业定价权正经历系统性重组。闪迪FY2026财报显示,已签八份长期供货协议,按地板价计算最低总收入939亿美元,加权平均期限超四年,年均约200亿美元,接近当前年化收入的一半。高盛研报对比三星、SK海力士、美光、闪迪的LTA条款,发现期限更长(五年为主)、覆盖率更高(三星达60%-70%,海力士50%-60%)、定价结构更利卖方(三星跌幅限5%但涨幅无上限,海力士取消价格上限)、约束力更强(美光预付款220亿美元,闪迪担保110亿美元)。美光称地板价下毛利率仍高于历史峰值,行业库存低位,供需紧张支撑条款倾斜。

#存储#长协#三星

08:31华尔街见闻(RSS)

AI股神爆仓前:大佬站台,机构回避

由24岁创始人Leopold Aschenbrenner掌舵的Situational Awareness基金,资产规模一度达450亿美元,但今年7月因重仓股下挫遭遇追加保证金要求,被迫将大部分公开市场股票组合出售给Citadel。据《华尔街日报》报道,部分投资者曾对其激进杠杆策略和信息披露不足发出警告。该基金投资人以高净值个人为主,机构投资者因缺乏历史业绩记录而普遍回避。

#Situational Awareness#对冲基金#AI投资

07:19Hacker News Best(web_list)

AMD收购AI芯片初创公司Taalas,将模型蚀刻进硅片提升推理性能

AMD宣布收购AI芯片初创公司Taalas,旨在通过将模型直接蚀刻进硅片来提升推理性能。Taalas的技术能够将特定AI模型固化到硬件中,从而减少通用计算的冗余,显著提高推理速度和能效。此次收购将强化AMD在AI推理领域的竞争力,与NVIDIA等对手展开更直接竞争。具体交易金额未披露。

#AMD#Taalas#收购

04

论文研究

Research1

08:37MarkTechPost(RSS)

微软SkillOpt:Agent技能可在模型与工具间迁移

微软联合上海交大、同济、复旦提出SkillOpt,在冻结目标模型下训练单一自然语言技能文档。优化器模型提出编辑,仅当分数提升时接受。实验显示,技能在模型间迁移保留部分收益,如SpreadsheetBench在GPT-5.4-mini上保留82%增益;跨工具迁移效果最强,Codex优化技能使Claude Code得分从22.1升至81.8,超过其域内优化。但数学推理类技能迁移较弱。技能文件仅379-1995 token,训练成本一次性,推理零开销。研究认为程序性技能可移植,推理型技能与环境绑定。

#微软#SkillOpt#Agent技能迁移

05

技巧与观点

Tips8

11:11Hacker News Best(web_list)

DeepSeek V4 Flash 单卡 MI300X 生产部署配置

该仓库提供在单块 AMD MI300X 上生产运行 DeepSeek-V4-Flash-0731 的完整配置与补丁,包括 Docker Compose 栈、SHA-256 固定文件覆盖、上游差异补丁及调优表。实测单流解码 168.6 tok/s,8 并发流聚合 542 tok/s,64 流突发 830 tok/s 无 OOM,上下文 256K 验证通过,权重占用 156.67 GiB,无需额外量化或卸载。作者针对 MI300X 的 FP8 格式、高并发 MoE 路由、因果投机验证、CPU-KV 同步及未调优内核形状进行了修复,并固定了生产版本。仓库包含部署步骤、健康检查日志示例及冒烟测试命令。

#DeepSeek#AMD MI300X#部署

10:36meng shao

AI Skills v1.2 发布:新增 wizard 等技能,扩展分发渠道

Matt Pocock 发布 AI Skills v1.2,核心更新三条主线:分发渠道扩展、文档体系补齐、核心技能机制级重构。分发方面,整套 Skills 作为托管插件上架 Claude 官方插件市场,可通过 `claude plugins install mattpocock-skills` 安装,插件为只读、自动更新;同时为每个 SKILL.md 新增 agents/openai.yaml,实现完整 Codex 支持,用户触发型技能默认不隐式调用。新增三个技能:/wizard 将人工操作步骤转为引导式 TUI 脚本;/to-questionnaire 生成可转发的 Markdown 问卷;

#Matt Pocock#Skills#Claude

01:17MarkTechPost(RSS)

Meta Ax 自适应实验实战:贝叶斯优化与多目标调参指南

本教程演示如何使用 Meta 的 Ax 平台(现代 Client API)进行自适应实验。以随机森林模型在合成分类数据集上的调参为例,在平衡预测精度与模型规模的同时,定义包含整数、浮点、对数缩放和类别参数的混合搜索空间,并通过 ask-tell 优化循环实现约束贝叶斯优化、多目标优化及参数约束实验。教程涵盖收敛可视化、Pareto 前沿分析、内置分析工具使用及实验持久化,并提供了完整的可运行代码。

#Meta#Ax#贝叶斯优化

09:16数字生命卡兹克

OpenAI开源Codex Security,Vibe Coding安全插件实测

作者分享OpenAI开源的Codex Security安全插件,用于扫描Vibe Coding产品的漏洞。该插件源自2025年10月的Aardvark,后更名并整合进Codex,近期开源并支持OpenRouter和Fireworks。作者在Claude Code中演示安装与使用,默认用gpt-5.6-sol,扫描214个文件耗时一个多小时,花费约55美元,发现21个安全问题(1个高风险、11个中风险、9个低风险),高风险为权限判断错误。文章还介绍用OpenRouter接入第三方模型(如DeepSeek)的方法,并建议定期扫描,但指出无法覆盖DDoS等基础设施问题。

#OpenAI#Codex Security#安全

16:13IT之家(RSS)

华为昇腾支持RL训推一致性,实测性能提升最高60%

华为计算8月5日宣布,昇腾基于Ascend C提供完整训推一致算子集,在Qwen3-30B MoE模型上实现Logdiff为0,并通过FA算子优化在Eager模式下获得20%-60%性能收益。训推不一致指推理与训练引擎的数值差异,昇腾通过统一注意力语义、锁定reduce累加序、对齐在线Softmax分块策略和关键路径精度等修改,实现训推一致且不显著牺牲性能。相关基础设施已开源,并计划上线问题识别Skill。

#华为昇腾#强化学习#训推一致

14:07InfoQ 中国(RSS)

Claude Code之父:每半年清空配置文件

在InfoQ中国的报道中,Claude Code的创造者分享了一个工程实践建议:每半年清空一次claude.md、skills和hooks配置文件,让模型自己重新适应和优化。这一做法旨在避免配置文件因长期累积而变得臃肿或过时,从而影响模型的表现。报道强调,通过定期重置这些配置,可以促使模型重新探索并找到更有效的解决方案。该建议面向使用Claude Code的开发者,提供了一种维护AI辅助编程工具配置的实操思路。

#Claude Code#工程实践#配置管理

13:12Hacker News Best(web_list)

Castform+Neon:4B模型检索超GPT-5.6,成本低百倍

Neon 博客文章介绍,Castform 与 Neon 合作,通过 RL 后训练使 4B 开源模型在检索任务上达到 GPT-5.6 Sol 的准确率,成本降低 100 倍。文章指出,多跳搜索调用前沿模型耗时超 10 秒、成本约 0.03 美元,而小模型成本低百倍但能力不足,RL 后训练可弥补差距。Castform 提供无需处理 ML/GPU 细节的后训练平台,利用 Neon 的 Lakebase Search 进行语料存储、合成数据生成、训练和推理。

#Castform#Neon#RL后训练

11:11Hacker News Best(web_list)

Pi 的极简主义成为优势:更便宜且性能更优

Earendil 公司发文阐述其编码工具 Pi 的极简设计理念。Pi 默认仅提供 4 个工具,系统提示和工具定义低于 1000 tokens,旨在通过减少上下文开销和复杂性来降低成本并提升性能。文章引用 Databricks 的基准测试,显示在相同模型下,Pi 作为 harness 的成本比 Claude Code 和 Codex 更低,且通过率更高。Shopify 通过 Pi 的扩展机制构建了 Autoresearch 工具,实现了单元测试提速 300% 等优化。

#Pi#编码工具#极简设计

往期存档