跳到主内容
NewsHub

日报

LIVE每早八时发报 · 更新于 00:00NewsHub Daily · 中文 AI 资讯精选

新闻枢纽 · 日报

本期 15 事件 · 覆盖 5 家信源
今日头条 · Lead

Vercel 开源 Agent 框架 Eve,Agent 即目录

IT之家(RSS)

英伟达机器人自学装显卡,将开源自动研究框架

英伟达 GEAR 实验室联合负责人 Jim Fan 宣布首次在物理世界中启用 AutoResearch,其提出的 ENPIRE 编码智能体框架可将现实世界机器人学习转化为可控优化过程。团队为 8 个 Codex 智能体配备多个机器人、GPU 分配及充足 Token 预算,设定目标为快速安全完成任务。机器人学会寻找视觉线索、重置场景、练习新技能、调整控制堆栈、在线阅读论文、辩论、反思并直接在硬件上尝试。研究人员仅提供通往物理世界的 API,其余由 AI 自主探索。在 ENPIRE 加持下,机器人能独立完成系扎带、整理钉子、插显卡等高精度任务,可整夜不间断自我改进。Jim Fan 表示将开源该技术。

#英伟达#GEAR实验室#机器人

01

模型发布/更新

Model Releases2

IT之家(RSS)

阿里开源统一科学大模型 LOGOS,1B参数超越微软NatureLM

阿里 ATH-Token Foundry 联合中国人民大学高瓴人工智能学院开源首个基于统一“科学语法”的多领域科学生成基础模型 LOGOS。该模型将蛋白质、小分子、材料等异构对象编码为统一离散 Token 序列,实现跨模态生成。在六大科学任务上,LOGOS-1B 以 1/56 的参数量(1B vs 8×7B)超越微软 NatureLM。模型构建了涵盖 7 类模态、44.87B tokens 的预训练语料库,并设计“文字描述法”将 3D 空间接触模式语法化为离散 Token,无需输入 3D 坐标。LOGOS 通过形式与目标对齐消除预训练与下游任务间的 gap,无需大量微调即可激活生成能力。模型权重、推理代码与技术报告已开源。

#阿里#LOGOS#科学大模型

IT之家(RSS)

WWDC26苹果演示4台Mac Studio本地运行万亿参数Kimi K2.6

苹果在WWDC 2026特别讲座中,重点演示了在4台Mac Studio上通过LM Studio本地运行1万亿参数的Kimi K2.6模型,并采用低延迟RDMA over Thunderbolt技术实现多机内存直连。该模型由月之暗面于2026年4月发布,具备代码编写、长程任务执行及Agent集群能力。讲座还展示了AI构建App的流程,工程师仅用单条提示词生成具备3D动画和全息效果的WWDC badge tracker应用。

#苹果#月之暗面#Kimi K2.6

02

产品发布/更新

Products2

meng shao

Vercel 开源 Agent 框架 Eve,Agent 即目录

Vercel 开源了其 Agent 框架「Eve」,核心设计理念是「Agent 即目录」。开发者通过目录结构定义 Agent:agent.ts 配置模型,instructions.md 设定系统提示,tools/ 存放可执行能力,skills/ 提供领域知识,subagents/ 实现子 Agent 委托,channels/ 对接 Slack、Discord 等入口,schedules/ 管理定时任务,connections/ 处理 MCP/OpenAPI 外部连接。Eve 内置多项生产级能力:持久会话基于开源 Workflow SDK,支持 checkpoint 和恢复;沙箱隔离代码执行,支持 Docker 和 Vercel Sandbox;Human-in-the-loop 机制通过 needsApproval 暂停会话,审批后继续;Connections 由框架代理鉴权,模型不接触凭证;多 Channel 支持同一 Agent 服务多个平台,并可 handoff;Tracing 和 Evals 基于 OpenTelemetry,支持本地和 CI 运行。开发流程:本地使用 eve dev 启动 TUI,可观察每一步;部署通过 vercel deploy,Agent 作为普通 Vercel 项目,部署不中断进行中的会话。工程化方面,Agent 进入 Git,prompt、工具、skill 均有 diff 和 review;Preview 部署可提前测试;eve eval 集成 CI 防回归。Vercel 内部验证了多个案例:d0 月处理 3 万+ 查询,权限对齐;Lead Agent 年成本约 $5k,回报 32 倍;Athena 由 RevOps 6 周搭建;Vertex 解决约 92% 工单;draft0 用于内容审阅;V 作为路由 Agent 分发到百级 Agent 舰队。

#Vercel#Eve#Agent框架

Latent Space(RSS)关联 3

Midjourney 发布全身超声 CT 扫描仪与 Spa 计划

Midjourney 宣布启动医疗成像项目,推出名为 Midjourney Scanner 的全身超声 CT 原型机。该设备采用 358,000 个超声换能器环形阵列,通过水耦合实现全身扫描,声称分辨率可达 0.5mm,目标在 60 秒内完成数百层切片。当前为 Gen 1 原型,尚未使用 AI,扫描约需 20 分钟,团队约 9 人,已扫描约 12 人。同时宣布 Midjourney Spa 计划,首家位于旧金山 Union Square,约 25,000 平方英尺,配备 9-10 台扫描仪,目标 2027 年底开业。公司表示已开始与 FDA 讨论,初期商业化路径可能围绕身体成分分析。长期目标是部署 5 万台扫描仪,实现每月 10 亿次扫描。Midjourney 称其为自筹资金,无外部投资者。

#Midjourney#医疗成像#超声CT

03

行业动态

Industry8

华尔街见闻(RSS)

Transformer之父Shazeer从谷歌跳槽OpenAI

Noam Shazeer,被誉为“Transformer之父”的AI研究员,正式加入OpenAI。OpenAI于6月17日内部宣布此消息,Shazeer随后在X上确认。他是2017年论文《Attention Is All You Need》的核心作者之一,该论文提出的Transformer架构是ChatGPT等生成式AI的基础。Shazeer曾于2021年离开谷歌联合创办Character.AI,2024年谷歌以27亿美元将其团队重新纳入DeepMind,他担任Gemini模型技术负责人。此次加入OpenAI,他将专注于探索AI模型新架构和推动Transformer演进。OpenAI正面临Anthropic的竞争,并筹备IPO,此举被视为关键人才争夺。Shazeer此前在Character.AI曾因AI聊天机器人相关诉讼和解,且在谷歌期间因争议言论与同事产生摩擦。

#Noam Shazeer#OpenAI#谷歌

华尔街见闻(RSS)

理想汽车全面转向AI,发布VLA、世界模型与自研芯片

理想汽车在Livis Day上发布了一系列AI与具身智能技术,包括VLA、Agent、世界模型、3D ViT和自研马赫芯片。理想汽车CTO谢炎和基座模型负责人詹锟在媒体沟通会上阐述了公司的战略:将汽车、Agent和机器人视为共享同一大脑的统一智能体,通过垂直整合(芯片、模型、系统)摆脱同质化竞争。詹锟强调,未来自动驾驶需要模型具备像人类一样的思考能力,而不仅仅是经验主义的数据覆盖。谢炎指出,自研芯片采用数据流架构,目标是实现4倍于当时最好芯片的性能,并最终形成车内单一AI计算中心。理想汽车认为,技术高速发展期需要打破分工、进行垂直整合,这是领先公司的必然选择。

#理想汽车#AI战略#具身智能

华尔街见闻(RSS)

CoreWeave高管:AI需求持续强化,供电机房成基建瓶颈

CoreWeave联合创始人兼首席发展官Brannin McBee及企业发展与投资者关系副总裁Nick Robbins近日接受媒体采访时表示,AI需求“每天都在寻找新方式强化”,没有任何放缓迹象。随着智能体AI浪潮加速,市场对CPU、存储等配套资源的需求相对GPU显著提升,数据中心架构经历根本性重构。当前制约AI基础设施扩张的核心瓶颈是“供电机房”(已完成供电配套的数据中心建筑本体),而非GPU芯片或HBM内存。CoreWeave是目前唯一同时服务Anthropic、OpenAI、Meta、谷歌、微软、英伟达等顶尖AI机构的独立云服务商。公司已从根本上重新设计数据中心标准方案,为更多存储和CPU预留空间。对于英伟达Vera Rubin平台,预计服务器将于2025年下半年开始交付,大规模量产爬坡贯穿2027年。

#CoreWeave#AI基建#算力

华尔街见闻(RSS)

LeCun警告AI泡沫:xAI已失败,行业面临成本危机

被誉为“AI教父”的Yann LeCun公开批评马斯克旗下xAI已“失败”,并警告整个AI行业若不削减成本、提高定价,将面临“泡沫大爆炸”。LeCun指出,xAI核心创始团队大量出走,马斯克难以招募顶尖AI人才,xAI无力与OpenAI和Anthropic竞争。他还质疑AI商业模式,认为运营成本下降速度远不及预期,各大实验室靠投资者补贴用户使用,难以为继。LeCun力推“世界模型”路线,其创立的AMI Labs今年3月完成10亿美元融资,专注于该方向。

#Yann LeCun#xAI#AI泡沫

The Decoder(RSS)

谷歌Gemini联合负责人Noam Shazeer加入OpenAI

Noam Shazeer,著名论文《Attention Is All You Need》的合著者、谷歌Gemini模型的联合负责人,已加入OpenAI。他于2024年通过价值27亿美元的交易从Character.AI重返谷歌,仅两年后便再次离职。这是继Karpathy转投Anthropic之后,今年AI领域的第二次重大人事变动。

#Google#OpenAI#Noam Shazeer

Rohan Paul

谷歌Gemini联合负责人Noam Shazeer离职加入OpenAI

据路透社报道,谷歌Gemini联合负责人Noam Shazeer将离开谷歌,加入OpenAI。Shazeer是Transformer时代最重要的模型构建者之一,曾参与创建Character.AI。谷歌在2024年支付约27亿美元将其与Character.AI人才带回,并让他负责Gemini项目。他的加入将为OpenAI带来对话系统构建经验、谷歌规模基础设施经验以及从初创公司到大型科技公司的架构竞争视角。

#Google#OpenAI#Noam Shazeer

华尔街见闻(RSS)

淡马锡计划2030年前将AI投资扩至750亿美元

据The Information报道,新加坡主权财富基金淡马锡计划在2030年前将其AI相关投资持仓从250亿美元扩大至750亿美元,AI资产在其投资组合中的占比将从7%跃升至约15%。淡马锡董事总经理Aftab Mathur表示,公司正在大规模扩大AI敞口。今年以来,淡马锡已投资Anthropic、Isomorphic Labs和Waymo等AI公司。淡马锡认为,其旗下大型新加坡被投企业如星展银行已开始大规模采用AI,带动了AI模型和应用公司的营收增长,进而支撑数据中心等基础设施的资本开支,形成“良性循环”。但淡马锡高管对具体赢家持谨慎态度,表示会以投资组合方式多元化布局。

#淡马锡#AI投资#主权基金

04

论文研究

Research1

Avi Chawla

CMU研究:AI编程助手短期提效但长期降低代码质量

卡内基梅隆大学(CMU)一项新研究追踪了807个采用Cursor的GitHub仓库,并与未采用的相似仓库进行匹配对比。结果显示,采用AI编程助手后的第一个月,代码产出量增加3-5倍,但这一增益在两个月内消失。同时,代码质量持续下降:静态分析警告增加约30%,代码复杂度上升约41%,且在整个研究期间保持高位。研究还发现,即使控制代码量,复杂度增长仍更快,表明AI本身加剧了问题。使用AI审查自身代码或另加AI审查效果不佳,因为模型共享相同的盲点。研究建议采用确定性验证(如SonarQube插件)来替代概率性猜测。

#CMU#AI编程助手#代码质量

往期存档