跳到主内容
@wquguru
精选85实践哥MinLi论文研究

世界模型、空间智能与具身智能关系论文发布

这篇论文,把世界模型、空间智能和具身智能之间的关系讲得很清楚。

原文
发到 X

这篇论文,把世界模型、空间智能和具身智能之间的关系讲得很清楚。

上海人工智能实验室物理智能团队发布了《世界模型:定义与路线图》。

它把世界模型这个混乱的概念,重新划清边界。

论文最值得看的是一张坐标图如图。

它把 Seedance、李飞飞团队的 Marble、杨立昆的 JEPA、英伟达 Cosmos 等热门系统,放进了同一个框架。

判断一个系统属于哪种世界模型,只需要问两个问题:

它输出什么?

视觉像素、可查询的世界状态,还是可执行的动作?

它内部如何表征世界?

直接使用观测数据、压缩成隐状态,还是建立显式的 3D 结构?

几个典型案例:

① Seedance:观测级表征 + 渲染器

② Marble:结构化 3D 表征,更接近李飞飞所说的空间智能。

③ JEPA:隐状态 + 模拟器,杨立昆的路线预测抽象世界状态如何变化,重点是理解和预测。

④ 英伟达 Cosmos 可以根据不同配置成为渲染器、模拟器或规划器,一整片能力。

这也说明:

未来不能再简单地问“某个模型是不是世界模型”,而要看它具体具备什么能力。

论文最核心的主张是:

世界模型的本质不是生成,而是压缩。

这样看,空间智能、世界模型、具身智能三者的关系就很清楚:

空间智能:理解世界里有什么,以及它们在哪里。

世界模型:预测世界接下来会如何变化。

具身智能:根据这些预测采取行动。

文章链接:https://arxiv.org/html/2607.06401v1

看到这里,你能找到下文Alaya world 的位置么?

更进一步:量化金融体系

看懂新闻只是起点——沿量化金融路径,把它变成能交付的工程能力

进入量化体系 →

相似阅读

另一事件,读法相近