美光高管:存储成AI瓶颈,实质性新增产能2028年后释放
美光高管:存储决定AI上限,实质性新增产能要到2028年后
存储是AI算力的关键瓶颈,美光作为核心供应商对产能释放节奏的预判直接影响产业链预期,建议关注相关硬件供应链动态。
随着AI浪潮从数据中心向边缘侧和机器人领域蔓延,美光高管警告称,存储已成为决定AI性能上限的最核心瓶颈,而由于新建产能周期漫长且工艺极度复杂,行业供需失衡的局面至少要到2028年后才能迎来实质性的新增产能释放。
9月15日,在Six Five Summit 2026的半导体聚焦论坛上,美光公司CEO高级顾问Sumit Sadana接受了分析师Patrick Moorhead的采访,详细拆解了AI时代下存储行业的供需格局、资本支出计划以及未来的核心增量市场。
在过去的一年里,整个科技行业对存储的认知发生了根本性重塑。这种重塑的根源在于,算力早已不再是衡量AI系统能力的唯一标尺。Sadana在访谈中一针见血地指出了当前AI硬件的底层逻辑:“如今,人工智能系统的性能首先取决于内存子系统的性能和内存容量。这两点真正决定了人工智能子系统的性能水平。”
他解释称,由于AI模型需要存储在内存中,且海量数据需要在内存间来回传输,处理器与内存之间的带宽已成为性能的关键瓶颈。同时,存储市场正面临着长达数十年积累下来的结构性失衡——上世纪90年代初有多达20多家DRAM公司,如今只剩下寥寥几家;而目前设计处理器的公司却已超过20家。这种“少对多”的漏斗型供给格局,使得面对爆发式的AI需求时,存储供应链显得极为脆弱。
资本支出飙升,实质性新增供应需等到2028年
面对供需之间的巨大缺口,单靠技术转型带来的比特增长已无法满足市场胃口,整个行业被迫进入“新建洁净室和晶圆厂”的重资产扩张周期。
美光正在开启前所未有的资本开支计划。Sadana透露:“单看我们的资本支出计划:2025财年我们的资本支出略高于130亿美元;2026财年将翻一番;2027财年预计将超过450亿美元。我们最近在美国宣布,将投资额从2000亿美元提高到2500亿美元,并加快了时间表。”此外,美光还在美国爱达荷州、纽约州,以及中国台湾、日本和新加坡等地同步推进约20个扩产项目。
然而,远水难解近渴。半导体工厂的建设受制于基础设施、监管审批以及技术工人的严重短缺。Sadana给出了明确的时间表预期:“我们认为真正意义上有效的新增供应要到2028年才能开始逐步释放,而且这仅仅是初期阶段,产能增长的势头要到之后几年才能真正增强。因此,整个行业需要一段时间才能找到新的平衡点。”
产能释放缓慢的另一大原因在于存储器制造的天文数字级复杂度。以当前火热的HBM为例,Sadana直言其能正常工作“简直是个奇迹”:“想想看,把12层DRAM芯片层层堆叠起来,最底层还有一个连接到GPU的基础芯片。整个系统面临着非常严峻的散热挑战和功耗问题……晶圆厂里大约有2000道工序。从晶圆厂开始生产,到最终能把产品交付给客户,整个周期大约需要五个月。”
告别“随买随卖”,长期“长协”与“深度定制”重塑商业模式
极度紧缺的产能正在倒逼存储行业的商业模式发生蜕变,传统的现货交易和符合JEDEC标准的通用芯片时代正在发生改变。
“我们签订的是多年期合同,承诺向客户供货,客户也承诺提供需求预测。这与以往的一年期协议截然不同——以往客户想买就买,只要有货我们就供货。”Sadana表示,这种被称为“战略客户协议”的模式投资回报率极高,为晶圆厂多年的资本支出提供了底层保障。
更为深刻的变化在于研发端的绑定。为了在AI系统中实现功耗、模型运行速度等方面的差异化,客户正将存储设计提前纳入其5到7年的产品路线图。Sadana指出:“这种模式将合作关系转变为更类似于ASIC芯片的合作模式——客户在设计上拥有更大的自主权,且这种关系具有长期性。”
AI走向边缘,人形机器人将成最大增量市场
市场普遍聚焦于数据中心的AI需求,但美光认为,这仅仅是起点。随着AI向智能手机、PC(如采用统一内存架构的Mac mini)以及自动驾驶汽车渗透,存储需求将无处不在。
对于未来的想象空间,Sadana将目光锁定在了机器人赛道,认为这将是继数据中心之后的又一波海量需求浪潮。
“想想人形机器人,它将成为有史以来最大的产品市场之一。”Sadana在展望2030年代的市场时强调了端侧AI对存储的恐怖消耗量:“机器人技术最令人兴奋的地方在于,每个设备需要存储海量数据——每个人形机器人将拥有数百GB的DRAM内存和数TB的NAND闪存。因此,它们将极大地推动DRAM和NAND的需求增长……机器人必须能够自主运行,不能每次都向服务器发送数据。”
以下是访谈正文:
Sumit Sadana 00:00
如今,人工智能系统的性能首先取决于内存子系统的性能和内存容量。这两点真正决定了人工智能子系统的性能水平。欢迎回到 2026 年峰会。
Patrick Moorhead 00:22
人工智能的时代已经来临。内存的重要性和战略意义令人惊叹。我一直认为内存很重要,但考虑到人工智能时代,它所赋予我们的能力简直不可思议——坦白说,如果没有足够的内存、没有合适的内存,我们周围所有令人惊叹的事物都无法实现。
我很高兴地宣布,美光公司将出席本次峰会。很高兴见到你,很高兴你回来了。谢谢你的邀请。这真是太棒了。我从事这个行业 35 年了,从内存的消费者,到内存的合作伙伴,再到现在在分析公司研究内存市场及所有相关领域。我们取得的成就令人惊叹。去年我们交流的时候,我实际上把内存归类为战略性技术——是的,我得为此邀功。坦白说,你更应该得到赞誉,因为你是实际行动者,我只是说说而已。但如今,这种观点似乎更加重要了,越来越多的人开始谈论它。在这个人工智能时代,过去一年里发生了什么变化,让整个行业更加重视内存?
Sumit Sadana 01:44
为什么人工智能实际上加速了这种转变?这是个很好的问题。一年过去了,但就过去一年世界发生的变化而言,感觉却相当漫长。从客户的角度来看,变化尤其巨大。我们现在面临的情况是,所有市场领域的内存都严重短缺。尽管我们尽了最大努力来增加供应,但目前仍然无法确定何时才能使供应赶上需求,因为需求一直在持续增长。来自各个领域客户的信号,每年都在不断增加。
客户看待内存的方式之所以发生变化,原因有几个。其一是供需之间存在的巨大缺口;其二是,考虑到人工智能的需求,系统对性能的要求也在不断提高。当你思考是什么让系统发挥出最佳性能时,你会发现处理器并非唯一因素。如今,内存性能、处理器与内存之间的带宽以及内存本身的容量都至关重要。因为人工智能模型需要存储在内存中,大量数据需要在内存之间来回传输,处理器与内存之间的带宽就成了性能的关键瓶颈。因此,客户逐渐意识到,他们需要重新规划产品路线图,并采用不同的内存策略。
Sumit Sadana 03:44
现在,关键在于如何设计内存以获得竞争优势,如何让每个客户的系统脱颖而出。如果内存仍然像几年前那样,采用所有人都使用的、符合 JEDEC 标准的现成内存,那么就很难实现差异化。因此,我们现在与客户合作,将内存设计纳入他们多年的产品路线图。他们现在专注于如何实现差异化、如何改变竞争格局。这意味着要以不同的方式思考内存,与像美光这样的公司合作,设计出一种可以加以应用和利用的新型功能。
Sumit Sadana 04:31
举个例子,我们与英伟达在数据中心低功耗 DRAM(LPDRAM)领域的合作就是个很好的例子。我们是首家将这项技术引入数据中心的公司,并且长期以来一直是该领域的独家供应商,而现在这项技术正逐渐被其他公司所采用。越来越多的客户开始意识到使用低功耗 DRAM 的优势——它能带来更高的密度、更小的尺寸、更强的性能,以及显著降低的功耗,而这对于数据中心来说至关重要。这只是众多例子中的一个。
Patrick Moorhead 05:07
展望未来五年,这些技术正开始蓬勃发展。当我试图解释为什么人们对内存的兴趣如此高涨时,我想起了我大学时上的一门课——那是在 80 年代末,那门课讲的基本原理是:如果你能把操作限制在内存范围内,就能提高性能。当然,现在的情况略有不同。内存越多,你就能获得更好的结果,而且内存越接近你正在处理的事务越好,因为一旦超出内存范围,速度就会变慢。在人工智能时代,这是一个很大的挑战。
这很有意思。我的职业生涯中经历了九个内存周期。我之前在一家 OEM 厂商工作,也曾在一家芯片公司工作,现在在一家分析公司工作了 15 年。内存似乎是周期性最强的,尽管我知道还有其他行业也有类似的周期规律,但内存也被认为相当商品化。你在第一个问题中已经稍微谈到了这一点,但是……
Sumit Sadana 06:17
为什么人工智能正在从根本上改变这种认知?这是一个很好的问题。如果你回顾上世纪九十年代初,当时有超过 20 家公司在做 DRAM,DRAM 行业经历了大量的整合。那时候处理器公司就只有那么几家,而现在,处理器公司已经超过 20 家了。如果你坐下来数一数所有做处理器设计的公司,这个数字很快就出来了。但是做 DRAM 的公司却寥寥无几。
所以,当你思考人工智能设计、人工智能子系统设计时,不仅仅局限于数据中心——当然,数据中心方面要区分训练工作负载与推理工作负载,甚至推理工作负载本身也会越来越细分为不同的推理类型。其中一小部分可以使用 SRAM,但很大一部分仍然非常依赖 DRAM。我们尽可能地在这些系统中设计出最大的 DRAM 容量。这种趋势甚至延伸到自动驾驶汽车、工业系统,再看看智能手机和个人电脑——由于统一内存架构,Mac mini 销量火爆,掀起了一股"Open Claw"运动。而这一切,归根结底,都与人工智能息息相关。
Sumit Sadana 07:50
如今,系统性能首先取决于内存子系统的性能和内存容量,这两点真正决定了人工智能子系统的性能。因此,当内存成为系统的核心设计点时,你就必须以不同的方式思考内存问题。随之而来的核心问题就是:如何快速推出差异化产品?我认为,未来的内存业务将与过去截然不同,而这又与以下这个理念紧密结合……
Sumit Sadana 08:36
整个行业最终都发展到了需要新建产能的地步,这着实令人意外,因为人工智能驱动的需求增长如此显著。仅仅依靠技术转型无法满足这种需求,而过去几年,技术转型带来的比特增长原本足以满足需求增长。如今,行业需要大幅增加晶圆产量,这意味着必须建设新的洁净室空间。当现有生产基地的洁净室空间告罄时——大多数公司似乎都已面临这个问题——就必须同时在新建厂址扩产,而这需要很长时间。
这是一个非常耗时的过程,而且还受到诸多实际因素的制约,例如世界各地建设速度的差异,以及监管审批的效率。如何在一片荒地上建立起所有必要的基础设施——电力、水和水处理厂?化学品供应以及建立晶圆厂所需的一切配套基础设施,都需要很长时间,这正是整个行业正在经历的现实。
Sumit Sadana 10:01
所以,尽管我们尽了最大努力,也看到了业内其他企业的努力,但我们目前仍然难以满足市场需求。供应需要很长时间才能赶上需求,而这也是影响客户行为的另一个重要因素。
Sumit Sadana 10:27 这就是我们一直在讨论的战略客户协议。这些战略客户协议从根本上改变了我们的商业模式和业务方式。我们签订的是多年期合同,承诺向客户供货,客户也承诺提供需求预测。这与以往的一年期协议截然不同——以往客户想买就买,只要有货我们就供货。现在的协议是承诺供货协议,投资回报率非常高,因此我们可以为多年所需的资本支出提供保障。
当然,这还没有涉及到智能体人工智能,也就是人工智能发展的下一个阶段。之后还会发展到物理人工智能,那将是下一波巨大的需求浪潮。如果你观察这些不同的需求浪潮,你会发现它们相互叠加、相互促进,而非相互取代。这就带来了一个很大的挑战,那就是如何将如此大规模的实体供应能力转移到线上。
Patrick Moorhead 11:39
在这段时间里,为了满足所有这些需求,我认为你们的长协计划恰恰证明了内存的战略意义正在提升。我知道很容易将其简单地归结为"我们需要长协计划来锁定未来的产能",这固然重要,但它也涉及到协同规划。
从技术角度来说,我真的深受震撼,也很高兴你提到了边缘人工智能。最有趣的是,无论是 Open Claw,还是客户端计算领域的一些新设计——例如将内存与 CPU 和 GPU 紧密耦合以增强带宽——客户端计算机的架构变化并不多见,它们已经相当稳定了很长时间。接下来我想谈谈超大规模数据中心,我们之前也稍微讨论过,很多动态都发生在这里,至少在资本支出方面投入巨大,模型和应用方面的创新也主要集中在这些领域。不过,我很好奇,关于自动驾驶汽车、个人电脑、机器人、智能边缘等领域……
Sumit Sadana 13:00
内存需求是否正在改变这些应用场景?是的,这是个很好的问题。当然,这一切都始于数据中心。但当我们思考人工智能的未来发展方向时,它不会仅仅局限于数据中心。这股智能浪潮将向边缘推进,最终,智能将无处不在,渗透到所有设备中。因此,它涵盖各种消费电子产品、汽车,当然,甚至包括工业革命第二阶段——届时,所有这些智能都将分布在全球各地的企业之中。
Sumit Sadana 13:43
您的个人设备,无论是在工作场所还是在家中使用的电脑、您的智能手机,甚至包括一些公司正在考虑开发的新设备——这些设备的外形可能与智能手机或电脑截然不同,完全采用不同的设计。因为当你考虑构建一款原生 AI 设备时,可以想到与传统电脑和智能手机方案完全不同的实现方式。这又回到了如何尽可能降低功耗的问题,例如对于一些需要电池供电的设备而言。如何最大限度地提高性能,如何运行那些既能为消费者提供价值、又足够小以便在设备上运行而无需返回云端的模型——这正是人工智能的新前沿。
这种探索将会持续下去。那些足够小、可以在电脑或智能手机等设备上运行的模型,将随着时间的推移变得越来越好。随着这种情况的发生,数据隐私和保密性的优势就凸显出来了。消费者非常重视这一点,而那些能够让消费者确信其与设备交互的所有内容都不会上传到云端的公司,将催生出一系列全新的应用,带来巨大的价值。
Sumit Sadana 15:30
再看看自动驾驶,它现在发展迅猛,这得益于人工智能技术的进步;而下一代前沿技术则是机器人。想想人形机器人,它将成为有史以来最大的产品市场之一。当然,这需要一些时间,但我们正越来越接近那个奇点——届时,你将能够像与其他人交谈一样与人形机器人交谈,其认知能力几乎无法区分。随着时间的推移,这些机器人的物理能力将变得越来越复杂,这将是一项革命性的成果。
最初,它们将应用于工厂自动化之类的环境中,执行非常具体的任务,自由度也较低。一旦从那里"毕业",最复杂的环境就是家庭,因为家庭环境非常非结构化。但我相信,进入本世纪 30 年代,机器人技术将成为巨大的增长驱动力。而机器人技术最令人兴奋的地方在于,每个设备需要存储海量数据——每个人形机器人将拥有数百 GB 的 DRAM 内存和数 TB 的 NAND 闪存。因此,它们将极大地推动 DRAM 和 NAND 的需求增长。我认为很多人常常无法充分理解这一点:机器人必须能够自主运行,不能每次都向服务器发送数据。确实如此。
Patrick Moorhead 17:25
而且,在你讲解的过程中,我突然意识到美光正在实现到吉瓦的飞跃。想到要发明这项技术,我就觉得有点不可思议。但我认为,人们在想到美光的时候,应该记住这一点。
随着人工智能时代的到来,人们的战略眼光也越来越强,无论是利用尚未发明的前沿设备,还是在不久后发布的、可以直接接入人工智能和大模型的吉瓦级数据中心,都至关重要。
这种共同设计或共同发明的理念我听说过,也和你们的一些合作伙伴聊过,他们谈到了一些正在尝试的想法。我之前也稍微谈到了架构方面的变化——这些变化传统上是通过某种 JEDEC 标准之类的东西来实现的。但现在我们正在探讨的是真正意义上的深度共同设计。您能谈谈您与合作伙伴之间正在发生的这种关系变化吗?
Sumit Sadana 18:45
当然。我们的合作伙伴也希望弄清楚如何在各自的市场中获得优势、战胜竞争对手。内存处理器子系统之所以成为人工智能子系统如此关键的组成部分,是因为内存与处理器之间的交互本质上决定了人工智能系统的许多关键参数——它决定了系统的功耗,决定了可以运行哪些类型的模型、模型的大小以及运行速度。
当你想到大语言模型(LLM)领域各种尺寸和类型上正在发生的种种进步时,你会发现,为了在硬件的内存设计周期和处理器设计周期中实现差异化,各个细分市场都必须密切合作。这并非那种即插即用、符合 JEDEC 标准的器件,事后只需进行一些认证即可使用。虽然部分市场确实如此,但客户越来越需要思考:如何实现差异化?我需要创造一些现成产品无法提供的特殊功能。因此,我们需要与存储器公司合作,就研发路线图展开长达 5 到 7 年的长期讨论。我们正在融入许多客户的研发路线图,他们提出了许多非常有趣的想法,其中一些可行,而另一些则需要更长时间,才能产生突破性进展所需的发明和创新。
Sumit Sadana 20:28
我们对所看到的多元化理念感到非常兴奋。正如您所说,这些理念涵盖了如此广泛的系统——有些设备功耗极低,因为全部采用电池供电,而有些设备则适用于吉瓦级的数据中心。我们已经在多个细分领域以及每个细分领域的一些领先客户中看到了创新成果涌现,我们将继续见证这些成果,并积极为此努力。
在一些令人振奋的项目中,我们不断拓展自身能力,交付客户渴望实现的创新设计理念。客户无法与多家公司进行如此深度的合作,因此能够开展深度讨论的通常只有一两家公司,其他公司可能要几年后才能跟上。这种模式的优势在于,你可以真正与一两家公司建立极其紧密的合作关系,通常走上这条路,你会成为单一来源供应商,或者在一段时间内只有另一家供应商。这种模式将合作关系转变为更类似于 ASIC 芯片的合作模式——客户在设计上拥有更大的自主权,且这种关系具有长期性。这是因为双方之间建立的是一种特殊的 ASIC 式合作关系,而不是几年前那种标准内存芯片式的合作关系。我看到的另一个重大变化是,这种模式可以大规模应用。
Patrick Moorhead 22:27
没错。这意味着销量如此之大,坦白说,资金规模足以让双方都进行投资,而当你启动这个项目时,关键就在于差异化。人们都在寻找方法,无论是性能效率还是总拥有成本(TCO),他们都想与众不同。
我想从投资的角度展望一下未来。你刚才谈到了产能方面的投资。有趣的是,有人期望存储器工厂能像写代码一样快速建成。但听着,我曾经在一家拥有晶圆厂的芯片公司工作,即使在今天,这仍然是一个非常困难的资本密集型项目,必须等三四年后才能看到任何有利的结果。您能谈谈您正在进行的哪些投资真正巩固了美光在下一代技术中的地位吗?不管是人工智能,还是其他技术,抑或是人工智能的某种变体。这些投资确实需要很长时间,您已经把这一点说得很清楚了。
Sumit Sadana 23:57
你说得很有道理。顺便说一句,如果有人知道如何快速建成一座 DRAM 工厂,我们非常想知道,因为这会大大简化我们的工作。我们的客户肯定希望尽快拿到货,我们也正在尽一切努力。
更进一步:量化金融体系
看懂新闻只是起点——沿量化金融路径,把它变成能交付的工程能力