Art of Speculation
Art of Speculation|2026年10月05日 19:13
大摩:AI不会等内存扩产:降规、解聚和CXL正在重构下一轮半导体机会 大摩认为,内存短缺会贯穿整个AI周期,但AI产业不会等DRAM新产能慢慢建出来,会通过降规格 + 工作负载解聚 + CXL内存池化三条路径绕开瓶颈,这可能让整个内存紧缺周期维持得更久。 最直接的做法是降规,NVIDIA已经开始给Rubin提供更低内存配置,例如LPDDR5从每机架54TB降到28TB、HBM从每GPU 288GB降到192GB,Rubin Ultra也可能从原本1TB HBM4e降到512GB甚至更低。这短期看着是压制单机内存用量,本质上是把瓶颈从HBM/DRAM往NAND和更大规模扩展域转移,同时长上下文、Agent和编码助手越来越普及后,降规空间也会越来越小。 第二条路径是推理解聚,把prefill和decode拆开,前者交给GPU等计算密集架构,后者交给更擅长内存带宽和容量的系统,通过异构架构提高稀缺内存的使用效率,受益者包括 CBRS,以及整合Groq之后的NVIDIA。 第三条路径是CXL内存集中化,把外部DRAM通过CXL做成可扩展、可共享、可池化的内存层,用来承接KV Cache和长上下文需求,大摩预计AI会把CXL可寻址市场从传统CPU附加控制器的约40亿美元,扩大到2030年约60亿美元,核心受益是 ALAB 和 MRVL,其中Marvell管理层预计CXL业务到2028年前后可贡献超过10亿美元收入。 投资上,大摩的核心观点没有因为降规而转空内存,反而继续超配 MU 和 SNDK,因为这轮降规是供应不够不是需求不行,一旦供应缓解,规格回升很快就能重新吸收产能。能终结这轮内存周期的不一定是新供给,可能是AI资本开支因为电力、土地、机房外壳等瓶颈而放缓。
分享至:

热门快讯

APP下载

X

Telegram

Facebook

Reddit

复制链接

热门阅读