大摩:AI 内存短缺将持续数年,三条路径绕过内存墙
发布日期:2026-10-09
事件概述
10 月 5 日发布的一份半导体行业研报给出判断:前沿大模型规模每 6 个月翻一番、头部模型上下文窗口年增 5 至 6 倍,而 DRAM 晶圆厂建设周期以年计,算力扩张不会等待供给,内存短缺将贯穿整个 AI 产业周期。
报告归纳了行业正在使用的三条绕行路径:一是硬件降配,新一代机架本地内存规格被主动下调,单机架从 54TB 降到 28TB、单 GPU 高带宽内存从 288GB 降到 192GB;二是推理架构解耦,把预填充交给 GPU、解码交给大缓存专用芯片;三是 CXL 内存池化,把内存从单机解绑成共享池。
核心要点
- 降配的实质:不是消灭瓶颈,而是把压力在内存层级之间转移:KV 缓存下沉到存储、跨卡交互交给网络
- 市场规模:CXL 及相关内存扩展芯片市场预计 2030 年约 60 亿美元,远超传统 CPU 内存扩展市场
- 被点名的方向:存储龙头、互联芯片与异构推理受益标的被一并列入推荐框架
- 高管表态:行业需要通过架构创新应对内存约束,而不是单纯等待产能扩张
行业意义
内存从配件升格为定义 AI 设备等级的核心标准:容量与吞吐正在取代单纯算力,成为分级的新尺子。
来源:智通财经