AI算力需求的爆发式增长,正在从多个维度重塑服务器硬件架构。在CPU核心数从几十核向上百核跃进的同时,一个日益尖锐的矛盾浮出水面:CPU的算力在倍增,但内存带宽的增长速度远远跟不上。这个矛盾,被业界称为“内存墙”(Memory Wall)。
正是在这一背景下,一种名为MRDIMM的新型服务器内存标准正在从实验室走向数据中心。
一、什么是MRDIMM?
MRDIMM,全称Multiplexed Rank Dual In-line Memory Module(多路复用秩双列直插式内存模块),是由固态技术协会(JEDEC)制定的DDR5高带宽内存模组标准。它的核心目标只有一个:在不改变DDR5物理插槽的前提下,成倍提升内存带宽。
从技术架构上看,MRDIMM基于DDR5 LRDIMM架构,采用 “1+10”设计方案——即每根内存条配备1颗MRCD(多路复用秩寄存时钟驱动器)芯片和10颗MDB(多路复用秩数据缓冲器)芯片。
传统RDIMM仅需1颗RCD芯片即可工作,而MRDIMM通过MRCD与MDB的组合,让单个内存模块能够同时访问多个Rank的数据,实现数据在多个Rank上的并行传输。
简单来说:RDIMM一次只能与一个Rank通信,MRDIMM可以让数据在同一时刻于两个Rank上并行传输。
二、为什么需要MRDIMM?——“内存墙”正在成为瓶颈
MRDIMM的诞生,源于一个越来越紧迫的现实问题:CPU核心数量在飙升,但每核心能分到的内存带宽在下降。
现代服务器CPU的核心数已从十几核扩展到几十核甚至上百核。以英特尔至强6性能核处理器(代号Granite Rapids)为例,其核心数量相较前代大幅提升。但标准DDR5 RDIMM的速率停留在6400MT/s,内存带宽的增长速度远远落后于CPU算力的增长速度。
在AI推理、高性能计算等数据密集型场景中,这种“算力等数据”的矛盾尤为突出。大语言模型推理会产生海量的KV Cache,对内存带宽提出极高要求。当内存带宽成为瓶颈时,再多的CPU核心也无法充分发挥作用——这就是“内存墙”的实质。
三、MRDIMM vs RDIMM vs HBM:三条不同的技术路径
在理解MRDIMM的价值之前,需要先厘清它与RDIMM、HBM之间的定位差异。
3.1 MRDIMM vs RDIMM:同插槽、翻倍带宽
MRDIMM与RDIMM最直观的区别在于带宽。
第一代MRDIMM的传输速率已达到8800MT/s,单条容量最高256GB,相比标准DDR5 RDIMM的6400MT/s,带宽提升了约37.5%。第二代MRDIMM目标速率锁定在12800MT/s,是当前主流RDIMM的两倍。在AI负载下,第二代MRDIMM相对DDR5 RDIMM的带宽可提升2.3倍。
更关键的是,MRDIMM与RDIMM采用相同的连接器和外形规格,无需对主板做任何更改。这意味着数据中心可以在现有服务器平台上享受带宽升级,无需等待DDR6的全面铺开。
除了带宽,MRDIMM在延迟和总线效率上同样表现突出。与RDIMM相比,MRDIMM的有效内存带宽提升高达39%,总线效率提高15%以上,延迟降低高达40%。
3.2 MRDIMM vs HBM:各司其职,并非替代
HBM(高带宽内存)与GPU集成,作为GPU的专用显存使用。而MRDIMM是CPU直接访问的主内存。
澜起科技在投资者互动平台明确表示:DRAM内存模组(如RDIMM和MRDIMM)属于服务器主内存,与HBM的应用场景不同,分别有相对独立的市场空间,二者都将受益于AI产业的发展,并非竞争或替代关系。
MRDIMM与HBM服务于AI计算中两个不同的层级:HBM解决GPU内部的“显存墙”,MRDIMM解决CPU与内存之间的“内存墙”。两者协同,而非对立。
四、性能实测:MRDIMM在AI场景中的真实表现
理论数据之外,实际测试更能说明问题。
在AI推理的KV Cache密集型场景中,MRDIMM的优势尤为明显:
在大语言模型推理领域,MRDIMM的带宽优势可带来性能提升超过30%。英特尔表示,MRDIMM尤其适用于科学计算、小语言模型、传统深度学习和推荐系统等工作负载。
五、对采购端的影响:接口芯片价值量跃升
MRDIMM不仅是技术上的升级,更深刻影响着服务器内存的成本结构。
传统RDIMM仅需1颗RCD芯片,接口芯片成本约7美元。而一根MRDIMM需要1颗MRCD加10颗MDB,接口芯片价值量跃升至超70美元——整整十倍的提升。
这意味着,当MRDIMM逐步渗透市场时,服务器内存模组的单条成本将显著上升。财通证券预测,在乐观情况下,2030年MRDIMM在服务器内存中的渗透率可达65%,MRCD和MDB芯片的需求量将分别达到数亿颗级别