英伟达重启Rubin CPX项目及产品细节 - 英伟达已重启此前被认为从产品路线图中剔除的Rubin CPX项目,预计于2027年第一季度(1Q27)开始生产 [1][4] - 重启后的Rubin CPX提供更强的预填充(prefill)性能,并对GPU规格与机架架构作出重大改动,凸显英伟达对预填充解决方案的高度重视 [1][4] Rubin CPX GPU规格变动 - CPX提供接近Rubin的计算性能,并匹配Rubin每颗GPU最高2,300瓦的额定功耗上限 [2][5] - CPX改用168GB的HBM4(Rubin为288GB,此前CPX设计为128GB的GDDR7) [2][5] 机架设计变动 - 新版CPX采用独立的MGXETL机架,而非此前设计中与Rubin共用机架 [2][5] - 客户可根据需求选择64、128、192或256颗CPX GPU [2][5] - 在单个CPX机架内,每64颗CPX GPU构成一个机架模块,该模块由八个计算托盘(每个托盘8颗CPX GPU)和一个交换托盘组成 [2][5] 纵向扩展与横向扩展 - NVLink仅用于每个托盘内8颗CPX GPU之间的纵向扩展,每颗CPX的NVLink带宽为1–1.5TB/s(相比之下,每颗Rubin为3.6TB/s) [2][5] - 每个机架模块内各托盘之间的横向扩展通过Spectrum-6以太网运行,采用全铜L1链路 [2][5] - 跨机架模块的横向扩展则由各模块的Spectrum-6交换机经OSFP光链路处理 [2][5] 工作原理与产品定位 - CPX必须与Vera Rubin NVL72搭配使用,英伟达建议CPX与Rubin GPU按1:1的比例配置 [3][6] - CPX负责预填充并构建KV缓存,随后通过以太网RDMA将KV缓存传输给Rubin进行解码 [3][6] - 如今超过50%的AI推理工作负载来自对输入上下文的处理及相应KV缓存的构建,CPX提供了一种更灵活、成本更低的预填充处理方式 [3][7] - 每个八颗CPX的托盘拥有约1.34TB的HBM4,足以满足大多数长上下文预填充工作负载及相应的KV缓存需求 [3][7]
郭明錤:英伟达已重启Rubin CPX项目 将于2027年第一季度开始生产