据TF International Securities分析师郭明錤称,在GTC 2026上该项目似乎从英伟达的路线图中消失后,英伟达重新启动了Rubin CPX AI推理加速器项目。预计该产品将于2027年第一季度开始投产。重新设计后的芯片面向预填充,即推理过程中处理输入、生成KV缓存的阶段;这一阶段目前可能占推理工作负载的50%以上。预计每块CPX GPU的性能将接近标准版Rubin GPU,最大功耗为2,300瓦,配备168GB HBM4显存。相比之下,标准版Rubin GPU配备288GB HBM4,而早期CPX方案配备128GB GDDR7。一个由8块CPX组成的计算托盘可提供约1.34TB的总HBM4容量。新设计将采用独立的MGX ETL机架,允许客户部署64、128、192或256块CPX GPU。每个64 GPU模块将包含8个八GPU计算托盘和一个交换机托盘。托盘内部的GPU之间将通过NVLink连接,托盘与模块之间则通过Spectrum-6以太网连接,机架模块之间使用OSFP光纤。英伟达建议以1:1的比例将CPX与Vera Rubin NVL72系统配对:CPX负责预填充,并通过以太网RDMA将生成的KV缓存发送给Rubin GPU进行解码。此次重启与英伟达的Groq 3 LPU和LPX产品形成互补,后两者专注于低延迟解码。英伟达于8月公布第二季度营收为962.2亿美元,同比增长106%,高于市场预期的921.8亿美元;公司还表示,Vera Rubin已进入全面量产阶段,合作伙伴包括CoreWeave、Nebius、微软Azure、谷歌云和甲骨文云。截至发稿,英伟达尚未回应置评请求。