Nvidia、Rubin CPXアクセラレーターを再始動 2027年第1四半期に生産開始予定

  • NvidiaはAI推論のプリフィル向けにRubin CPXアクセラレーターを再始動したと、Ming-Chi Kuo氏が述べた。
  • 各CPX GPUはHBM4を168GB搭載し、最大消費電力は2,300ワットとなる予定である。
  • CPXの生産は2027年第1四半期に始まる見通しである。

TF International Securitiesのアナリスト、Ming-Chi Kuo氏によると、NvidiaはRubin CPX AI推論アクセラレーターを再始動した。同プロジェクトはGTC 2026で同社のロードマップから消えたように見えていた。生産は2027年第1四半期に始まる見通しである。再設計されたチップは、推論の入力処理段階であり、KVキャッシュを生成し、現在の推論ワークロードの50%超を占める可能性があるプリフィルを対象とする。各CPX GPUは標準Rubin GPUに近い性能を発揮すると見込まれ、最大消費電力は2,300ワット、HBM4メモリー容量は168GBとなる。これは、標準Rubin GPUのHBM4容量288GB、および従来のCPX計画におけるGDDR7容量128GBと比較したものだ。8枚のカードを搭載するCPXコンピュートトレイ1基は、合計約1.34TBのHBM4容量を提供する。新設計では独立したMGX ETLラックを使用し、顧客は64基、128基、192基、または256基のCPX GPUを導入できる。64基のGPUモジュールはそれぞれ、8基の8-GPUコンピュートトレイと1基のスイッチトレイで構成される。トレイ内のGPU間はNVLinkで接続し、トレイおよびモジュール間はSpectrum-6 Ethernetで接続する。ラックモジュール間にはOSFP光ファイバーを使用する。Nvidiaは、CPXとVera Rubin NVL72システムを1対1の比率で組み合わせることを推奨している。CPXがプリフィルを処理し、その結果得られたKVキャッシュをEthernet RDMA経由でRubin GPUに送信し、デコードを行う構成である。今回の再始動は、低レイテンシーのデコードに重点を置くNvidiaのGroq 3 LPUおよびLPX製品を補完するものとなる。Nvidiaは8月、2025年第2四半期の売上高が962億2000万ドルとなり、前年同期比106%増で、市場予想の921億8000万ドルを上回ったと報告した。また、Vera Rubinが量産体制に入ったとし、パートナーにはCoreWeave、Nebius、Microsoft Azure、Google Cloud、Oracle Cloudなどが含まれると述べた。記事執筆時点で、Nvidiaはコメント要請に回答していなかった。

当サイトの情報はAIを用いて生成されており、正確性を保証するものではありません。 参考情報としてご活用ください。