NVIDIAが本格出荷を始めた次世代AIシステム「Vera Rubin」で、中核部品であるスーパーチップの原価のうち約62%をメモリが占めることが明らかになりました。最大の費目はGPUに載るHBM4ではなく、CPU側に積まれるスマートフォン向けメモリです。
GPU側のHBMは据え置き、増えたのはCPUに載るスマホ用メモリ
Vera Rubinのスーパーチップは、Vera CPU 1基とRubin GPU 2基を束ねた構成で、メモリはGPUに直結するHBM4と、CPU側に載るLPDDR5Xの2種類を搭載しています。このうちGPU側のHBM4は12段×8スタックで288GBとなり、Blackwell B200の192GBからは5割増えたものの、前世代上位のBlackwell Ultra B300からは据え置かれています。一方のCPU側は最大1.5TBのLPDDR5Xに対応し、前世代Grace CPUの最大480GBから3倍超に増えました。
投資銀行UBSの部品原価分析によると、このスーパーチップの原価に占めるメモリの比率は約62%で、前世代のGB300スーパーチップの53%から9ポイント上昇したとのことです。原価総額も約2.1倍に増えていますが、メモリ費用はそれを上回る約2.5倍に増えています。この増加分は容量が変わらないHBM4ではなく、3倍超に膨らんだCPU側のLPDDR5Xによるもので、これをモジュール化した「SOCAMM2」がHBM4を上回る最大の費目になっています。
このSOCAMM2は、スマートフォンや薄型ノートで使われる省電力メモリLPDDR5XをAIサーバー向けにモジュール化した製品で、複数のDRAMをまとめてCPUの近くに配置し、交換もできる設計です。HBMほどの帯域はない代わりに、サーバー向けのDDR5 RDIMMより帯域と電力効率で優れ、少ない電力で大容量を確保できるため、AIサーバー向けの主力メモリへ位置付け直す動きが規格面でも進んでいます。
このスーパーチップを1ラックへまとめたVera Rubin NVL72では、当初の仕様でRubin GPU 72基とVera CPU 36基が載り、DRAMの合計は74.7TBに達します。このうちCPU側のLPDDR5Xだけで54TBを占め、プレミアムスマートフォン1台あたり12GB換算で約4,500台分に相当します。こうしたAIサーバーによるLPDDR需要の急増を背景に、エントリー向けスマホが4GBへ戻る見通しが出るほど、メモリ需給は逼迫しています。
性能優先のNVIDIAもメモリ容量を確保できず
AI向けに大量のメモリを買い付けているNVIDIAでさえ、Vera Rubin向けのメモリを十分に確保できておらず、SOCAMM2の容量はすでに当初計画の約半分へ引き下げられたとのことです。
さらにThe Informationは、2027年投入予定の上位モデルRubin UltraでもHBM容量の削減が検討されていることを明らかにしています。NVIDIAは当初、Rubin UltraではGPU 1基あたり1TB(16スタック)のHBM4Eを積む計画でしたが、直近でテストされているサンプルには192GB水準と256GB水準のものが含まれ、現行Rubin GPUの288GBすら下回るとのことです。
特に、Rubin Ultraを巡っては製造上の問題で4GPU構成を断念して2GPU構成へ後退しており、性能を最優先してきたNVIDIAもメモリ容量まで削らざるを得なくなるなど、供給が追いついていない状況が浮き彫りになっています。なお、このメモリ不足を背景に、メモリのGB単価は約20年前の水準まで戻っており、HBMはAIサーバー向け、LPDDRはスマートフォンや薄型ノート向けという用途の住み分けが崩れたいま、これらの機器に載るLPDDR5XもAIサーバーと生産枠を奪い合うメモリになっています。


