英伟达(NVIDIA)即将推出的Vera Rubin Ultra系统目前正处于变动之中,持续的传闻指向其可能降低HBM规格,即这家GPU巨头可能选择减少每个GPU中的HBM4E容量以维持利润率。

美国银行(Bank of America)今日发布了一份颇具洞察力的报告,量化了英伟达即将推出的基于Vera Rubin Ultra的Kyber机架中,HBM4E与基于LPDDR5X的SOCAMM2模块之间的动态关系。

NVIDIA-Kyber-1-scaled.jpeg

英伟达在其即将推出的基于Vera Rubin Ultra的Kyber机架中,LPDDR5X的支出将超过HBM4E。

目前,每个基础Rubin GPU配备288 GB的HBM4,分布于8个堆栈,每个GPU的带宽高达22 TB/s。与此同时,Vera CPU放弃了标准服务器RDIMM,转而采用基于LPDDR5X的SOCAMM2模块,这些模块使用平贴于主板的压缩连接器,缩短了电气走线,使LPDDR5X具备数据中心所需的信号完整性和低延迟。每个Vera CPU配备8个SOCAMM2插槽,相当于每个CPU的理论内存容量为1.5 TB的LPDDR5X(192GB模块)。

如今,美国银行刚刚发布了一份新报告,详细说明Rubin中的HBM4E成本为每GB 19.76美元。更重要的是,每个144-GPU的Kyber机架将配备216 TB的LPDDR5X,成本约为280万美元,高于124.4 TB HBM4E的250万美元账单。总体而言,每个Kyber机架的成本将达到4160万美元

与此同时,根据瑞银(UBS)的相关报告,Vera Rubin超级芯片配置中的每个Rubin GPU成本估计为9247美元,其中包括HBM4、封装、中介层和外围组件。另一方面,每个Vera CPU的成本约为20059美元,包括SOCAMM2 LPDDR5X,外加350美元的其他板载组件。然而,GPU成本的一半左右以及CPU成本的几乎所有(剥离内存后仅704美元)都是由DRAM构成的!

Blackwell服务器上,Grace CPU配备了480 GB的内存,而Blackwell GPU则提供192 GB的HBM3E(GB200)和高至288 GB的HBM3E(GB300)。不过,Vera Rubin机架上的总内存池已膨胀至74.7 TB(HBM4 + SOCAMM2)。对于Kyber机架,这一池子更是激增至惊人的340.4 TB


文章标签: #硬件 #AI #英伟达 #内存 #数据中心

负责编辑

  菠萝老师先生 

  让你的每一个瞬间都充满意义地生活,因为在生命的尽头,衡量的不是你活了多少年,而是你如何度过这些年。