一套 AI 机架到底值多少钱,已经不能只数 GPU。5 月 21 日,多家媒体转引 Morgan Stanley Research 的估算称,Nvidia 下一代 Vera Rubin NVL72 面向大型云服务商的单机架成本可能达到约 780 万美元,其中内存相关支出约 200 万美元,占整套系统的四分之一左右。
这个数字足够醒目,但需要先划清边界:它是机构对特定配置的成本或采购口径估算,不是 Nvidia 公布的建议零售价。它真正揭示的也不是一张确定的报价单,而是 AI 基础设施成本重心正在从 GPU 芯片扩展到内存、存储、网络、供电和液冷组成的完整系统。
780 万美元是怎样拼出来的
Vera Rubin NVL72 是一台机架级计算系统。按照 Nvidia 公布的规格,一套系统集成 72 颗 Rubin GPU 和 36 颗 Vera CPU,并通过第六代 NVLink 把整机组织成一个统一的加速器。
Morgan Stanley 的估算中,Rubin GPU 按每颗约 5.5 万美元计算,72 颗合计 396 万美元;Vera CPU 按每颗约 5000 美元计算,36 颗合计 18 万美元。两项相加约 414 万美元,仍然是整机最大成本,但只占 780 万美元估值的一半多。
变化最大的部分是内存。媒体转引的表格把 Vera Rubin NVL72 的内存成本估至 2,001,600 美元,相比 GB300 NVL72 的约 37.4 万美元增加 435%。剩余成本则分布在 NVLink 交换、网络、PCB、封装、供电、散热和机架集成等环节。换句话说,GPU 依旧昂贵,但它已经不足以解释整套系统的价格。
74.7 TB 内存把配角推到台前
内存成本上升首先来自容量。Nvidia 的规格表显示,每颗 Rubin GPU 配置 288 GB HBM4,全机架合计 20.7 TB HBM4;每颗 Vera CPU 配置 1.5 TB LPDDR5X,全机架合计 54 TB LPDDR5X。两者相加达到 74.7 TB,而且承担的任务不同:HBM4 贴近 GPU,负责高带宽计算;LPDDR5X 则为 CPU 侧的数据处理与并发任务提供容量。
这也解释了为什么“内存”不能再被当作一个附属物料。按照 Tom's Hardware 对估算的拆解,即便按每 GB 8 美元估算,54 TB LPDDR5X 本身就约值 40.8 万美元;如果计入 SOCAMM2 模组、测试和渠道加价,支出还会继续上升。
同一估算还把约 100 万美元的 3D NAND 存储计入 Vera Rubin 系统。这个数字并未得到 Nvidia 官方确认,却提示了另一个趋势:当推理系统需要容纳更长上下文、更多 KV cache 和更复杂的数据管线时,机架内的高速存储也开始进入核心物料清单。HBM4、LPDDR5X 和 NAND 的供应、良率与交付节奏,会共同影响整机何时能够上线。
买家采购的是系统,不再只是 GPU
Vera Rubin 的设计本身就在强化这种系统属性。Nvidia 将 Vera CPU、Rubin GPU、NVLink 6、ConnectX-9、BlueField-4 和 Spectrum-6 作为协同工作的完整平台;计算托盘还集成供电、液冷、网络和管理模块。复杂度从单颗芯片转移到机架内部的协同设计,报价自然也会覆盖更多价值环节。
对云服务商而言,这会改变预算和交付管理方式。过去可以用“GPU 数量乘单价”粗略估算集群投入,现在还必须同时核算主机内存、机架存储、交换网络、配电、冷却以及维保。任何一个环节供货不足,都可能让已经到位的 GPU 无法形成可用算力。
对服务器厂商而言,预组装程度提高可以缩短部署时间,却也可能压缩自主设计空间。Tom's Hardware 此前报道称,Nvidia 可能向合作伙伴提供高度集成的 L10 计算托盘,让 ODM 更集中于机架集成、配电、冷却分配和管理软件。这个方向尚未成为 Nvidia 的公开定价承诺,但它与 Vera Rubin 强调的机架级共同设计是一致的。
先别把估算当成价目表
780 万美元不应被理解为所有 Vera Rubin NVL72 的统一成交价。Nvidia 没有公布 NVL72 的官方标价,配置、采购量、网络与存储选项、保修服务和交付条款都会改变最终价格。另一篇基于供应链消息的报道给出的 Vera Rubin NVL72 报价区间是 500 万至 700 万美元,并提醒部分流传数字只覆盖 ODM 出厂成本,不含完整维保。
因此,这份估算最有价值的部分不是小数点后的精确金额,而是成本结构:在拥有 72 颗 GPU 的系统里,内存相关支出可能已接近总成本的四分之一。对准备部署下一代 AI 集群的公司来说,真正需要锁定的已不只是 GPU 配额,而是一整套内存、存储、网络、供电和冷却能力。Vera Rubin 把竞争从“谁能买到芯片”,进一步推向“谁能按时交付并运营完整系统”。