返回行业情报

NVIDIA Vera Rubin平台发布:性能功耗比与Token成本双突破

NVIDIA Vera Rubin Driving Performance Per Watt, Lowest Token Cost for Partners Worldwide

NVIDIA正式发布Vera Rubin平台,已获全球300多家合作伙伴部署。该平台通过七芯片五托盘的极致协同设计,实现每兆瓦性能提升10倍、Token成本降低至十分之一。CoreWeave实测显示,Vera Rubin NVL72在DeepSeek-R1基准上比Grace Blackwell NVL72每兆瓦吞吐量提升10倍。平台还集成第六代NVLink、Spectrum-X以太网及光共封装技术,并宣布与微软、Mistral合作推进欧洲主权AI基础设施建设。

深度解读

NVIDIA Vera Rubin平台正式进入大规模量产阶段,其核心价值并非简单的算力堆砌,而是通过从芯片到电网的极致协同设计,实现了单位功耗性能的飞跃式提升,将AI工厂的竞争维度从“算力峰值”彻底转向“每瓦特产出”与“每Token成本”。

这一代平台的革命性,首先体现在其颠覆性的系统架构上。Vera Rubin NVL72不再是传统意义上由独立部件拼装的服务器,而是将七颗全新芯片(包括Vera CPU、Groq 3 LPX、Spectrum-6 SPX等)和五个机架托盘作为单一系统进行协同设计。这种“外科手术式”的整合,直接消除了传统系统中因部件间通信协议、物理接口不匹配而产生的巨大性能损耗和功耗浪费。其直接成果是,机架内不再有电缆、风扇或软管,计算托盘的组装时间从数小时骤降至一分钟,这不仅仅是制造效率的提升,更意味着在同等物理空间内可部署的计算密度得到了指数级增长,为“千兆级”AI工厂的物理实现扫清了障碍。

性能跃迁的实证:CoreWeave的10倍里程碑

衡量这一代平台成败的关键,在于真实负载下的能耗表现。CoreWeave在DeepSeek-R1模型上进行的首批实测数据,给出了最有力的回答:与上一代Grace Blackwell NVL72相比,Vera Rubin NVL72实现了每兆瓦吞吐量10倍的提升。这一数据的意义远超纸面参数,它直接定义了AI工厂的经济模型——在电力成本与供应成为全球AI扩张首要瓶颈的当下,每兆瓦产出的Token数量决定了AI服务的边际成本。10倍的提升意味着,在同样的电力合同下,运营商可以支撑10倍的用户规模,或者将单位Token的推理成本降至原来的十分之一,这直接击穿了阻碍AI应用普及的成本壁垒。

网络与存储:突破“木桶效应”的关键拼图

当计算单元的性能被极致压榨后,数据搬运的效率便成为新的瓶颈。Vera Rubin平台为此构建了双层专用网络。用于纵向扩展(Scale-up) 的第六代NVLink,在复杂工作负载下吞吐量提升超过2倍,延迟降低3倍,数据包速率提升10倍,这确保了GPU之间如同一个统一芯片般高效协作,尤其针对混合专家模型(MoE)这类需要频繁“全对全”通信的架构至关重要。

横向扩展(Scale-out) 层面,平台引入了专为AI优化的Spectrum-X以太网和NVIDIA Photonics共封装光学器件。Spectrum-X通过自适应路由和拥塞控制,实现了比普通以太网高1.6倍的RDMA带宽,而NVIDIA Photonics作为业界首款量产共封装光学交换机,其功耗比可插拔光模块降低5倍,平均无故障时间(MTBI)提高10倍。这一组合拳直接回应了千兆级AI工厂面临的最大挑战:如何在超大规模集群中,以可接受的功耗和成本,实现数据的高速、稳定、无损传输。此外,NVLink Fusion的开放策略,允许第三方XPU接入NVLink生态,这为整个行业提供了一条通往高性能互连的捷径,而非被封闭生态所绑架。

运营革命:从“水冷”到“干冷”的范式转移

AI工厂的可持续性不仅取决于芯片能耗,更取决于整个散热基础设施的碳足迹与水资源消耗。Vera Rubin NVL72的机架设计将液体冷却入口温度提升至45摄氏度,这一看似微小的变化带来了运营层面的巨大变革。它使得数据中心可以完全依赖干冷器进行散热,从而摆脱了对冷水机组和大量水资源的依赖。据估算,对于新建AI工厂,这种高温干冷与闭环液冷相结合的设计,每年每兆瓦可节省数百万加仑的水资源。这不仅是环保责任的体现,更是为在缺水或高温地区建设AI工厂提供了可能,极大地拓展了全球算力布局的地理边界。

地缘战略与生态重构:欧洲的“主权AI”基石

Vera Rubin的发布不仅是技术事件,更是地缘政治事件。微软与Mistral AI达成的数十亿美元新协议,其核心基础设施正是基于Vera Rubin平台。这一合作并非简单的商业采购,而是欧洲追求“主权AI”的实质性落地。通过将Mistral的开放模型与微软的云基础设施(包括Azure Local和Foundry Local)结合,欧洲的政府与受监管行业(如医疗、金融)可以在完全自主控制的数据环境中部署前沿AI,无需在“创新、成本、控制”三者间做痛苦抉择。

这一布局的战略意图在于,Vera Rubin平台为欧洲提供了一个“不依赖美国科技巨头”的技术底座。它支持从训练到推理的全栈流程,并针对智能体(Agentic)工作负载进行了优化——这类应用消耗的Token数量是传统AI应用的15倍。因此,高效的底层基础设施成为支撑欧洲本土AI生态繁荣、满足其严苛数据治理法规的前提。NVIDIA正通过Vera Rubin,将自己嵌入到区域数字主权的核心位置,从单纯的芯片供应商,转变为支撑全球AI地缘格局演变的“算力基建商”。

对行业与从业者的深远影响

对于AI从业者而言,Vera Rubin带来的10倍Token效率提升,意味着“模型规模崇拜”将让位于“单位智能成本”的竞争。训练和运行更大、更复杂的模型(尤其是推理密集型应用)的经济门槛被大幅拉低,这将直接催生新一轮的AI应用创新浪潮。对于云服务商和AI工厂运营商,竞争焦点已从“能否买到GPU”转变为“能否以最低的每Token成本运营GPU集群”。那些无法跟上协同设计、高效散热和专用网络部署步伐的厂商,将在成本曲线上被迅速甩开。NVIDIA通过Vera Rubin确立的,不仅是一个性能标杆,更是一个全新的、以“每瓦特智能”为衡量标准的产业游戏规则,而全球300多家合作伙伴的部署,则宣告了这场算力效率革命的全面打响。

AI前沿NVIDIAAI基础设施算力效率