英伟达(NVIDIA)的Vera Rubin终于问世了,随着首批系统启动运行,它所带来的AI性能远超Blackwell,达到了不可思议的水平。

英伟达Vera Rubin现已部署,在DeepSeek-R1(DeepSeek-R1)模型中实现每秒80万词元,功耗相同的情况下碾压Blackwell。
好了,它来了:这是迄今为止世界上最强大的AI平台——Vera Rubin。作为英伟达“极致协同设计”计划的一部分——该计划旨在提供一整套AI就绪的硬件与软件堆栈,实现前所未有的每瓦性能,并提供最低的词元成本——Vera Rubin开启了AI的新纪元。
英伟达Vera Rubin平台是一套多元化的硬件与软件解决方案,是五层蛋糕框架的体现,构成了一个全面的AI生态系统。该堆栈共包含六个托盘,每个托盘都集结了世界上最先进的芯片:
英伟达Vera Rubin NVL72计算托盘(Rubin + Vera + Grace Bluefield + ConnectX-9)
英伟达Vera Rubin NVL72 NVLink交换托盘(NVLink6 Switch)
英伟达Vera CPU托盘(Vera)
英伟达Spectrum-6 SPX交换托盘(Spectrum-6 Switch)
英伟达Groq 3 LPX托盘(Groq 3)
英伟达Vera Bluefield-4 STX存储托盘(Vera Bluefield)
英伟达的机架级解决方案也经历了持续的改进。就像SpaceX改进Raptor发动机,最终诞生了更流线、更简洁、功能更强大的Raptor 3一样,英伟达也优化了其Vera Rubin托盘,摒弃了线缆、风扇和外壳,转而采用更流线型的液冷系统,以模块化方式无缝集成到机架中。这表明,其工程努力远不止于芯片和代码本身。
现在,英伟达首批Vera Rubin NVL72系统正在启动,首批结果也已出炉。上个月,我们报道了Coreweave(Coreweave)和其他主要云服务商正在安装并验证英伟达的Vera Rubin平台;而今天,我们终于能看到它们的实际表现了。
在由Coreweave分享的首次DeepSeek R1测试中,该公司Vera Rubin平台每瓦的词元吞吐量是Grace Blackwell(Grace Blackwell)的10倍。一套英伟达 GB200 NVL72 Grace Blackwell系统在150MW功耗下仅能处理8万词元/秒。而英伟达 VR200 NVL72 Vera Rubin平台在相同功耗下可实现80万词元/秒,在处理MoE(混合专家模型)工作负载方面展现了巨大的提升。
而这仅仅是个开始;随着更多系统上线并展示其潜力,英伟达的Vera必将颠覆市场。凭借强大的网络解决方案组合,使企业能够实现千兆级AI规模,英伟达再次证明了其为何是AI领域的领导者。



