英伟达近日宣布,其最新研发的Vera Rubin架构正朝着万亿级规模部署稳步迈进。这一消息由英伟达官方发布,标志着公司在高性能计算领域再次取得重大突破。
据英伟达介绍,公司正在全力加速Vera Rubin NVL72的量产进程。目前,这款产品已在多家全球知名云服务提供商的内部环境中投入运行,包括CoreWeave、Google Cloud、Microsoft Azure以及Oracle Cloud Infrastructure等。这一部署不仅彰显了英伟达在技术上的领先地位,也体现了其与合作伙伴的紧密协作。
为了满足全球范围内不断增长的计算需求,英伟达为Vera Rubin构建了前所未有的机架级供应链体系。该体系覆盖30个国家,拥有超过350个生产基地,堪称行业内规模最大、成熟度最高的供应链网络。
CoreWeave公司作为英伟达的重要合作伙伴,也在近日分享了其与Vera Rubin NVL72相关的最新进展。据悉,CoreWeave于6月初成功完成了业界首个NVIDIA Vera Rubin NVL72的上电与验证工作,并搭建了完整的端到端机架级系统。该系统集成了电源、冷却、网络及计算等核心组件,且均已通过验证并稳定运行。
在性能测试方面,英伟达基于当前驱动智能体AI激增的推理模型DeepSeek R1,对Vera Rubin NVL72和NVIDIA Blackwell NVL72进行了对比评估。测试重点聚焦于每兆瓦吞吐量与交互性之间的关系,其中交互性通过TPS/user指标衡量,反映了用户或智能体在模型处理任务时的响应速度。
测试结果显示,在相同的DeepSeek R1工作负载下,Vera Rubin NVL72在匹配的交互性目标下,每兆瓦Tokens吞吐量较NVIDIA GB200 NVL72提升了10倍。这一数据充分证明了Vera Rubin NVL72在能效比方面的显著优势,也为未来大规模部署提供了有力支撑。
