01 发生了什么

NVIDIA 近期披露了其 Vera Rubin NVL72 系统的性能表现,数据显示该系统在处理推理任务时提升了能效与吞吐量。

02 关键细节

  • 在 MLPerf Inference v6.1 预测试中,Vera Rubin NVL72 的吞吐量比 GB300 NVL72 高出 3.7 倍。
  • 通过 DSX MaxLPS 技术,在同等电力预算下可获得高达 40% 的 GPU 容量提升。
  • 在运行 DeepSeek V4 Pro 模型时,该系统的每兆瓦吞吐量提升至 GB300 NVL72 的 30 倍。
  • 得益于软件优化,MLPerf Inference v6.1 的性能较 v6.0 版本提升了 1.6 倍。

03 为什么重要

这一进展对于在大规模电力受限环境下部署代理智能和复杂神经网络的企业至关重要,有助于优化数据中心的运营与算力产出。

04 适合谁

基础设施工程师、IT架构师及高性能计算专家。

原始来源NVIDIA