跳到正文
原文
NVIDIA Blog· Zhihan Jiang·· 17 天前精选AI 评分62

NVIDIA Vera Rubin NVL72 首次亮相 MLPerf Inference v6.1 并取得领先性能

NVIDIA Vera Rubin NVL72 Delivers Leading Performance in MLPerf Inference v6.1 Debut

AI 导读

NVIDIA 在 MLPerf Inference v6.1 首次提交 Vera Rubin NVL72 预览结果,在 Qwen3-VL 上吞吐最高达 GB300 NVL72 的 3.7 倍,在 DeepSeek-R1 上最高达 2.5 倍。

推荐理由

MLPerf v6.1 首次提交数据给出 Vera Rubin NVL72 相对 GB300 的吞吐倍数与 99% 扩展效率,可作推理基础设施选型的量化参照。

来源:NVIDIA Blog · blogs.nvidia.com