NVIDIA Blog· Zhihan Jiang·· 15 天前
NVIDIA Vera Rubin NVL72 首次亮相 MLPerf Inference v6.1,吞吐最高提升 3.7 倍
NVIDIA Vera Rubin NVL72 Delivers Leading Performance in MLPerf Inference v6.1 Debut
SI 导读
NVIDIA 在 MLPerf Inference v6.1 首次提交 Vera Rubin NVL72 预览成绩,在 Qwen3-VL 上吞吐最高达 GB300 NVL72 的 3.7 倍,在 DeepSeek-R1 上最高 2.5 倍。
精选SI 评分62
推荐理由
MLPerf v6.1 首次提交数据给出 Vera Rubin 相对 GB300 的吞吐倍数与 99% 扩展效率,可据此判断推理成本走向。
来源:NVIDIA Blog · blogs.nvidia.com