跳到正文
原文
NVIDIA Blog· Zhihan Jiang·· 15 天前精选AI 评分62

NVIDIA Vera Rubin NVL72 首次亮相 MLPerf Inference v6.1 并取得领先性能

NVIDIA Vera Rubin NVL72 Delivers Leading Performance in MLPerf Inference v6.1 Debut

AI 导读

NVIDIA Vera Rubin NVL72 在 MLPerf Inference v6.1 首次预览提交中,于 Qwen3-VL 上吞吐量最高达 GB300 NVL72 的 3.7 倍,于 DeepSeek-R1 上最高达 2.5 倍。

推荐理由

原文给出 Vera Rubin NVL72 在 MLPerf Inference v6.1 的首次提交数据,读者可据此比较其与 GB300 NVL72 的吞吐差距。

来源:NVIDIA Blog · blogs.nvidia.com