NVIDIA Blog· Zhihan Jiang·· 15 天前精选AI 评分62
NVIDIA Vera Rubin NVL72 首登 MLPerf Inference v6.1,吞吐最高达 GB300 NVL72 的 3.7 倍
NVIDIA Vera Rubin NVL72 Delivers Leading Performance in MLPerf Inference v6.1 Debut
AI 导读
NVIDIA 在 MLPerf Inference v6.1 首次提交 Vera Rubin NVL72 预览成绩,在 Qwen3-VL 上吞吐最高达 GB300 NVL72 的 3.7 倍,在 DeepSeek-R1 上最高为 2.5 倍。
推荐理由
NVIDIA 官方首次公布 Vera Rubin NVL72 的 MLPerf 推理成绩,并给出跨机架扩展与软件迭代的量化对比,可供判断推理经济学走向。
来源:NVIDIA Blog · blogs.nvidia.com