NVIDIA Blog· Zhihan Jiang·· 15 天前AI 评分30
NVIDIA Vera Rubin NVL72 首登 MLPerf Inference v6.1,性能领先
NVIDIA Vera Rubin NVL72 Delivers Leading Performance in MLPerf Inference v6.1 Debut
AI 导读
NVIDIA Vera Rubin NVL72 在 MLPerf Inference v6.1 首次预览提交中,Qwen3-VL 吞吐量最高达 GB300 NVL72 的 3.7 倍,DeepSeek-R1 上最高 2.5 倍。GB300 NVL72 以 288 GPU 四机架提交实现 99% 扩展效率,软件优化较 v6.0 带来最高 1.6 倍性能提升。
来源:NVIDIA Blog · blogs.nvidia.com