跳到正文
原文
NVIDIA Blog· Zhihan Jiang·· 13 天前精选AI 评分61

NVIDIA Vera Rubin NVL72 在 MLPerf Inference v6.1 中发布领先性能

NVIDIA Vera Rubin NVL72 Delivers Leading Performance in MLPerf Inference v6.1 Debut

AI 导读

NVIDIA Vera Rubin NVL72 系统在 MLPerf Inference v6.1 封闭组首秀,Qwen3-VL 离线/服务器/交互场景下吞吐量较 GB300 NVL72 最高提升 3.7 倍,使用 vLLM 配合 NVIDIA Dynamo 开源推理框架。

推荐理由

NVL72在MLPerf v6.1中首次提交验证性能,3.7倍吞吐提升和99%线性扩展给出实际推理经济性的基准参考。

来源:NVIDIA Blog · blogs.nvidia.com