NVIDIA Blog· Zhihan Jiang·· 13 天前精选AI 评分61
NVIDIA Vera Rubin NVL72 在 MLPerf Inference v6.1 中发布领先性能
NVIDIA Vera Rubin NVL72 Delivers Leading Performance in MLPerf Inference v6.1 Debut
AI 导读
NVIDIA Vera Rubin NVL72 系统在 MLPerf Inference v6.1 封闭组首秀,Qwen3-VL 离线/服务器/交互场景下吞吐量较 GB300 NVL72 最高提升 3.7 倍,使用 vLLM 配合 NVIDIA Dynamo 开源推理框架。
推荐理由
NVL72在MLPerf v6.1中首次提交验证性能,3.7倍吞吐提升和99%线性扩展给出实际推理经济性的基准参考。
来源:NVIDIA Blog · blogs.nvidia.com