NVIDIA Blog· Zhihan Jiang·· 14 天前AI 评分42
NVIDIA Vera Rubin NVL72 首次参加 MLPerf Inference v6.1 即获领先性能
NVIDIA Vera Rubin NVL72 Delivers Leading Performance in MLPerf Inference v6.1 Debut
AI 导读
NVIDIA Vera Rubin NVL72 首次提交 MLPerf Inference v6.1 预览成绩,在 Qwen3-VL 上吞吐最高达 GB300 NVL72 的 3.7x,在 DeepSeek-R1 上达 2.5x,使用 vLLM、Dynamo 和 TensorRT-LLM。
来源:NVIDIA Blog · blogs.nvidia.com