跳到正文
原文
NVIDIA Blog(RSS)· Zhihan Jiang·· 15 天前AI 评分54

NVIDIA Vera Rubin NVL72 首次参加 MLPerf Inference v6.1,吞吐最高达 GB300 NVL72 的 3.7x

NVIDIA Vera Rubin NVL72 Delivers Leading Performance in MLPerf Inference v6.1 Debut

AI 导读

NVIDIA Vera Rubin NVL72 首次提交 MLPerf Inference v6.1 预览结果,在 Qwen3-VL 上吞吐最高达 GB300 NVL72 的 3.7x,在 DeepSeek-R1 上达 2.5x,分别使用 vLLM 搭配 NVIDIA Dynamo 和 TensorRT-LLM。

来源:NVIDIA Blog(RSS) · blogs.nvidia.com