跳到正文
热点事件观察中

vLLM 支持 NVIDIA Vera Rubin NVL72

1 篇报道1 个报道来源1 天前更新

先了解这件事

AI 综述

2026年10月9日,vLLM 社区(Inferact、NVIDIA、Red Hat)在 vLLM Blog 宣布,vLLM 已支持 NVIDIA Vera Rubin NVL72 平台,并公布早期性能结果:吞吐量达 GB200 NVL72 的 7.8 倍。报道称,vLLM 目前即可在 Vera Rubin NVL72 上运行,提供每日容器构建,并支持 DeepSeek、Moonshot AI、Z.ai 和 MiniMax 等模型。用户可从 vLLM 的 Docker Hub 拉取并使用基于 CUDA 13.4 和 PyTorch 2.15 构建的 nightly 镜像 vllm/vllm-openai:cu134-nightly,用于 Rubin 硬件。针对 Rubin 的每日容器构建已可用(#55953),由 #53443 与 #54640 提供 CUDA 13.4 上的 Rubin 构建路径,并由 #56545 与 #59288 完成 Rubin 依赖更新。报道还称,随着获得更多 Vera Rubin NVL72 节点,将扩大测试并加速优化,预计后续性能还会提升。

AI 根据报道生成 · 3 小时前更新

报道时间线

沿着报道,了解事件的不同侧面。

10月9日
  1. vLLM Blog精选
    vLLM 支持 NVIDIA Vera Rubin NVL72,吞吐量达 GB200 NVL72 的 7.8 倍

    vLLM 宣布已支持 NVIDIA Vera Rubin NVL72,提供每日容器构建,并可在该平台上运行 DeepSeek、Kimi、GLM 和 MiniMax 等模型。

本事件热度走势

可比范围当前
4
可比范围峰值
510月10日 11:00
近 24 小时变化
–

趋势仅比较持续完整观测到的相同主体,范围可能小于当前热度统计。移动指针或点击图表查看每小时热度;键盘可用左右方向键切换。