vLLM 支持 NVIDIA Vera Rubin NVL72
热点事件观察中
vLLM 支持 NVIDIA Vera Rubin NVL72
1 篇报道1 个报道来源1 天前更新
先了解这件事
AI 综述
2026年10月9日,vLLM 社区(Inferact、NVIDIA、Red Hat)在 vLLM Blog 宣布,vLLM 已支持 NVIDIA Vera Rubin NVL72 平台,并公布早期性能结果:吞吐量达 GB200 NVL72 的 7.8 倍。报道称,vLLM 目前即可在 Vera Rubin NVL72 上运行,提供每日容器构建,并支持 DeepSeek、Moonshot AI、Z.ai 和 MiniMax 等模型。用户可从 vLLM 的 Docker Hub 拉取并使用基于 CUDA 13.4 和 PyTorch 2.15 构建的 nightly 镜像 vllm/vllm-openai:cu134-nightly,用于 Rubin 硬件。针对 Rubin 的每日容器构建已可用(#55953),由 #53443 与 #54640 提供 CUDA 13.4 上的 Rubin 构建路径,并由 #56545 与 #59288 完成 Rubin 依赖更新。报道还称,随着获得更多 Vera Rubin NVL72 节点,将扩大测试并加速优化,预计后续性能还会提升。
AI 根据报道生成 · 3 小时前更新
最新进展10月9日 08:00
vLLM 支持 NVIDIA Vera Rubin NVL72,吞吐量达 GB200 NVL72 的 7.8 倍报道时间线
沿着报道,了解事件的不同侧面。
10月9日
- vLLM Blog精选vLLM 支持 NVIDIA Vera Rubin NVL72,吞吐量达 GB200 NVL72 的 7.8 倍
vLLM 宣布已支持 NVIDIA Vera Rubin NVL72,提供每日容器构建,并可在该平台上运行 DeepSeek、Kimi、GLM 和 MiniMax 等模型。
本事件热度走势
- 可比范围当前
- 4
- 可比范围峰值
- 510月10日 11:00
- 近 24 小时变化
- –
0246
11:0012:0013:00
趋势仅比较持续完整观测到的相同主体,范围可能小于当前热度统计。移动指针或点击图表查看每小时热度;键盘可用左右方向键切换。