跳到正文
热点事件持续更新

从1x3090到20台DGX Spark的本地部署实践

1 篇报道1 个报道来源13 小时前更新

先了解这件事

AI 综述

2026年10月4日,r/LocalLLaMA 用户 /u/ciprianveg 分享其本地大模型部署的扩展历程:从单张 3090 起步,经历 16x3090 集群,最终转向 ASUS GB10(DGX Spark)。据其自述,他曾在 NVIDIA 论坛发布 8xSparks 上首个 MiMo 2.5 Pro 与 Kimi 2.6 方案,随后又发布 16x Sparks 上首个可用的 Kimi K3 方案。他称在 8 台 DGX Spark 上跑通 Kimi K3(2.8T),并在 16x Sparks 上把 100k 上下文下的 7 t/s 优化到 300k 上下文下 20 t/s。该用户表示只使用本地托管模型,从未付费订阅商业模型,理由并非成本,而是对本地模型前景的信心。他还提到设备于 10 月 2 日到货,另为弟弟多购 4 台 Spark。报道标题称家里保险丝成为扩展的第一个瓶颈。

AI 根据报道生成 · 1 小时前更新

报道时间线

沿着报道,了解事件的不同侧面。

10月4日
  1. r/LocalLLaMA
    从 1x3090 到 20 台 DGX Spark:家里保险丝成了第一个瓶颈

    一位用户从单张 3090 起步,历经 16x3090 集群,最终用 8 台 ASUS GB10(DGX Spark)跑通 Kimi K3(2.8T),在 16x Sparks 上把 100k 上下文下的 7 t/s 优化到 300k 上下文下 20 t/s。

本事件热度走势

还没有足够的连续观测数据,暂不绘制趋势。