跳到正文
热点事件持续更新

RDNA4 上跑 Qwen 3.8 的推理方案讨论

1 篇报道1 个报道来源2 小时前更新

先了解这件事

AI 综述

2026 年 10 月 6 日,r/LocalLLaMA 出现一则讨论帖,询问在 RDNA4 架构上运行 Qwen 3.8 的当前最佳推理方案。帖中一名用户称,其在双 R9700 显卡上通过 vllm-radiance 运行 Qwen 3.8 27B FP8(Swift 1.5 FP8),实测 prefill 达到 5000t/s,代码生成速度超过 130t/s。该数据由发帖用户自述,属单一来源的实测报告,尚未见其他来源独立验证,也未见针对其他硬件配置或量化格式的对比结果。目前事件仍停留在社区经验分享阶段,尚无官方或第三方评测确认这一方案是否为 RDNA4 上的最优选择。

AI 根据报道生成 · 1 小时前更新

报道时间线

沿着报道,了解事件的不同侧面。

10月6日
  1. r/LocalLLaMA
    RDNA4 上跑 Qwen 3.8 的当前最佳推理方案是什么?

    有用户在双 R9700 上通过 vllm-radiance 运行 Qwen 3.8 27B FP8(Swift 1.5 FP8),实测 prefill 达 5000t/s、代码生成 130t/s+。

本事件热度走势

还没有足够的连续观测数据,暂不绘制趋势。