跳到正文
热点事件持续更新

Mac Mini M5 上 SSD 流式运行 Qwen Flash Next 优化实践

1 篇报道1 个报道来源3 小时前更新

先了解这件事

AI 综述

2026年10月5日,r/LocalLLaMA 用户 /u/turtleninja99 分享了一个副项目:在 Mac Mini M5 64GB 上通过 SSD 流式加载运行 Qwen Flash Next Q4。据其自述,基于日常 AI 使用场景测试,实测解码速度为 17.5 tks、提示处理为 360 tks。他称通过为提示处理中的专家流式加载设置轮播缓冲(carousel buffer),使提示处理提升 30%;又尝试用第二块外置 SSD 实现并行读取,使提示处理和解码均再提升约 15%。此外,他还搭建了一套机制,允许聊天应用调用服务器、触发编码任务,该任务在聊天结束后仍保持存活并继续运行。上述数据与优化幅度均为该开发者个人测试结果,报道未提供独立验证。

AI 根据报道生成 · 2 小时前更新

报道时间线

沿着报道,了解事件的不同侧面。

10月5日
  1. r/LocalLLaMA
    在 Mac Mini M5 64GB 上用 SSD 流式运行 Qwen Flash Next Q4

    有开发者在 Mac Mini M5 64GB 上通过 SSD 流式加载运行 Qwen Flash Next Q4,实测解码 17.5 tks、提示处理 360 tks。他加入专家流式轮播缓冲使提示处理提升 30%,并用第二块外置 SSD 并行读取再提升约 15%,还实现了聊天应用触发编码任务、任务在聊天后继续运行的机制。

本事件热度走势

还没有足够的连续观测数据,暂不绘制趋势。