Modal Blog·· 2026-08-12精选AI 评分62
千问 Qwen3.8-2.4T-A95B 开源发布并上线 Modal
Qwen3.8-2.4T-A95B now available on Modal
AI 导读
千问 Qwen3.8-2.4T-A95B 作为开放权重模型发布,并同步上线 Modal。相比 Qwen 3.7,新模型在编码、工作、研究和长周期任务上有明显提升。
推荐理由
Modal 与千问合作在模型发布当天上线托管端点,并给出基于 SGLang 与定制 DFlash 推测器的推理加速方案。
正文 · AI 翻译
Qwen3.8-2.4T-A95B 刚刚作为开放权重模型发布,现已在 Modal 上线。
相比 Qwen 3.7,最新模型在编程、工作、研究和长周期任务上都有显著提升。
我们在发布前就与 Qwen 合作,为 Modal Auto Endpoints 带来首日支持,由 SGLang 和针对 Qwen3.8 形态调优的自定义 DFlash 推测器提供支持。
立即试用,作为共享端点。
用自定义 DFlash 推测加速推理
让模型跑起来是一回事,让它跑得快是另一回事。为此,我们再次求助于 DFlash 推测器模型,因为——跟我们一起念——推测就是你所需的一切。
推测器只有在目标模型接受它草拟的 token 时才有价值,而接受率取决于草拟器是否见过与它正在预测的序列相似的序列。由于 Max 在编程、研究和工作方面的改进(这些往往使用更多工具调用),我们在训练数据中侧重了这一点以提高接受率。
立即试用
Qwen3.8-2.4T-A95B(纯文本)将在接下来一个月内作为 OpenAI 兼容的共享端点提供,采用按 token 计费。
来源:Modal Blog · modal.com