跳到正文
NVIDIA Developer Blog· Michelle Horton·· 2026-08-27精选AI 评分62

阿里发布 Qwen3.8-Flash-Next 权重,预览 Qwen4 架构

Experiment with Qwen3.8-Flash-Next on NVIDIA GB300 NVL72 for Agentic Coding

AI 导读

阿里发布 Qwen3.8-Flash-Next 的模型权重,作为即将推出的 Qwen4 架构预览,供开发者实验和评估。该模型为多模态 MoE 架构,主模型 125B 参数,另有 51B N-gram 嵌入向量,每 token 激活 6B 参数,原生上下文窗口 262,144 token,可扩展至 1M token。

推荐理由

阿里放出 Qwen3.8-Flash-Next 权重作为 Qwen4 架构预览,读者可据此了解其 MoE 结构与上下文规格。

正文 · AI 翻译

Decorative image.阿里巴巴发布了 Qwen3.8-Flash-Next 的模型权重,作为即将推出的 Qwen4 架构的预览版,供开发者实验和评估。它……Decorative image.

阿里巴巴发布了 Qwen3.8-Flash-Next 的模型权重,作为即将推出的 Qwen4 架构的预览版,供开发者实验和评估。这是一个多模态混合专家(MoE)模型,主模型拥有 125B 参数,并额外补充了 51B 的 N-gram 嵌入,每个 token 激活 6B 参数。它具有原生 262,144 token 的上下文窗口,可扩展至 1M token……

来源

来源:NVIDIA Developer Blog · developer.nvidia.com