2026 年 8 月 25 日——阿里云通义千问团队于 8 月 25 日发布预告,将于 2026 年 8 月 26 日晚开源新模型 Qwen3.8-Flash-Next。据官方预告,该模型基于下一代 Qwen4 架构构建,是原生多模态的混合专家(MoE)模型,这是 Qwen4 架构相关信息首次随开源计划对外披露。

Qwen3.8 系列于 2026 年 8 月 3 日正式发布,包含旗舰版 Qwen3.8-Max 与轻量版 Qwen3.8-27B。此后系列开源节奏密集:8 月 12 日至 13 日,旗舰版 Qwen3.8-2.4T-A95B 权重上架 Hugging Face 与 ModelScope;8 月 14 日晚,27B 权重开放。据 Hugging Face 平台统计,截至 8 月 20 日,Qwen3.8-27B 系列衍生版合计下载量已超过 780 万次,并在 HF 热榜占据 9 席。

1. 官方预告信息

据官方预告内容,Qwen3.8-Flash-Next 定于北京时间 2026 年 8 月 26 日晚开放模型权重,模型基于下一代 Qwen4 架构,采用混合专家(MoE)结构,支持原生多模态输入。

从已公布的有限信息看,该模型与系列前作存在两处明显差异。其一,已开源的 Qwen3.8-Max 权重版为纯文本模型,多模态能力仅通过云端 API 提供;Qwen3.8-27B 为稠密架构,其多模态属性据媒体报道,具体以官方模型卡为准。按预告信息,Qwen3.8-Flash-Next 将是 Qwen3.8 系列中首款以开源权重形式发布的原生多模态 MoE 模型。其二,官方称该模型基于下一代 Qwen4 架构构建,而此前开源的 Qwen3.8 两款模型仍沿用 Qwen3.8 系列既有架构。

截至 8 月 25 日发稿,官方尚未公布 Qwen3.8-Flash-Next 的参数规模、激活参数数量、上下文长度、许可证类型及上线平台等信息,上述内容需以 8 月 26 日晚官方发布为准。

2. 已知信息与待公布事项

项目 信息 信息状态
模型名称 Qwen3.8-Flash-Next 官方预告
开源时间 2026 年 8 月 26 日晚(北京时间) 官方预告
架构 下一代 Qwen4 架构 官方预告
结构类型 混合专家(MoE) 官方预告
输入模态 原生多模态 官方预告
参数规模与激活参数 未公布 截至 8 月 25 日发稿
上下文长度 未公布 截至 8 月 25 日发稿
许可证类型 未公布 截至 8 月 25 日发稿
上线平台 未公布 截至 8 月 25 日发稿

数据口径说明:表中前五项来自官方预告;系列前作惯例为同步上线 Hugging Face 与 ModelScope 平台,Qwen3.8-Flash-Next 的实际上线渠道以官方发布为准。

3. 与 Qwen3.8 已开源模型对比

项目 Qwen3.8-Max(Qwen3.8-2.4T-A95B) Qwen3.8-27B Qwen3.8-Flash-Next(预告)
开源日期 2026 年 8 月 12 日至 13 日 2026 年 8 月 14 日 2026 年 8 月 26 日晚(预告)
总参数 2.4 万亿 约 270 亿 未公布
激活参数 950 亿 全部激活(稠密) 未公布
架构 稀疏 MoE(Gated DeltaNet + MoE + Gated Attention) 稠密(Dense) 下一代 Qwen4 架构 MoE
原生上下文 262,144 Token 262,144 Token 未公布
输入模态 纯文本(多模态仅限 API 版) 原生多模态(据媒体报道) 原生多模态
许可证 定制协议 Apache 2.0 未公布

表中 Qwen3.8-Max 与 Qwen3.8-27B 数据来自官方发布信息,Qwen3.8-Flash-Next 一列来自官方预告,其余项截至发稿未公布。

8 月 26 日晚开源后,可供关注的信息包括:模型参数规模与激活参数比例、是否延续 262K 原生上下文设定、许可证沿用定制协议还是转向 Apache 2.0,以及推理框架 vLLM、SGLang 的适配进度。