2026 年 8 月 25 日——阿里云通义千问团队于 8 月 25 日发布预告,将于 2026 年 8 月 26 日晚开源新模型 Qwen3.8-Flash-Next。据官方预告,该模型基于下一代 Qwen4 架构构建,是原生多模态的混合专家(MoE)模型,这是 Qwen4 架构相关信息首次随开源计划对外披露。
Qwen3.8 系列于 2026 年 8 月 3 日正式发布,包含旗舰版 Qwen3.8-Max 与轻量版 Qwen3.8-27B。此后系列开源节奏密集:8 月 12 日至 13 日,旗舰版 Qwen3.8-2.4T-A95B 权重上架 Hugging Face 与 ModelScope;8 月 14 日晚,27B 权重开放。据 Hugging Face 平台统计,截至 8 月 20 日,Qwen3.8-27B 系列衍生版合计下载量已超过 780 万次,并在 HF 热榜占据 9 席。
1. 官方预告信息
据官方预告内容,Qwen3.8-Flash-Next 定于北京时间 2026 年 8 月 26 日晚开放模型权重,模型基于下一代 Qwen4 架构,采用混合专家(MoE)结构,支持原生多模态输入。
从已公布的有限信息看,该模型与系列前作存在两处明显差异。其一,已开源的 Qwen3.8-Max 权重版为纯文本模型,多模态能力仅通过云端 API 提供;Qwen3.8-27B 为稠密架构,其多模态属性据媒体报道,具体以官方模型卡为准。按预告信息,Qwen3.8-Flash-Next 将是 Qwen3.8 系列中首款以开源权重形式发布的原生多模态 MoE 模型。其二,官方称该模型基于下一代 Qwen4 架构构建,而此前开源的 Qwen3.8 两款模型仍沿用 Qwen3.8 系列既有架构。
截至 8 月 25 日发稿,官方尚未公布 Qwen3.8-Flash-Next 的参数规模、激活参数数量、上下文长度、许可证类型及上线平台等信息,上述内容需以 8 月 26 日晚官方发布为准。
2. 已知信息与待公布事项
| 项目 | 信息 | 信息状态 |
|---|---|---|
| 模型名称 | Qwen3.8-Flash-Next | 官方预告 |
| 开源时间 | 2026 年 8 月 26 日晚(北京时间) | 官方预告 |
| 架构 | 下一代 Qwen4 架构 | 官方预告 |
| 结构类型 | 混合专家(MoE) | 官方预告 |
| 输入模态 | 原生多模态 | 官方预告 |
| 参数规模与激活参数 | 未公布 | 截至 8 月 25 日发稿 |
| 上下文长度 | 未公布 | 截至 8 月 25 日发稿 |
| 许可证类型 | 未公布 | 截至 8 月 25 日发稿 |
| 上线平台 | 未公布 | 截至 8 月 25 日发稿 |
数据口径说明:表中前五项来自官方预告;系列前作惯例为同步上线 Hugging Face 与 ModelScope 平台,Qwen3.8-Flash-Next 的实际上线渠道以官方发布为准。
3. 与 Qwen3.8 已开源模型对比
| 项目 | Qwen3.8-Max(Qwen3.8-2.4T-A95B) | Qwen3.8-27B | Qwen3.8-Flash-Next(预告) |
|---|---|---|---|
| 开源日期 | 2026 年 8 月 12 日至 13 日 | 2026 年 8 月 14 日 | 2026 年 8 月 26 日晚(预告) |
| 总参数 | 2.4 万亿 | 约 270 亿 | 未公布 |
| 激活参数 | 950 亿 | 全部激活(稠密) | 未公布 |
| 架构 | 稀疏 MoE(Gated DeltaNet + MoE + Gated Attention) | 稠密(Dense) | 下一代 Qwen4 架构 MoE |
| 原生上下文 | 262,144 Token | 262,144 Token | 未公布 |
| 输入模态 | 纯文本(多模态仅限 API 版) | 原生多模态(据媒体报道) | 原生多模态 |
| 许可证 | 定制协议 | Apache 2.0 | 未公布 |
表中 Qwen3.8-Max 与 Qwen3.8-27B 数据来自官方发布信息,Qwen3.8-Flash-Next 一列来自官方预告,其余项截至发稿未公布。
8 月 26 日晚开源后,可供关注的信息包括:模型参数规模与激活参数比例、是否延续 262K 原生上下文设定、许可证沿用定制协议还是转向 Apache 2.0,以及推理框架 vLLM、SGLang 的适配进度。
举手提问