2026 年 8 月 14 日——阿里云通义千问于 2026 年 8 月 14 日晚正式开源轻量版大模型 Qwen3.8-27B 的模型权重,同步上线 Hugging Face 与 ModelScope 平台。该模型为约 270 亿参数的稠密(Dense)架构,原生上下文 262,144 Token,面向个人单卡与本地部署场景,所有开发者、科研机构与企业均可免费下载、部署和使用。
2026 年 8 月 3 日,通义千问正式发布 Qwen3.8 系列,包括旗舰版 Qwen3.8-Max 与轻量版 Qwen3.8-27B,官方当时承诺两款模型的开放权重将于约一周内上线。8 月 12 日,旗舰版 Qwen3.8-2.4T-A95B 权重先行上架;8 月 14 日晚,27B 权重如期开放,与 ModelScope 此前倒计时指向的发布时间(8 月 15 日 00:00 日本标准时间,即北京时间 8 月 14 日 23:00)一致。
1. 开源详情
据官方发布信息,Qwen3.8-27B 权重已同步上线 Hugging Face 与 ModelScope,所有开发者、科研机构与企业均可自由下载、部署与使用。该模型为 Qwen3.6-27B 的直接继任者,是系列中面向单机本地部署的轻量版本。
许可证方面,据 PANews 等媒体报道,Qwen3.8-27B 采用 Apache 2.0 许可证,与 Qwen3.8-Max 采用的定制协议不同;具体商业使用条款以官方仓库 LICENSE 文件为准。
2. 模型规格
| 项目 | 数据 |
|---|---|
| 模型名称 | Qwen3.8-27B |
| 参数规模 | 约 270 亿(27B) |
| 架构 | 稠密(Dense),每个 Token 激活全部参数 |
| 原生上下文 | 262,144 Token |
| 扩展上下文 | 约 100 万 Token(YaRN 技术) |
| 新增特性 | reasoning_effort,按任务难度控制思考深度(低/中/高) |
| 输入模态 | 原生多模态(据媒体报道,开源版能力以官方模型卡为准) |
| 思考模式 | 开源版强制开启思考,无法关闭(据社区反馈) |
3. 性能表现
据官方发布信息,Qwen3.8-27B 在编程与办公场景相比前代 Qwen3.6-27B 提升明显,部分场景表现超越 Qwen3.7-Plus。截至发稿,具体基准测试分数尚未随开源同步公布。
4. 部署与硬件需求
开源权重版的硬件需求目前为基于前代 Qwen3.6-27B 的估算值,并非官方实测数据:
- 4-bit 量化(Q4_K_M)约 16-17 GB 显存,24 GB 显存显卡可运行
- FP8 量化约 27 GB 显存
- BF16 全精度约 54 GB 显存
推理框架方面,vLLM、SGLang 预计在数日内跟进支持;GGUF、AWQ 等社区量化版本通常滞后一到两周,届时可通过 Ollama、LM Studio 实现一键安装运行。
5. 系列开源进展
至此,Qwen3.8 系列两款模型的权重均已开放:旗舰版 Qwen3.8-2.4T-A95B(总参数 2.4 万亿、激活参数 950 亿的 MoE 模型)于 8 月 12 日开源,为 Qwen 首次开放 Max 级模型权重;轻量版 Qwen3.8-27B 于 8 月 14 日开源,覆盖了从云端旗舰到本地单卡的完整部署梯度。
举手提问