2026 年 10 月 10 日——阿里通义千问团队于 10 月 9 日开源图像生成加速模型 Qwen-Image-2.1-Turbo:该模型沿用 Qwen-Image-2.1 的 7B 视觉生成架构(约 71.2 亿参数),将文生图与图像编辑的去噪步数从原版默认的 40 步压缩至 8 步,模型权重以 Qwen Research License 协议在 Hugging Face 与 ModelScope 两个平台开放下载;同日 Qwen-Image-2.1 Pro 与 Turbo 托管 API 在阿里云 Model Studio 正式上线,其中 Turbo 在国内(百炼)定价 0.1 元/张。

通义千问团队 10 月 9 日在 X 平台宣布这一消息,官方 GitHub 仓库 QwenLM/Qwen-Image-2.1 的 News 栏目同日记录了两条更新:一是发布 Qwen-Image-2.1-Turbo 检查点,二是 Qwen-Image-2.1 Pro 与 Turbo API 在阿里云 Model Studio 上线。PANews 等媒体当日转述了官方口径:该模型基于 Qwen-Image-2.1 的 70 亿参数架构加速而来,可生成 2K 图像并支持自然语言连续编辑。

核心变化:去噪步数从 40 步降至 8 步

Qwen-Image-2.1-Turbo 是基座模型 Qwen-Image-2.1(2026 年 9 月 20 日开源)的加速检查点。官方 GitHub 仓库说明,Turbo 使用与 Qwen-Image-2.1 相同的 7B 视觉生成架构,仅用 8 步去噪即可完成文本生成图像与图像编辑两类任务;作为参照,原版 checkpoint 的默认去噪步数为 40 步,8 步相当于将迭代次数压缩到原来的五分之一。

工程使用层面,官方文档给出了三点关键说明:

  • 采样调度内置:Turbo 的 checkpoint 内置推荐的 8 步采样调度(sampling schedule),通过 Diffusers 的 QwenImage21Pipeline 加载后自动生效,无需手工配置。
  • 默认 CFG 为 1:官方示例中的文生图与图像编辑调用均使用保存的 8 步调度和默认 CFG=1 设置,即不启用分类器自由引导。
  • 步数参数不可直接覆盖调度:官方特别提示,仅设置 num_inference_steps 并不会覆盖 Turbo 保存的采样调度,需按模型卡说明使用。

官方示例代码中还启用了 use_kv_cache=True。运行环境要求为 torch 2.4.0 以上、transformers 5.17 以上,以及支持 pipeline 级采样调度的最新 Diffusers 源码版本。

开源信息:71.2 亿参数,Qwen Research License

模型权重已在 Hugging Face(Qwen/Qwen-Image-2.1-Turbo)与 ModelScope 同步开放。Hugging Face 仓库元数据显示,该模型以 BF16 精度存储,参数总量为 7,115,124,736(约 71.2 亿),仓库体积约 32.5GB,创建于 2026 年 10 月 9 日;许可证标注为 qwen-research,即 Qwen Research License Agreement,与基座模型的许可体系一致。

基座 Qwen-Image-2.1 于 2026 年 9 月 20 日开源,官方当时介绍其主要特性包括:视觉生成组件仅 7B 参数(32 层 Single-Stream DiT 结构)、原生支持 RGBA 透明图像、最多支持 10 张参考图的多主体合成、原生 2K 分辨率生成。Turbo 官方称在加速后仍可生成高质量 2K 图像并支持自然语言编辑,继承了上述能力。

托管 API 与定价:Turbo 单张 0.1 元,较 Pro 低 60%

阿里云 Model Studio(国内对应百炼平台)已上线 qwen-image-2.1-pro 与 qwen-image-2.1-turbo 两个托管 API,用户可选择托管调用,或下载权重在本地环境运行。据阿里云百炼模型价格页(华北 2 北京地域),图像生成系列按张计费,各模型单价如下:

模型 ID 单价 免费额度
qwen-image-2.1-turbo 0.1 元/张 10 张
qwen-image-2.1-pro 0.25 元/张 10 张
qwen-image-2.0 0.2 元/张 100 张
qwen-image-2.0-pro 0.5 元/张 100 张

按此口径,Turbo 较同代 Pro 低 60%,较上一代旗舰 2.0-pro 低 80%。新加坡地域的单价为 qwen-image-2.1-turbo 0.113362 元/张、qwen-image-2.1-pro 0.283404 元/张;免费额度仅限北京地域,有效期为自开通百炼或模型发布之日起 90 天(以较晚者为准);失败请求不计费、不占免费额度。

生态背景:官方收编社区加速路线

Qwen-Image-2.1 基座发布时即获得生态支持:Diffusers 通过 PR #14804 实现 Day-0 支持,ComfyUI 提供原生文生图与图像编辑工作流模板,vLLM-Omni、SGLang(PR #39983)、LightX2V 等推理框架也在发布当日宣布支持。

在官方 Turbo 发布之前,社区加速方案已经先行:据 CSDN 社区文章介绍,PrunaAI 于 10 月 1 日发布的蒸馏 LoRA 适配器可将 Qwen-Image-2.1 的推理压缩到 5 步或 8 步,官方口径最高提速约 6.3 倍,且无需 CFG。有第三方评论认为,官方 Turbo 的意义在于将加速方案收编为官方检查点,步数、采样方式与权重配套发布,用户不再需要在多个社区版本之间自行验证。此外,官方还提供了基于 Qwen3.5-VL 9B 微调的两款提示词重写模型(Qwen-Image-2.1-PE-T2I 与 PE-I2I),用于将短提示词扩写为高质量描述。