2026 年 8 月 16 日——过去 70 天内,DeepSeek、阿里云通义千问、智谱、月之暗面、MiniMax、字节跳动等 9 家国产 AI 厂商发布 10 款新模型及重大更新,其中 8 月 12 日至 14 日三天内即有 Qwen3.8-Max 权重开源、DeepSeek-V4-Pro-0813 正式版上线、DeepSeek Harness 公测、Qwen3.8-27B 开源、GLM-5.3 发布五件大事落地。据 Hugging Face《2026 年春季全球开源 AI 生态报告》,中国开源模型下载占比已达 41%,首次超过美国。

本轮密集迭代并非单纯的版本更新。业内人士普遍认为,开源路线、成本结构与 Agent 竞赛构成三重驱动:国产模型以"开放权重 + 商业许可"模式打开生态,以低一个数量级的调用价格重构商业模型,并以 Agent 评测作为新的能力标尺。截至 2026 年 8 月 16 日,公开信息尚未显示这一发布节奏有放缓迹象。

2026-08-16 · 大模型 · 开源 · Agent · 国产AI


一、概览

2026 年 6 月以来,国产大模型进入罕见的密集发布周期。据证券时报、新浪财经等媒体统计,自 6 月中旬起的约 70 天内,9 家中国主要 AI 公司发布了 10 款新模型及重大更新;21 世纪经济报道将其概括为"八周五连发",36 氪则以"一个月 9 款旗舰,大模型进入月抛时代"形容发布节奏之快。

这一周期覆盖语言、多模态、语音、Agent 工程等各个方向:语言模型方面有 DeepSeek-V4-Pro、Qwen3.8-Max、Qwen3.8-27B、智谱 GLM-5.2 与 GLM-5.3、月之暗面 Kimi K3;多模态生成方面有 MiniMax H3;语音方面有 B站 IndexTTS-2.5;Agent 工程层则有 DeepSeek Harness。密集程度与覆盖面,均超过此前任何一轮国产模型更新周期。

二、密集发布时间线

以下为 2026 年 6 月至 8 月中旬国产主要模型更新梳理(据官方发布信息及公开报道整理):

时间 主体 事件
6 月中旬起 多家厂商 约 70 天内 9 家公司发布 10 款新模型及重大更新
7 月 31 日 DeepSeek API 新增 Responses API 支持,deepseek-v4-flash 正式版公测
7 月 31 日 MiniMax 发布全模态生成模型 H3
8 月 3 日 阿里云通义千问 发布 Qwen3.8-Max 与 Qwen3.8-27B
8 月 3 日 MiniMax H3 权重在 ModelScope 与 Hugging Face 开源
8 月 11 日 B站 开源 IndexTTS-2.5 零样本多语言 TTS
8 月 12 日 阿里云通义千问 Qwen3.8-Max(总参数 2.4 万亿)权重开源,首次开源 Max 级旗舰
8 月 13 日 DeepSeek V4-Pro-0813 正式版发布;首款 Agent 产品 Harness 公测并开源
8 月 14 日 阿里云通义千问 Qwen3.8-27B 权重开源(Apache 2.0 许可)
8 月 14 日 智谱 发布 GLM-5.3,编程能力较 GLM-5.2 提升 50%

注:表中"约 70 天 10 款"口径据证券时报统计,部分媒体以"八周五连发"或"一个月 9 款旗舰"概括同一周期,统计口径略有差异。

三、驱动之一:开源路线成为竞争主轴

3.1 从"追赶"到"围剿"

据 Hugging Face《2026 年春季全球开源 AI 生态报告》,中国开源模型下载占比达 41%,首次超过美国,累计下载量突破 100 亿次。行业共识认为,开源模型已从追赶闭源模型的角色,转变为对闭源模型的"围剿"角色。

海外舆论同步转向。2026 年 7 月,英伟达 CEO 黄仁勋发布公开信支持开源生态,称"世界需要前沿的闭源模型,也需要前沿的开源模型";Meta CEO 扎克伯格则公开呼吁美国放宽开源 AI 限制,认为美国严苛的数据使用与模型训练限制使本土实验室处于竞争劣势,单纯封禁境外开源模型无法解决问题。

3.2 "开放权重 + 商业许可":开源不免费

"开源并不意味着免费"是本轮更新的明显特征。月之暗面 Kimi K3 的许可证规定,连续 12 个月总收入超过 2000 万美元的 MaaS 提供商需与月之暗面签约,分成比例最高 30%;阿里云对 Qwen3.8-Max 采用定制协议,月活用户超 1 亿或月收入超 2000 万美元的商业产品需在界面展示模型名称,MaaS 或 AI 工作助手业务近 12 个月合并营收超 5000 万美元的厂商需另行获得授权。相比之下,面向个人与本地部署的 Qwen3.8-27B 采用 Apache 2.0 许可。中信建投分析认为,"开放权重 + 商业许可"模式有望推动开源模型商业回收。

四、驱动之二:成本优势重构商业模型

国产模型与海外闭源旗舰之间数十倍的价格差,被视为厂商敢于高频迭代的直接商业动力。

模型 输出价格(美元 / 百万 tokens) 数据来源
DeepSeek-V4-Pro 0.87 DeepSeek 开放平台
Grok 4.6 6 厂商定价
GPT-5.6 Sol Max 30 厂商定价
Claude Fable 5 50 厂商定价

据 21 世纪经济报道整理,DeepSeek-V4-Pro 输出价格不足 Grok 4.6 的七分之一、Claude Fable 5 的五十七分之一。另据 Artificial Analysis 数据,DeepSeek-V4-Pro 平均单任务成本约 0.06 美元,约为 Claude Opus 5(2.34 美元)的三十九分之一;DeepSeek-V4-Flash 执行复杂工作负载的成本约 0.03 美元,而 Claude Fable 5 约为 3.15 美元,价差超过百倍。

业内分析认为,百倍价差源于底层技术路线差异:海外闭源厂商背负数亿美元的训练沉没成本,需以高 API 单价维持商业闭环;国产厂商以 MoE 稀疏化架构与推理侧优化控制成本,再以规模化调用摊薄研发投入。有美国投资机构统计,多达八成的美国 AI 初创公司在融资路演中使用中国开源模型,构成实打实的市场转向信号。

五、驱动之三:Agent 成为新的能力标尺

本轮密集更新的另一显著特征,是厂商的对外叙事重点从"通用智能"转向"Agent 能力",评测重心随之迁移到终端任务基准。

以 DeepSeek-V4-Pro-0813 为例,据官方基准测试,其 Terminal Bench 2.1 得分 87.9(预览版 72.1)、Cybergym 得分 83.3(预览版 52.7)、DeepSWE 得分 62.7(预览版 12.8),相比预览版分别提升 15.8、30.6、49.9 个百分点,其中 Cybergym 得分微幅超过 Claude Fable 5。智谱 GLM-5.3 在基座模型与 GLM-5.2 完全相同的情况下,通过后训练将 Terminal-Bench 3.0 得分从 4.6 提升至 28.3、DeepSWE v1.1 从 46.2 提升至 66.9,智谱将其称为"编程能力最强的开源模型"。

Agent 竞争还从模型层延伸到工程层。8 月 13 日,DeepSeek 发布首款 Agent 产品 Harness(MIT 协议开源),提出"Model + Harness = Agent",可接入近 40 家模型厂商,被外界视为直接对标 OpenAI Codex 与 Anthropic Claude Code。中信证券研报认为,具备成熟 Harness 的厂商同时握有商业模式闭环和长程任务轨迹数据两项稀缺资产,Harness 工程可能正在开启 AI 递归式自我进化的下一个窗口。

六、后训练 Scaling:密集迭代的技术基础

多款"小步快跑"式更新背后,是后训练(post-training)阶段的 Scaling 被作为独立技术路径。DeepSeek-V4-Flash-0731 与预览版模型结构保持一致,仅重新进行后训练即实现 Agent 能力大幅增强;智谱 GLM-5.3 在与 5.2 完全相同的基座上推进强化学习,并涌现出白盒代码审查与漏洞发现等网络安全能力,智谱表示"可能还远未开发出这个基座的智能上界"。

这种路径降低了单次版本迭代的训练成本与周期,使厂商可以在控制成本的前提下快速打磨、测试并发布多版本。斯坦福《2026 人工智能指数报告》显示,中美顶尖模型综合性能差距已收窄至 2.7%,技术迭代时差压缩至 6 至 9 个月,为国产模型的高频迭代提供了能力基础。

七、行业观察

从竞争格局看,本轮密集更新将竞争从单一性能比拼,推向性能、成本、商业化与生态的综合较量。Counterpoint 指出,如果西方科技巨头只顾构建封闭的"围墙花园",开发者和企业自然会转向中国的开放权重模型。硅谷企业"换底座"的迹象已经出现,据新浪财经报道,部分美国企业因成本考量正将业务流量切换至中国大模型。

从产业支撑看,开源生态得到地方政策与基础设施支持。中国工程院院士王坚认为,人工智能开源正从开放源代码(Open Source)转为开放资源(Open Resource);浙江省"十五五"规划纲要六次提及"开源",2026 年政府工作报告将开源列为全省 AI 布局核心抓手,魔搭社区已成为国内最大 AI 开源社区。

值得关注的风险与变量包括:一是开源"边界"参差,多家厂商仅开放权重或部分模块,如 MiniMax H3 的 Context-IR 与 2K 超分模块未开源、GLM-5.3 权重计划发布两周后开放;二是定价可持续性,DeepSeek 已于 2026 年 8 月 6 日公告计划整体上调 API 价格,低定价能否长期维持尚待观察;三是闭源厂商的应对节奏,海外旗舰模型同样在加速迭代,竞争天平是否持续倾斜,取决于后续版本的实际表现。