2026 年 9 月 29 日——华为于 9 月 28 日通过官网及官方公众号宣布,开源盘古 openPangu-2.0 的预训练、SFT 代码和后训练 RL 代码正式开源上线,对应 openPangu-2.0-Training 与 openPangu-2.0-RL 两个代码仓库,发布于 GitCode 平台的 Ascend Tribe 开源社区。

据官方介绍,开源盘古 openPangu 是华为开源 AI 模型品牌,致力于通过昇腾原生训练与推理技术,为业界用好昇腾提供最佳实践参考,助力打造 Agent 时代强大的智能底座,加快人工智能商业创新和生态繁荣。

两套代码的开源内容

据华为官方公告 FAQ 介绍,本次开源聚焦训练侧,分为两部分:

openPangu-2.0-Training(预训练与 SFT 代码)是面向大规模基础模型训练的统一训练框架,提供从大规模预训练(Pretraining)、监督微调(Supervised Fine-Tuning,SFT)到模型持续优化的一体化训练能力,支持多维分布式并行、高效数据流水线、混合精度训练、自定义算子优化以及高可用训练等能力。官方称其为百亿至万亿参数级基础模型训练打造稳定、高效、可扩展的训练基础设施。

openPangu-2.0-RL(后训练 RL 代码)是面向华为昇腾的强化学习加速框架,基于 VERL 生态构建昇腾原生 RL 训练与部署能力,支持高精度、高效的 Agentic RL 后训练。官方称其可显著提升 openPangu 大模型在复杂任务中自主规划与执行的能力。

两个仓库的开源地址:

  • openPangu-2.0-Training:https://gitcode.com/ascend-tribe/openPangu-2.0-Training
  • openPangu-2.0-RL:https://gitcode.com/ascend-tribe/openPangu-2.0-RL

openPangu-2.0 系列开源进度

openPangu-2.0 系列模型于 6 月 12 日在华为开发者大会 HDC 2026 上发布。据公开资料,系列包含 Pro 与 Flash 两款 MoE 架构模型,均配备 512K 上下文窗口。此后模型权重、推理代码与技术报告陆续开源,本次训练侧代码上线后,openPangu-2.0 的开源组件已覆盖权重、推理与训练全链路。

组件 开源上线时间 规格与定位
openPangu-2.0-Flash 2026 年 6 月 30 日 总参数 920 亿、激活参数 60 亿,上下文 512K,轻量版本
openPangu-2.0-Pro 2026 年 7 月 31 日 总参数 505B、激活参数 18B,激活率约 3.6%,上下文 512K
openPangu-2.0-Training 2026 年 9 月 28 日 预训练与 SFT 统一训练框架,面向百亿至万亿参数级模型
openPangu-2.0-RL 2026 年 9 月 28 日 基于 VERL 生态的昇腾原生强化学习加速框架

数据来源:华为官方公告、华为云开源公告及公开资料整理。

openPangu-2.0 技术报告题为《openPangu-2.0: Towards Reliable and Efficient Agentic Reasoning》(迈向可靠且高效的智能体推理),随 Pro 模型于 7 月 31 日一同开源上线。

行业观察

华为方面在公告中表示,openPangu-2.0 模型相关组件已陆续上线开源平台,诚邀开发者、企业伙伴及研究人员下载使用并反馈意见。从开源节奏看,华为在约四个月内完成了从模型权重、推理代码到训练侧代码的开放,训练框架与强化学习框架均以昇腾原生为定位;预训练与后训练全流程代码开源在头部基础模型厂商中仍属少数做法,这套代码在昇腾之外的硬件上的适配情况有待社区后续验证。