华为开源盘古 openPangu-2.0 的预训练、SFT 代码和后训练 RL 代码正式上线,模型相关组件陆续登陆开源平台。openPangu 是华为的开源 AI 模型品牌,定位是通过昇腾原生训练与推理技术,为业界用好昇腾提供最佳实践参考。
openPangu-2.0-Training 是面向大规模基础模型训练的统一训练框架,提供从大规模预训练、监督微调到模型持续优化的一体化训练能力,支持多维分布式并行、高效数据流水线、混合精度训练、自定义算子优化以及高可用训练,目标是为百亿至万亿参数级基础模型提供稳定、高效、可扩展的训练基础设施。
后训练侧,openPangu-2.0-RL 是面向华为昇腾的强化学习加速框架,基于 VERL 生态构建昇腾原生 RL 训练与部署能力,支持高精度、高效的 Agentic RL 后训练,用于提升模型在复杂任务中的自主规划与执行能力。
代码通过 Ascend Tribe 开源社区发布,面向开发者、企业伙伴及研究人员开放下载,并同步征集使用反馈,以持续迭代开源生态。