9月28日,华为宣布开源盘古openPangu-2.0的预训练、SFT(监督微调)代码及后训练RL(强化学习)代码,相关组件已陆续上线开源平台。开源地址分别为gitcode.com/ascend-tribe/openPangu-2.0-Training和gitcode.com/ascend-tribe/openPangu-2.0-RL。
据华为介绍,开源盘古openPangu是华为开源AI模型品牌,致力于通过昇腾原生训练与推理技术,为业界用好昇腾提供最佳实践参考。此次开源的代码覆盖从预训练到后训练强化学习的完整流程,意味着开发者可基于昇腾平台复现或二次开发盘古大模型的训练管线。
从开源内容来看,预训练与SFT代码的开放,使开发者能够了解盘古模型在昇腾硬件上的训练配置、数据处理及微调策略;后训练RL代码的开放,则涉及模型对齐与强化学习阶段的实现细节。这一组合基本覆盖了大模型从基座训练到对齐部署的关键环节。
当前,国内大模型开源生态竞争日趋激烈,多数厂商选择开源模型权重以吸引开发者,但完整开放训练代码的案例相对有限。华为此次将预训练、SFT及RL代码一并开源,与其推动昇腾计算生态的战略一致。通过降低基于昇腾平台训练大模型的技术门槛,华为意在吸引更多开发者和企业采用昇腾软硬件体系,而非仅依赖英伟达生态。
对行业而言,训练代码的开放有助于研究者和企业理解大模型训练全流程,减少重复试错成本。但实际效果仍取决于代码的完整度、文档质量及昇腾硬件的可获得性。华为后续能否围绕openPangu形成活跃的开发者社区,将决定这一开源举措的长期价值。
该文观点仅代表作者本人,企服科学平台仅提供信息存储空间服务。