大众财经网 9月28日消息,据华为官方宣布,开源盘古 openPangu-2.0 的预训练、SFT(监督微调)代码与后训练 RL(强化学习)代码正式开源上线。开源盘古 openPangu 是华为面向业界的开源 AI 模型品牌,致力于通过昇腾原生训练与推理技术,为开发者用好昇腾芯片提供最佳实践参考,相关代码已陆续上线至 GitCode 开源平台。
把预训练、监督微调和强化学习全链路代码同时公开,意味着外界可以基于华为这套框架复现和二次开发大模型训练流程。过去一段时间,国内大模型开源多集中在模型权重与推理层面,训练侧尤其是后训练阶段的工程实现相对稀缺,华为此次把 RL 后训练代码一并放出,对相关研发团队具备较高的参考门槛降低意义。
昇腾生态是这次开源动作的底层逻辑。openPangu 强调的是“昇腾原生训练与推理”,也就是模型从训练到部署都围绕华为昇腾算力体系展开。在国产算力加速落地的背景下,一个能被开发者直接复用的训练范式,对补齐软件栈、吸引更多应用跑在国产硬件上尤为关键。
从产业视角看,大模型竞争已从“参数规模”转向“训练成本与开源性”。当头部厂商把更多训练工程能力开放出来,中小团队能够以更低门槛参与模型迭代,客观上也有利于形成围绕某一算力底座的开发者社区。华为选择把盘古系列的部分核心代码开源,既是技术开放,也是生态卡位。
开源并不等于放弃商业边界——代码公开主要服务于昇腾生态的繁荣,模型能力、行业解决方案等仍由华为通过自身产品与服务体系对外提供。对于国内 AI 开发者而言,这次开源提供了少见的、覆盖“预训练—微调—强化学习”完整链路的参考实现,后续能否催生出更多基于昇腾的国产大模型应用,值得持续观察。
本文仅供信息参考,不构成任何投资建议。