华为昇腾社区已将盘古openPangu-2.0的预训练、监督微调(SFT)和后训练强化学习(RL)代码开源。

相关代码面向昇腾训练生态:openPangu-2.0-Training涵盖预训练和SFT,openPangu-2.0-RL则用于强化学习后训练。此次开放的是训练代码,不代表模型权重也在此次一并开放。