AI Pulse
📡 X 信号

华为盘古大模型团队开源openPangu-2.0 预训练、SFT、后训练RL代码(505B)

华为盘古大模型团队开源openPangu-2.0 预训练、SFT、后训练RL代码(505B)

中国第一大模型华为盘古又开源了🫡

刚刚,华为盘古大模型团队开源了 openPangu-2.0 的预训练代码、SFT 代码和后训练 RL 代码。

现在大部分所谓开源大模型,基本还是权重 + 推理代码。

你可以部署、可以魔改,但模型怎么被训出来的 Pretrain、SFT、RL recipe国产,往往还是黑盒的。

此前华为已经陆续开了模型结构、Flash/Pro 权重、推理代码和训推算子; 其中 Pro 是 505B 总参数、18B 激活,512K Context,预训练用了约 34T Tokens。

现在预训练 + SFT + RL 代码再补上,基本已经开始覆盖一套大模型从训练到后训练的完整链路。

而且这件事放在华为昇腾生态里看会更有意思。

华为这两年其实一直在干一件事:不只是卖卡,而是把 CANN、PyTorch 适配、模型、训推算子、训练系统这一整套东西逐渐打开。

华为自己披露,目前基于昇腾+CANN 的原生训练模型已经超过 40 个。

所以我觉得 openPangu 真正想做的,可能也不是再造一个国产模型排行榜选手。

它在回答一个很重要问题: 如果未来有人真的想在昇腾上,从头训一个自己的大模型,到底有没有一套可以直接抄作业的开源参考?

现在华为自己给出了参考答案。 也算是遥遥领先了。。。

查看 X 原帖

订阅 AI Pulse

每天 08:00 · 12:30 · 18:30 · 23:50 更新