7月31日,华为正式兑现了六月在开发者大会上许下的承诺——开源盘古5050亿参数的openPangu-2.0-Pro模型(模型权重、基础推理代码)及技术报告正式开源上线。开源盘古openPangu是华为开源AI模型品牌,致力于通过昇腾原生训练与推理技术,为业界用好昇腾提供最佳实践参考。

505B参数、512K上下文,一个为昇腾而生的MoE模型

openPangu-2.0-Pro是基于昇腾NPU训练的大规模混合专家(MoE)语言模型,参数规模约505B,每token激活参数规模约18B,支持512k上下文长度,训练数据总量约34T tokens。后训练阶段完成了快慢合一微调(SFT)、多专项强化学习(RL),并通过在线蒸馏(OPD)完成能力合一。

在模型架构上,Pro版本实现了全面升级:

Attention架构:沿用高效MLA,并采用DSA+SWA独立分层混合架构,层配比为1:2。SWA层负责局部窗口建模,DSA层负责稀疏全局聚合,在保持精度的同时显著降低长序列推理的计算、显存与访存开销。

拓扑架构:将传统残差连接升级为4支流mHC架构,提升表征多样性与泛化能力。

自投机模块:采用3头MTP架构,一次额外预测3个token,显著提升模型的推理速度。

优化器:训练中采用Muon优化器,获得更快的收敛速度。

早在6月30日,920亿参数的轻量版openPangu-2.0-Flash模型已率先开源。Pro版本是华为开源盘古2.0系列的旗舰之作。

余承东的“字典里没有第二”

在今年6月的华为开发者大会HDC 2026主题演讲中,华为常务董事、终端BG董事长余承东正式发布了开源盘古openPangu 2.0。他在现场放出豪言:“在我余承东的字典里,没有第二,只有第一。”他宣布,openPangu 2.0计划从6月30日起陆续开源7大组件,包括业界常规开源的模型结构、模型权重、技术报告和推理代码四项,以及华为额外新增开源的预训练代码、后训练代码、训练算子——几乎把大模型的核心技术全部开放了。

对于Pro版本总参数只有505B而非更大规模,余承东曾解释称,算力大量支持了国内其他企业的需求,自己留的数量有限;此外,AI算力成本非常高,华为更聚焦时延和吞吐率的提升。这是华为在算力资源有限的情况下,选择了一条更务实的道路——不盲目追求参数规模,而是把昇腾的效率做到极致。

为昇腾生态打造“最佳实践参考”

openPangu-2.0-Pro的更大意义在于,它不是华为自用的模型,而是一份给整个昇腾生态的“使用说明书”。

据此前报道,openPangu 2.0模型更亲和昇腾算力,单卡吞吐率可达其他业界主流开源模型的2倍。华为通过开源模型权重、推理代码、技术报告乃至预训练和后训练代码,让全球开发者都能在昇腾NPU上跑通一个大模型的全流程——从训练到推理,从微调到部署。

这正是华为一贯的生态策略:先让更多人用上昇腾,再通过规模效应把成本降下来。开源盘古不是为了卖模型,而是为了让昇腾成为开发者真正能用的算力底座。

华为方面表示,诚邀全球开发者、企业伙伴及研究人员下载使用,或访问华为云MaaS模型即服务平台在线体验。目前,openPangu-2.0模型相关组件已陆续上线开源平台。当你把模型权重、推理代码、预训练代码、后训练代码、技术报告全部开放时,你给开发者的不只是一个模型,而是一整套在昇腾上训练和部署大模型的“标准作业程序”。这或许比模型本身更值钱。