7月31日,华为正式宣布开源盘古openPangu-2.0-Pro 大模型,开放内容包括5050亿参数模型权重、基础推理代码以及技术报告 。
这也意味着,余承东此前在华为开发者大会(HDC2026)承诺的openPangu 2.0开源计划再次兑现。
据悉,在今年6月的华为开发者大会(HDC2026)主题演讲上,华为常务董事、产品投资评审委员会主任、终端BG董事长余承东表示,openPangu 2.0计划从6月30日起陆续开源7大组件,包括新增开源的预训练代码、后训练代码、训练算子。
据了解,openPangu 是华为打造的开源AI模型品牌,基于昇腾原生训练与推理技术,旨在为开发者、企业及科研机构提供完整的技术参考,帮助行业更高效地使用昇腾生态,进一步推动Agent时代智能底座建设和人工智能产业发展。
此次开源的openPangu-2.0-Pro 是一款基于昇腾NPU训练的大规模混合专家(MoE)语言模型,总参数规模约5050亿(505B) ,单个Token激活参数约180亿(18B) ,支持最长512K上下文 ,训练数据规模约34万亿Tokens 。
模型在后训练阶段完成了监督微调(SFT)、多专项强化学习(RL)以及在线蒸馏(OPD),进一步提升了综合能力。
在模型架构方面,openPangu-2.0-Pro进行了多项升级,包括采用DSA+SWA混合Attention架构优化长文本推理,引入四支流mHC拓扑结构提升模型泛化能力,同时加入三头MTP自投机模块以提高推理速度,并采用Muon优化器加快训练收敛效率。
按照华为此前公布的开源计划,openPangu 2.0将陆续开放包括预训练代码、后训练代码、训练算子等七大组件。
其中,92B参数的openPangu-2.0-Flash 已于6月30日率先开源,而此次505B参数的openPangu-2.0-Pro正式上线,也标志着该开源计划持续推进。
目前,openPangu-2.0 相关组件已陆续登陆开源平台。华为表示,欢迎全球开发者、企业伙伴和科研人员下载使用,也可通过华为云MaaS模型即服务平台在线体验。
同时,官方也邀请广大用户积极反馈使用建议,共同完善开源生态,推动人工智能技术创新与产业繁荣。





京公网安备 11011402013531号