华为近日正式宣布,其开源AI模型品牌openPangu迎来重大进展——拥有5050亿参数的openPangu-2.0-Pro模型已全面开源,包括模型权重、基础推理代码及详细技术报告均已上线。这一举措标志着华为在推动昇腾生态建设方面迈出关键一步,为全球开发者提供了基于昇腾NPU的高性能语言模型开发框架。
作为基于昇腾NPU训练的大规模混合专家(MoE)语言模型,openPangu-2.0-Pro采用创新架构设计,总参数规模达5050亿,但每token激活参数仅约180亿,在保证模型性能的同时显著降低计算资源消耗。该模型支持长达512k的上下文窗口,训练数据总量超过34万亿token,后训练阶段通过快慢合一微调(SFT)、多专项强化学习(RL)及在线蒸馏(OPD)技术,实现了模型能力的深度优化与整合。
在6月举办的华为开发者大会HDC 2026主题演讲中,华为常务董事余承东曾透露openPangu 2.0的开源计划。根据规划,该系列模型将从6月30日起分阶段开源7大核心组件,涵盖预训练代码、后训练代码及训练算子等关键模块。作为首批开源成果,920亿参数的openPangu-2.0-Flash模型已于6月30日率先上线,为开发者提供了轻量化部署的解决方案。
针对openPangu-2.0-Pro的参数规模设计,余承东解释称,华为将大量算力资源用于支持国内其他企业的AI发展需求,自身保留的计算资源相对有限。同时,面对AI算力成本高企的现状,华为选择将研发重点聚焦于时延优化与吞吐率提升,通过技术创新实现计算效率的突破。这一战略选择既体现了华为在AI领域的责任担当,也为其构建开放共赢的产业生态奠定了基础。




