华为开源5050亿参数盘古大模型 openPangu-2.0-Pro
7月31日,华为正式开源盘古AI模型品牌 openPangu 旗下 openPangu-2.0-Pro 大模型,同步开放模型权重、基础推理代码及技术报告,进一步推进昇腾AI生态建设,为开发者和企业提供基于昇腾原生训练与推理技术的实践参考。
openPangu-2.0-Pro 是一款基于昇腾NPU训练的大规模混合专家(MoE)语言模型,总参数规模约 505B(5050亿),每Token激活参数约 18B,支持 512K 上下文长度,训练数据规模约 34T Tokens。在后训练阶段,模型完成了快慢合一监督微调(SFT)、多专项强化学习(RL),并通过在线蒸馏(OPD)实现能力融合,进一步提升综合性能。
此次开源是华为 openPangu 2.0 开源计划的重要组成部分。今年6月举行的 HDC 2026 开发者大会上,华为常务董事、产品投资评审委员会主任、终端BG董事长余承东宣布,openPangu 2.0 将自6月30日起陆续开源7大组件,包括预训练代码、后训练代码和训练算子等核心能力。此前,92B参数的 openPangu-2.0-Flash 模型已于6月30日率先开源。
针对 openPangu-2.0-Pro 总参数规模为505B,余承东曾表示,华为将大量AI算力资源支持国内产业生态,自身可用算力相对有限,同时AI训练成本持续高企,因此华为更注重模型在时延、吞吐率等推理效率上的优化。随着 openPangu 2.0 持续开放核心模型与训练能力,昇腾原生AI开发生态有望进一步完善,并为国产大模型研发提供更多开源参考。
Ascend Tribe 开源社区:https://www.huaweicloud.com/product/modelarts/studio