2026年7月31日,华为正式开源旗下盘古大模型系列的openPangu-2.0-Pro版本。该模型基于昇腾NPU训练,采用混合专家架构,总参数规模达5050亿,单Token激活参数180亿,支持512K超长上下文,本次同步开放模型权重、推理代码及技术报告,为开发者提供昇腾原生训练推理实践方案,加速昇腾AI生态落地。
今年6月举办的HDC2026开发者大会上,华为常务董事、产品投资评审委员会主任、终端BG董事长余承东就曾公开透露,将在年内推进openPangu 2.0系列开源计划,时隔不到两个月,这一承诺正式落地。
作为国内少数完全基于国产算力栈训练的超大规模大语言模型,openPangu-2.0-Pro采用当下主流的混合专家(MoE)架构,总参数规模达5050亿,单Token激活参数仅为180亿,既保留了大参数模型的能力上限,又控制了实际推理的算力成本。
据公开技术信息显示,该模型训练数据规模达34T Tokens,在后训练阶段先后完成快慢合一监督微调(SFT)、多专项强化学习(RL),并通过在线蒸馏(OPD)实现能力融合,综合性能在通用推理、代码生成、长文档处理等多个测评集上表现突出。其512K的超长上下文窗口,可支持一次性处理完整的学术论文、代码库、企业级合同等长文本内容,大幅拓展了大模型的应用场景。
登录后解锁全文,体验收藏、点赞、评论等完整功能
立即登录