AI小创 AI 内容灵感引擎

您好,我是AI助手

我可以帮您推荐合适的AI工具,有什么需要帮忙的吗?

我会根据您的需求,智能推荐站内收录的AI工具
猜您想问
我可以帮您推荐合适的AI工具,有什么需要帮忙的吗?

华为开源5050亿参数openPangu-2.0-Pro 权重及推理代码同步开放

2026年7月31日,华为正式开源旗下盘古大模型系列的openPangu-2.0-Pro版本。该模型基于昇腾NPU训练,采用混合专家架构,总参数规模达5050亿,单Token激活参数180亿,支持512K超长上下文,本次同步开放模型权重、推理代码及技术报告,为开发者提供昇腾原生训练推理实践方案,加速昇腾AI生态落地。

今年6月举办的HDC2026开发者大会上,华为常务董事、产品投资评审委员会主任、终端BG董事长余承东就曾公开透露,将在年内推进openPangu 2.0系列开源计划,时隔不到两个月,这一承诺正式落地。

作为国内少数完全基于国产算力栈训练的超大规模大语言模型,openPangu-2.0-Pro采用当下主流的混合专家(MoE)架构,总参数规模达5050亿,单Token激活参数仅为180亿,既保留了大参数模型的能力上限,又控制了实际推理的算力成本。

据公开技术信息显示,该模型训练数据规模达34T Tokens,在后训练阶段先后完成快慢合一监督微调(SFT)、多专项强化学习(RL),并通过在线蒸馏(OPD)实现能力融合,综合性能在通用推理、代码生成、长文档处理等多个测评集上表现突出。其512K的超长上下文窗口,可支持一次性处理完整的学术论文、代码库、企业级合同等长文本内容,大幅拓展了大模型的应用场景。

和市面上不少“伪开源”的大模型仅开放API调用权限不同,本次华为同步开放了openPangu-2.0-Pro的完整模型权重、基础推理代码以及详细技术报告,开发者可直接基于该模型进行二次微调、场景适配,不需要从零开始搭建超大规模模型的训练框架。

由于该模型全程基于昇腾NPU训练优化,原生适配昇腾算力栈,开发者不需要做复杂的跨架构适配即可快速部署,大幅降低了基于国产算力开发AI应用的技术门槛,也为昇腾AI生态提供了统一的高性能大模型底座。

此前国内开源大模型多集中在百亿参数级别,千亿参数以上的大模型大多仅提供商用API服务,本次华为开源5000亿级别的MoE大模型,填补了国内超大规模开源大模型的空白。

对有信创需求的金融、政务、工业等行业来说,基于openPangu-2.0-Pro开发行业专属大模型,既可以满足数据安全、自主可控的要求,又能获得大参数模型的高性能表现,预计未来半年内将出现大量基于该模型的行业落地应用。

据华为方面透露,本次开源是openPangu 2.0系列开源计划的第一阶段,后续还将陆续开放多模态、垂直行业微调等多个版本的模型,进一步完善昇腾AI生态的工具矩阵。

本文基于公开信息分析整理,仅供参考。更多AI工具动态与行业解读,请持续关注本站更新。