华为开源920亿参数openPangu2.0 Flash 布局Agent时代智能底座

2026年6月30日,华为正式开源920亿参数的openPangu-2.0-Flash大模型,同步开放模型权重、基础推理代码及训推算子,为昇腾算力提供原生训练与推理实践参考。该模型此前已在HDC2026上发布,属于openPangu2.0系列的轻量化版本,激活参数量仅60亿,兼顾高并发推理性能,将支撑长文本场景AI创新,繁荣昇腾开发者生态。

随着大模型应用从通用对话向行业Agent、长文本处理场景渗透,产业端对大模型的推理延迟、算力适配度、开发门槛提出了更严苛的要求,优质开源模型与本土算力栈的适配,成为当前AI落地的核心痛点之一。

当前全球大模型技术呈现两条明确的演进主线:一方面上下文窗口持续扩容,从早期的几千 tokens 升级到数十万甚至数百万tokens,满足法律文书审阅、全量代码库解析、长周期项目复盘等专业场景需求;另一方面推理成本高企、高并发场景延迟过高等问题,始终制约着Agent类产品的规模化落地。而本土算力生态长期缺乏成熟的适配参考模型、完整的工具链支持,也让不少中小开发者的落地成本居高不下。

openPangu2.0系列是华为在2026年华为开发者大会(HDC2026)上推出的新一代开源大模型,采用分化配置的矩阵策略,包含Pro和Flash两个版本,覆盖不同工业级应用场景。

此次率先开源的openPangu-2.0-Flash,总参数量达920亿,激活参数量仅60亿,在保留大模型复杂语义理解能力的同时,大幅降低了运行算力门槛,兼顾高并发推理性能,同时全系搭载512K超长上下文处理能力,可一次性处理完整的专业书籍、十万行级别代码库、数百轮历史对话记录等长文本内容,无需分段切割。

不同于多数厂商仅开放模型权重的开源方案,华为此次同步提供了基础推理代码、训推算子,且所有内容均为昇腾算力原生优化,相当于给开发者提供了一套现成的“落地样板间”,无需从零完成算力适配,即可快速基于模型开发定制化行业应用。

华为此次推出全栈开源方案的核心目标,是降低昇腾生态的开发门槛,吸引更多开发者基于本土算力栈开发AI应用。当前Agent类应用已经进入爆发期,智能办公助理、工业故障诊断、政务服务机器人等场景的智能体产品,都需要低延迟、高可靠、适配本土算力的大模型底座,openPangu2.0系列的开源,将直接填补这一市场空白,加速AI商业创新的落地速度。

按照华为公布的开源路线图,后续openPangu2.0的Pro版本也将按计划开放,进一步满足高精度复杂场景的开发需求。业内普遍认为,优质大模型与本土算力的深度绑定开源,将为国内AI产业形成自主可控的产业生态提供重要支撑。

本文基于公开信息分析整理,仅供参考。更多AI工具动态与行业解读,请持续关注本站更新。