2026年6月30日,华为正式开源920亿参数的openPangu-2.0-Flash大模型,同步开放模型权重、基础推理代码及训推算子,为昇腾算力提供原生训练与推理实践参考。该模型此前已在HDC2026上发布,属于openPangu2.0系列的轻量化版本,激活参数量仅60亿,兼顾高并发推理性能,将支撑长文本场景AI创新,繁荣昇腾开发者生态。
随着大模型应用从通用对话向行业Agent、长文本处理场景渗透,产业端对大模型的推理延迟、算力适配度、开发门槛提出了更严苛的要求,优质开源模型与本土算力栈的适配,成为当前AI落地的核心痛点之一。
当前全球大模型技术呈现两条明确的演进主线:一方面上下文窗口持续扩容,从早期的几千 tokens 升级到数十万甚至数百万tokens,满足法律文书审阅、全量代码库解析、长周期项目复盘等专业场景需求;另一方面推理成本高企、高并发场景延迟过高等问题,始终制约着Agent类产品的规模化落地。而本土算力生态长期缺乏成熟的适配参考模型、完整的工具链支持,也让不少中小开发者的落地成本居高不下。
openPangu2.0系列是华为在2026年华为开发者大会(HDC2026)上推出的新一代开源大模型,采用分化配置的矩阵策略,包含Pro和Flash两个版本,覆盖不同工业级应用场景。
此次率先开源的openPangu-2.0-Flash,总参数量达920亿,激活参数量仅60亿,在保留大模型复杂语义理解能力的同时,大幅降低了运行算力门槛,兼顾高并发推理性能,同时全系搭载512K超长上下文处理能力,可一次性处理完整的专业书籍、十万行级别代码库、数百轮历史对话记录等长文本内容,无需分段切割。
不同于多数厂商仅开放模型权重的开源方案,华为此次同步提供了基础推理代码、训推算子,且所有内容均为昇腾算力原生优化,相当于给开发者提供了一套现成的“落地样板间”,无需从零完成算力适配,即可快速基于模型开发定制化行业应用。
华为此次推出全栈开源方案的核心目标,是降低昇腾生态的开发门槛,吸引更多开发者基于本土算力栈开发AI应用。当前Agent类应用已经进入爆发期,智能办公助理、工业故障诊断、政务服务机器人等场景的智能体产品,都需要低延迟、高可靠、适配本土算力的大模型底座,openPangu2.0系列的开源,将直接填补这一市场空白,加速AI商业创新的落地速度。
按照华为公布的开源路线图,后续openPangu2.0的Pro版本也将按计划开放,进一步满足高精度复杂场景的开发需求。业内普遍认为,优质大模型与本土算力的深度绑定开源,将为国内AI产业形成自主可控的产业生态提供重要支撑。
AI创作导航,创作与探索并重。聚合全球优质AI工具,覆盖短视频、图文、写作、设计等创作场景,以及办公、学习、编程、生活等全品类需求。从创作出发,探索AI的无限可能,为创作者、学生、教师、职场人提供一站式AI工具导航与场景化应用指南。