余承东说到做到,华为盘古 openPangu-2.0-Pro 模型及技术报告开源上线
最新 7 月 31 日消息,华为今日官宣,开源盘古 5050 亿参数的 openPangu-2.0-Pro 模型(模型权重、基础推理代码)及技术报告正式开源上线。
开源盘古 openPangu 是华为开源 AI 模型品牌,致力于通过昇腾原生训练与推理技术,为业界用好昇腾提供最佳实践参考。

openPangu-2.0-Pro 是基于昇腾 NPU 训练的大规模混合专家(MoE)语言模型,参数规模约 505B,每 token 激活参数规模约 18B,模型支持 512k 上下文长度,训练数据总量约 34T tokens。后训练阶段完成快慢合一微调(SFT)、多专项强化学习(RL),并通过在线蒸馏(OPD)完成能力合一。

openPangu-2.0-Pro 在模型架构上实现了全面的升级:
Attention 架构:沿用高效 MLA,并采用 DSA+SWA 独立分层混合架构,层配比为 1:2;SWA 层负责局部窗口建模,DSA 层负责稀疏全局聚合,在保持精度的同时显著降低长序列推理的计算、显存与访存开销。
拓扑架构:将传统残差连接升级为 4 支流 mHC 架构,提升表征多样性与泛化能力。
自投机模块:采用 3 头 MTP 架构,一次额外预测 3 个 token,显著提升模型的推理速度。
Muon 优化器:训练中采用 Muon 优化器,获得更快的收敛速度。
在今年 6 月的华为开发者大会 HDC 2026 主题演讲中,华为常务董事、产品投资评审委员会主任、终端 BG 董事长余承东宣布,openPangu 2.0 计划从 6 月 30 日起陆续开源 7 大组件,包括新增开源的预训练代码、后训练代码、训练算子。
6 月 30 日,92B 参数的 openPangu-2.0-Flash 模型已正式开源上线。
对于 openPangu-2.0-Pro 总参数仅 505B,余承东曾解释称,算力大量支持了国内的其他企业需求,自己留的数量还是非常有限的;此外,AI 算力成本非常高,华为更聚焦时延和吞吐率的提升。
openPangu-2.0 模型相关组件已陆续上线开源平台,最新附开源地址:
https://ai.gitcode.com/ascend-tribe/openPangu-2.0-Pro
《余承东说到做到,华为盘古 openPangu-2.0-Pro 模型及技术报告开源上线》转载自互联网,如有侵权,联系我们删除,QQ:369-8522。
相关图文
-
打击低质量 AI 内容,领英现允许用户举报 AI 垃圾帖文
领英推出举报选项,用户可一键举报 AI 生成的低质量垃圾帖文,同时调整平台内置 AI 工具,不再支持生成完整帖文,仅保留基础校对功能。#领英AI垃圾帖文治理#... -
Meta 借助 AI 大幅缩短应用开发周期,更多新应用已在路上
近期推出的产品包括面向 Marketplace 卖家的应用、Facebook 群组应用、通过“氛围编程”打造的游戏应用、Instagram 照片应用,以及 AI 睡前故事实验。... -
消息称 DeepSeek 计划在内蒙古建设大型 AI 数据中心,增加 1GW 算力
据彭博社报道,DeepSeek 正扩大算力布局,计划在内蒙古建设大型 AI 数据中心,增加 1GW 算力。部分算力预计 2027 年底或 2028 年初投用,目前暂不清楚项目所用芯片。#DeepSeekAI数据中心#... -
新研究:AI 对就业市场的真正威胁不是失业,而是让加薪更困难
最新研究显示,AI 暂未对整体就业产生可检测影响,但会显著压低工资增速,低收入劳动者受冲击最明显,未来或将进一步加剧收入不平等。... -
智谱 GLM Coding Plan 订阅回归:透明积分制,每月 118 元起
智谱今日官宣 GLM Coding Plan 订阅回归,套餐价格和套餐规则有所调整。即日起至 2026 年 8 月 15 日,订阅新版包年 / 包季套餐分别享限时 7 折/ 8 折优惠。...












