新模型发布
华为开源505B参数openPangu-2.0-Pro:全程昇腾NPU训练,国产AI芯片标志性验证
华为正式开源openPangu-2.0-Pro大规模MoE(混合专家)语言模型,总参数约5050亿(505B),每token激活约18B参数,支持512K超长上下文,训练数据约34T tokens。该模型最突出的特点是完全使用华为自研昇腾910B NPU训练,未使用任何英伟达硬件,同时开源模型权重、基础推理代码和技术报告,兑现了HDC 2026上余承东"6月30日起分批开源七大组件"的承诺。
这是国产AI芯片在大模型训练场景中的标志性验证。此前,全球大规模AI模型训练几乎完全依赖英伟达GPU(H100/H200/B200等),国产AI芯片能否支撑千亿级参数模型的全流程训练一直是行业疑问。openPangu-2.0-Pro的开源证明昇腾910B NPU已具备训练500B级MoE模型的能力,这对国产AI芯片产业具有里程碑意义——不仅验证了硬件能力,还验证了配套软件栈(CANN)和训练框架的成熟度。
这一成果与同期寒武纪半年报营收翻倍增长、美国拟禁进口中国产光收发模块等事件共同指向一个趋势:中美AI芯片脱钩正在加速,但国产替代也在加速。华为昇腾、寒武纪思元、海光信息等国产AI芯片正在形成训练+推理的完整产品线。对AI行业而言,openPangu-2.0-Pro的开源为国内开发者提供了不依赖英伟达生态的模型选择,512K上下文和34T训练数据也使其在长文本处理场景具有竞争力。不过,国产AI芯片仍面临CUDA生态壁垒、先进制程受限等挑战,从"能训练"到"好用"仍需持续迭代。