505B参数全开源!华为放出盘古旗舰大模型,每次推理只激活18B,深度绑定昇腾算力。余承东说不堆更大参数,优先效率。这是要跟DeepSeek抢开源第一把交椅?
7月31日华为正式将盘古openPangu-2.0-Pro模型权重、基础推理代码及技术报告全部开源上线。该模型采用MoE混合专家架构,总参数505B即5050亿,但每次推理仅激活约18B参数。拥有512K上下文窗口,深度绑定华为昇腾算力平台。余承东解释为什么不堆更大参数:考虑算力成本和显存限制,优先保证效率而非规模。openPangu 2.0系列包括Pro和Flash两个版本,Flash版为920亿参数,于7月30日先行开源上线。在2026华为开发者大会上,余承东正式推出openPangu 2.0,依托稀疏架构兼顾超大上下文与高效推理。MoE架构的原理是:平时干活只调动一小部分专家模块,兼顾大模型的知识广度,又躲开稠密模型的算力消耗。
翻译一下:505B总参数但只激活18B是什么概念?相当于一个公司有5050个员工,但每次只派180个人干活。这180个人是根据任务精挑细选的,干得又快又好。稠密模型是5050个人每次全员出动,算力消耗大几十倍。MoE架构让大模型也能高效推理,不用超级算力也能跑。512K上下文意味着一次能处理几十万字的文档,相当于一本小说的长度。深度绑定昇腾算力意味着华为不只是做模型,是做芯片加模型的全栈方案。
华为开源505B盘古模型的意义远超参数本身。第一,这是国产芯片加国产模型的全栈开源,跟DeepSeek用英伟达芯片训练不一样,华为的模型是跑在自家昇腾芯片上的,真正的自主可控。第二,MoE架构18B激活参数意味着推理成本极低,企业部署门槛大幅降低。第三,余承东说不堆更大参数优先效率,这跟字节训练10万亿参数走的是不同路线。字节追规模,华为追效率,DeepSeek追调用量,中国大模型三条路线齐头并进。华为盘古加上昇腾算力,加上鸿蒙生态,加上10万卡曙光超集群,这套从芯片到模型到算力到终端的全链条闭环,全世界只有华为能做到。当华为把505B参数模型开源、深度绑定昇腾算力的时候,你觉得国产AI全栈自主闭环还有多远?
当华为把505B参数旗舰模型开源、跑在自家昇腾芯片上的时候,你觉得英伟达的护城河还剩多深?
