5050亿参数!余承东开源盘古新模型,"世界第一"还有些距离
很多人以为,余承东在开发者大会上喊出"要把盘古做到世界第一"只是随口一说。
但7月31日华为把openPangu-2.0-Pro的权重直接开源了出来,这一步走得挺实。
先看几个硬数据。
总参数5050亿,激活参数180亿,支持512K超长上下文,预训练语料约34T tokens。
这是华为基于昇腾NPU原生训练出来的MoE模型,训练效率提升了30%。
更关键的是三个"首次"。
第一,业界首个采用DSA+SWA独立分层混合架构的模型,长序列推理的算力和显存开销明显降下来。
第二,首个把预训练代码、后训练代码、训推算子一并开源的模型,诚意拉满。
第三,专门为长上下文智能体任务打造,128K上下文下单卡吞吐能到1326 token/s。
为什么说离"世界第一"还有距离?
技术报告里只放了自家两款模型的数据,没有附上任何第三方对照结果。
华为自己也承认,在处理复杂现实世界软件工程任务时,仍与顶尖模型存在明显差距。
对比一下同期热闹的开源赛道。
月之暗面Kimi K3已经做到2.8万亿参数,在CodeArena前端榜登顶;阿里Qwen3.8也官宣2.4万亿参数即将开源。
盘古的看点不在参数堆砌,而在软硬件协同这条自主路线。
它绑定昇腾算力和麒麟端侧,瞄准的是智能设备、汽车里的智能体生态。
这才是华为真正想抢的战场。
世界第一还没到,但把底层算子都摊开给行业看,这份底气本身就值得关注。
