余承东重回AI战线亮剑:华为盘古2.0凭什么敢喊\”只有第一\”?

当余承东在HDC 2026的舞台上说出”在我余承东的字典里,没有第二,只有第一”时,所有人都知道,那个从不掩饰野心的”余大嘴”正式回到了AI战场的最前线。
去年国庆节前夕被任命为华为产品投资评审委员会主任、执掌AI战略之后,余承东用了不到一年时间,交出了他的第一份答卷——开源盘古openPangu 2.0。这份答卷的分量,远超外界预期。
参数不”卷”规模,卷的是效率
openPangu 2.0分为两个版本:旗舰级的2.0 Pro总参数量5050亿,激活参数量180亿;轻量化的2.0 Flash总参数量920亿,激活参数量60亿。两款模型均搭载512K超长上下文窗口,对标业界顶尖水平。
面对外界关于”为什么不做万亿参数”的质疑,余承东直言不讳:华为把昇腾算力大量支持了国内其他企业需求,自己留的卡数量非常有限。但他随即话锋一转——华为选择了一条更务实的路径:在有限的算力上跑出极致效率。
数据最有说服力:openPangu 2.0对昇腾芯片进行了深度调优,单卡推理吞吐率达到业界主流开源模型的2倍,时延表现也更优。在AI算力价格飞涨的当下,这组数字的含金量远比参数规模本身更具现实意义。
7大组件开源,比业界多走三步
华为计划从6月30日起分批开源7大核心组件。与业界通常只开源模型结构、权重、技术报告和推理代码不同,华为额外开放了预训练代码、后训练代码和训推算子。
正如一位AI开发者社区资深贡献者所言:”华为这次开源力度是认真的,预训练和后训练全链路代码开放,意味着开发者可以直接在昇腾上复现整个训练流程,这对国产AI生态的推动不亚于模型本身。”
这意味着从芯片(昇腾)、框架(MindSpore)到模型(盘古)、操作系统(鸿蒙),华为打通了端到端的全栈链路。余承东还预告,今年秋天30B参数的端侧盘古模型将在麒麟芯片上运行,吞吐率提升5倍以上——云侧昇腾亲和、端侧麒麟亲和的技术闭环正在成型。
从”先驱者”到”赶超者”
2021年4月,余承东曾在华为云任上发布了国内第一个大模型——盘古1.0。他在HDC上回忆道:”当时不仅全中国,全世界都不知道大模型为何物的时候,我们就发布了盘古大模型,是这个行业的绝对先驱者。”
但此后因为种种原因,华为在AI大模型赛道一度被后来者超越。如今余承东重回赛道的姿态异常清晰——他在发布会上公开招揽人才,坦承”走向世界第一的挑战非常大,还要等算力资源赶上来”。这种坦诚与野心并存的态度,恰恰是当下国产AI最需要的现实主义精神。
— END —
LC 智趣厅 · 科技与生活的交点
ihygg.cn
