华为昇腾960超节点发布:业界首个NPO光互联超节点,剑指十万亿参数大模型

新闻3周前发布 ai30guanwang
25 0

文 / AI30媒体部 | 最后更新:2026年9月18日

华为昇腾960超节点与AI算力集群示意图
超节点+集群:国产算力底座的新一程(配图:AI30媒体部)

9月17日,上海,华为全联接大会2026开幕。副董事长、轮值董事长汪涛登台,把昇腾960超节点端了出来——业界第一个用NPO(近封装光学)做互联的超节点,单个节点可以扩到4096张卡,明牌冲着十万亿参数大模型的训练和推理去。同场还确认了两件事:昇腾950超节点已经开始规模商用,昇腾超节点累计部署超过1000套。算上此前一天财联社披露的汪涛七点AI战略部署,华为这次把「算力是AI战略核心、坚持硬件变现」这句话讲得相当直白。

昇腾960到底新在哪

先说NPO。集群规模越大、传输速率越高,传统铜缆电互联的信号损耗和布线密度就越是硬伤,业界普遍的思路是「把光往芯片边上引」。NPO作为和计算芯片近封装的光引擎,能在芯片边缘几厘米的位置完成光电转换,等于让电信号尽早「改乘」光信号。汪涛在科技日报的专访里给了Hi-ONE光引擎三个「第一」:业界首个具备量产能力的NPO产品、目前行业传输能力最大的NPO产品、唯一实现内置光源的NPO产品。30年光通信的技术积累,这回全压进了超节点的互联层。

再说超节点本身。按照鹏城实验室和全球计算联盟那份《超节点定义与实践白皮书》的说法,真正的超节点要满足「内存统一编址」——节点里任何一颗AI芯片都能访问整个节点的共享内存池,逻辑上就是一台计算机。汪涛的原话更直接:做不到内存统一池化,就别管自己叫超节点。这个定义一卡,市面上很多蹭概念的方案就露馅了。

为什么要这么折腾?华为马尔科夫实验室的仿真数据给了解释:用传统8卡服务器拼一个10万卡集群,芯片间通信开销可能吃掉全部训练时间的40%以上;而换成4K超节点去组同样的10万卡,MFU(模型算力利用率)能提升2.75倍。汪涛也实在,补了一句「具体模型表现上这个倍数并非一概而论」。上限也一并交代了:多个昇腾960超节点通过灵衢网络或RoCE互联,集群最大可以扩到51.2万卡,配合多轨道拓扑最多支持100万卡。

几个容易被忽略的信号

发布会主舞台之外,同一场合透露的几条信息,我觉得比参数更值得琢磨。

  • 昇腾计算产品线总裁张熙伟透露,今明两年昇腾板块的研发投入将超过华为无线产业部门——无线可是华为的基本盘业务,这个资源排序的变化本身就是态度。
  • 目前已有40多个大模型在昇腾上完成预训练,按官方口径是国内唯一支持预训练的算力产品,累计在线卡时超过6.5亿。
  • 在PyTorch Conference China 2026上确认,昇腾成为PyTorch官方支持的第一个中国硬件,9月9日已经做了原生支持的Live Demo。框架层的门票拿到了。
  • 产品节奏排得很满:昇腾960芯片比原计划提前到今年登场,Atlas 860风冷超节点2027年Q2上市,Atlas 960液冷超节点2027年Q3上市,后面还排着970、980。
  • 七点战略里,盘古大模型被明确放在「聚焦华为自身产品智能化」的位置上——不参加通用大模型的军备竞赛,钱全砸在底座上。

这事跟AI圈其他人有什么关系

对模型厂商来说,最大的变化是「算力焦虑」的解法多了一个。过去一年国内头部厂商在5T、10T参数模型上往前冲,卡住脖子的一直是训练算力的供给和稳定性。张熙伟在昇腾产业峰会上说的那句「双向奔赴」挺有意思:华为希望昇腾950、960成为国内主流模型训练的主要技术路线,前提是模型厂商愿意基于昇腾做原生训练。真到那一步,「0 Day适配」这个词可能会从行业词典里消失——因为不再需要适配,原生就是默认。

对做AI应用和内容的人来说,链条其实更长:算力供给上来了,国产模型的迭代节奏只会更快,生成式引擎抓取、引用内容的行为也会跟着变。这种时候站点的GEO体检别做一次就锁柜子里,隔段时间拿工具重新跑一遍——比如站内收录的FreeScan这类审计工具,40项检查过一遍AI可见性,成本不高。

常见问题

昇腾960什么时候能买到?芯片今年发布,整机要等:Atlas 860风冷超节点计划2027年Q2上市,Atlas 960液冷超节点计划2027年Q3上市。当下能规模化商用的是昇腾950超节点,急用算力可以先看这一代。

NPO和传统光模块有什么区别?NPO是近封装光学,光引擎直接贴着计算芯片布置,在几厘米内完成光电转换;传统光模块离芯片更远,电信号要走更长的铜缆。距离越短,功耗和时延越低,带宽上限也越高——这正是超大集群最缺的东西。

华为不是有盘古大模型吗?这次怎么不怎么提?汪涛这次把话说得很清楚:华为AI战略的核心是算力、坚持硬件变现,盘古大模型聚焦华为自身产品的智能化。换句话说,华为选择做「卖铲子的人」,把模型生态留给「百模千态」。

一年前业界还在担心昇腾910BC之后的路线断档,一年后超节点成了产业共识、友商陆续跟进。国产算力这条线,从「有没有」走到「好不好用」,节奏比很多人预想的快。接下来盯两件事就够:昇腾960超节点的实际商用进度,以及会不会有头部模型厂商官宣基于昇腾的原生训练——那才是这条战线的真正拐点。

© 版权声明

相关文章

暂无评论

none
暂无评论...