华为发布昇腾960超节点与灵衢互联:单节点4096卡,可组最大51.2万卡集群

在华为全联接大会上,华为发布新一代 AI 芯片昇腾960DT 与「灵衢」(UnifiedBus)互联体系,并推出基于该体系的昇腾960 超节点,单机节点规模达 4096 卡,借助灵衢可构建最大 51.2 万卡集群,标志着国产 AI 算力基础设施迈入百万卡时代。

事件背景

随着前沿大模型训练对算力集群规模的要求持续抬升,「万卡」「十万卡」已成为头部玩家的入场券。算力竞争的核心,正从单芯片算力转向互联带宽、集群规模与稳定交付能力。华为此次发布,正是在国产全栈路线上补齐超节点与互联短板。

核心内容

昇腾960DT 单芯片提供 2 PFLOPS(FP8)算力,较上代翻倍,比原计划提前约三个季度;预计 2027 年一季度就绪,2028、2029 年将推出昇腾970 与 980。配套发布的还有业界首个量产 NPO 光引擎 Hi-ONE,以及基于灵衢 UnifiedBus 的昇腾960 超节点,单节点 4096 卡,通过灵衢互联可横向扩展至最大 51.2 万卡集群。

生态层面,昇腾 CANN 社区外部开发者占比已达 61%,首次超过内部;鲲鹏生态全球开发者突破 416 万。这表明国产算力软件生态从「内部主导」转向「外部共建」。

影响与解读

百万卡集群能力意味着国产大模型训练可在本土全栈路线上获得更大规模供给,降低对海外硬件与互联方案的依赖。光引擎量产与超节点设计,也把竞争重点拉向「电、土地、机柜、交付周期」等基建属性,而非单纯的算法。

相关动态 / 展望

随着昇腾970/980 路线图公布,国产算力将在未来三年持续迭代。外部开发者占比过半,将决定生态能否真正繁荣——工具链成熟度与模型适配广度,是下一阶段关键。

信息来源:腾讯研究院 AI 速递(搜狐)

声明:本站所有文章,如无特殊说明或标注,均为本站原创发布。任何个人或组织,在未征得本站同意时,禁止复制、盗用、采集、发布本站内容到任何网站、书籍等各类媒体平台。如若本站内容侵犯了原著者的合法权益,可联系我们进行处理。