2026-09-17 13:28:06
9月17日,华为全联接大会2026在上海开幕,华为副董事长、轮值董事长汪涛发布全球首个采用NPO技术的超节点——昇腾960超节点,加速10万亿规模的大模型训练和推理。
大模型参数从千亿规模快速迈向10万亿规模,未来可能达到100万亿以上,对AI基础设施的规模、性能和可靠性提出了更高要求。算力基础设施一方面,必须支持更大规模的MoE模型、更长的上下文序列、更低的推理时延,另一方面,需要显著降低推理成本,提升算力效率。单芯片性能的提升远远无法满足这一需求,依靠简单规模堆叠的传统扩展路径面临着边际收益递减的困局。因此,由多芯片紧密协同组成“超节点”,进而实现算力基础设施的系统级架构重构,成为突破现有算力瓶颈的必然选择。
超节点是一种把多个计算节点通过高效互联紧密连接起来的计算系统,它能让这些节点共享统一内存,像一台计算机一样协同工作。随着大模型训练和推理规模持续扩大,超节点能够降低大规模集群中的通信开销、提升模型浮点算力利用率,目前已成为产、学、研在AI基础设施领域的共识。
据了解,华为AI战略的核心是算力,坚持硬件变现,聚焦做好AI基础设施,围绕“超节点+集群”,通过系统架构创新构建竞争力,打造中国坚实算力底座,构建开源开放的算力生态。
此次发布的昇腾960超节点是业界首个采用NPO技术的超节点,单个超节点最大支持4096卡,可提供8E FP8算力和1PB HBM容量。它用5500个Hi-ONE替代原本需要的4万8千颗800G光模块,降低550多千瓦功耗的同时,系统无故障运行时间提升一倍,可用度达到99.8%,为大规模AI训练和推理提供高效、可靠的算力支撑。
据了解,NPO(近封装光学)是一种面向高速互联的光互联技术。华为研发的Hi-ONE是业界首个具备量产能力的NPO产品,也是目前行业最大传输能力、唯一实现内置光源的NPO产品,单引擎传输容量达到7.2T,与灵衢UnifiedBus共同构建可规模扩展的超节点互联系统。
在去年的华为全联接大会上,华为发布昇腾950超节点。汪涛介绍,昇腾超节点作为国内唯一规模商用的超节点,截至目前,已规模商用1000多套,应用于互联网、运营商、金融、教育、医疗、交通、制造等行业。昇腾携手3000多家行业合作伙伴,孵化7000多个行业解决方案。昇腾超节点是国内唯一训练出SOTA模型的超节点。
在所有芯片中,昇腾芯片是整个系统中的核心部件,华为宣布昇腾960芯片研发进度超出预期,性能实现倍增。960DT比原计划提前三个季度,2027年第一季度就绪;960PR比原计划提前一个季度,2027年第三季度就绪。未来,昇腾系列芯片将持续坚持一年一代的演进节奏。2028和2029年,华为将陆续推出昇腾970、980芯片,依托τ定律的创新方向,实现算力规格继续翻倍,访存带宽、访存容量、互联带宽等也将大幅提升。
汪涛表示,构建开源开放的算力生态是华为公司的核心战略。CANN全面开源开放,已进入常态化的开源社区运营,从“可用”到“易用”,昇腾已跨越生态拐点。
“华为坚持打造强大的AI基础设施,构建开源开放的算力生态,支持主流大模型基于昇腾原生训练、积极拥抱百模千态,迎接智能世界的加速到来。”汪涛说。