9月17日,华为全联接大会2026在上海启幕。华为副董事长、轮值董事长汪涛在题为“智启新未来,打造智能世界的硅基黑土地”的主题演讲中,正式发布全球首个采用NPO(近封装光学)技术的超节点——昇腾960超节点,该产品计划于2027年第三季度正式上市。
汪涛在演讲中指出,随着大模型迈向十万亿级参数规模,超节点已成为超大规模AI基础设施建设的必然选择。华为超节点的设计理念是以一套协议平等连接集群内所有组件,支持跨物理服务器的内存访问,并采用近铜远光的互连策略。基于这一思路,华为将多年积累的光技术引入超节点系统内部,推出全球首个NPO光引擎Hi-ONE。据华为官方介绍,Hi-ONE是业界首个量产的NPO产品,也是目前传输能力最大的NPO产品,总容量达到7.2T,同时是唯一实现内置光源的NPO产品。
昇腾960超节点基于“灵衢+Hi-ONE”打造,采用正交架构和全液冷设计,基于灵衢实现内存统一编址,可扩展至4096卡规模,实现8EFLOPS FP8和16EFLOPS FP4算力。在光互连层面,该超节点使用5500个Hi-ONE替代原本所需的4万8千颗800G光模块,功耗降低超过550千瓦,系统无故障运行时间提升一倍,系统可用度达到99.8%。华为方面表示,这一设计将加速前沿模型的训练与推理创新。
除昇腾960超节点外,华为还将超节点架构引入通算系统,全新升级鲲鹏超节点。该产品基于灵衢全光组网,最大支持4096节点,形成256TB统一内存池,可实现Agent更高密的沙箱、更快的沙箱启动速度以及更好的Agent向量检索性能。同时,华为发布了基于灵衢UnifiedBus总线、支持“一跳直连”的L3.5层PB级KV缓存解决方案OceanStor M900集群。
在集群组网方面,多个昇腾960超节点可通过灵衢网络或RoCE连接在一起,构建更大规模的超节点集群。通过二层CLOS四平面组网,最大集群规模可达到51.2万卡;再结合多轨道拓扑技术,最大可支持100万卡昇腾超节点集群。这一组网能力为超大规模AI训练提供了可扩展的基础设施路径。
从行业视角看,华为此次发布的核心变化在于将光互连技术从集群间网络下沉至超节点系统内部。传统AI集群依赖大量可插拔光模块完成节点间通信,而NPO技术通过将光引擎近封装在交换芯片附近,减少了电信号传输距离和功耗开销。Hi-ONE作为首个量产的NPO光引擎产品,其7.2T总容量和内置光源设计,意味着华为在光互连环节实现了从芯片到系统的垂直整合。这一技术路线如果按计划在2027年落地,将对超大规模AI基础设施的能效比和可靠性产生实质性影响,同时也为国产AI算力集群的规模化扩展提供了新的工程参考。
该文观点仅代表作者本人,企服科学平台仅提供信息存储空间服务。