- 华为全联接大会2026发布昇腾960系列芯片及昇腾960超节点。
- 昇腾960芯片性能翻番:960DT算力达2PFLOPS(FP8)/4PFLOPS(FP4),互联带宽2.2TB/s,访存容量288GB,访存带宽9.6TB/s,较前代950DT算力、访存容量翻倍,访存带宽提升2.4倍;960PR FP4算力8PFLOPS,访存容量192GB,带宽2.4TB/s,FP4精度算力为前代950PR的4倍,访存容量和带宽提升50%。发布节奏加快,960DT风冷版计划2027Q1就绪,960PR液冷版计划2027Q3发布,后续昇腾970、980产品将保持年度迭代节奏。
- 超节点芯片实现全栈自研,竞争逻辑转向系统级协同:
- 华为发布11颗超节点关键芯片,覆盖"算"(鲲鹏CPU、昇腾NPU)、"存"、"管"、"联"四大类,以灵衢(UnifiedBus)统一协议打通组件互联及超节点集群级互联。灵衢强调超节点内部及集群级互联的统一架构能力,与英伟达NVLink的GPU互联定位不同。
- NPO首次规模商用:
- 华为Hi-ONE是首个量产NPO产品,单体传输容量7.2T,采用内置光源设计。昇腾960超节点以约5500个Hi-ONE替代4.8万颗800G光模块,功耗降低超550千瓦,无故障运行时间提升一倍,可用度达99.8%。
- 4096卡超节点落地,AI基础设施迈向更大规模与更高集成度:
- 昇腾960超节点支持4096卡,面向十万亿参数模型训练推理,RTT时延2μs。910C超节点已部署超1000套,950超节点规模化商用。
- 研究结论:
- 昇腾960系列通过芯片性能提升、灵衢统一互联架构及NPO等技术协同,推动国产AI算力竞争从单芯片性能比拼向超节点规模、互联效率及系统级协同演进。超节点向更大规模集群升级,算力基础设施价值量向高速互联、光电融合、服务器及电源等系统级环节延伸,相关产业链厂商受益。
- 风险提示:
- 超节点规模落地不及预期;AI算力需求不及预期;海外贸易及供应链政策变化风险。