华为昇腾384超节点及产业链分析
核心观点
- 华为在WAIC2025大会上首次展出了昇腾910C CloudMatrix 384(Atlas900A3SuperPoD),基于超节点架构,实现384个NPU之间的大带宽、低时延互联,突破集群内资源通信瓶颈。
- 昇腾系列近年来持续突破,从昇腾910到Atlas900,再到如今的CloudMatrix 384,算力性能不断提升,支持更大规模AI模型训练。
- 昇腾384超节点具备超大带宽、超低延迟、超强性能,算力达300PFLOPs,较传统集群提升显著,但在系统功耗方面高于英伟达GB200NVL72。
关键数据
- 昇腾910C芯片FP16算力达256TFLOPs,远超英伟达V100;910B芯片对标英伟达A100;910C支持万亿参数大模型训练,显存带宽超3TB/s。
- Atlas900A3SuperPoD算力达300PFLOPs,LLaMA3等模型训练性能较传统集群提升2.5倍以上,Qwen、DS及MOE模型提升达3倍。
- 与英伟达GB200NVL72对比,昇腾910C在芯片封装层BF16算力、HBM容量、带宽不及GB200;但在系统层级,BF16算力、HBM容量、带宽等处于领先,系统功耗较高。
研究结论
- 建议关注国产算力芯片代工企业中芯国际和光模块公司中际旭创。
- 中芯国际作为国内唯一的先进制程晶圆制造企业,将受益于国产替代趋势;中际旭创凭借全球光模块领导地位,在AI算力需求驱动下有望持续增长。
风险提示
- 国际贸易摩擦加剧
- 下游需求不及预期
- 技术升级进度滞后