昇腾960推出时间提前意味着华为在AI芯片领域的研发进度加快,未来将坚持一年一代的演进节奏。2028年和2029年将陆续推出昇腾970和980芯片,算力规格继续翻倍,访存带宽、访存容量、互联带宽等大幅提升。昇腾960DT和PR版本分别在2027年一季度和三季度准备就绪,FP8算力达2 PFLOPS、FP4算力达4 PFLOPS和8 PFLOPS,片上HBM最大支持288GB和512GB,访存带宽9.6 TB/s。超节点版本最大提供8 EFLOPS FP8算力,HBM容量高达1 PB,风冷和液冷超节点分别于2027年Q2和Q3上市。光互联技术方面,业界首个量产NPO光引擎即将规模量产,单引擎传输容量7.2 T,构建可规模扩展的超节点互联系统。
国产算力芯片产业链发展趋势向好,昇腾芯片出货量最大,产业链公司值得关注。代工方面有中芯国际、华虹公司等;封测方面有盛合晶微、通富微电、长电科技、伟测科技等;设备方面有北方华创、拓荆科技、中微公司、中科飞测等;存储方面有长鑫科技、长存控股(IPO中)等;EDA/IP方面有华大九天、概伦电子、广立微等。华为的鲲鹏超节点全面升级,基于灵衢全光网最大支持4096节点,具备256 TB统一内存池,进一步推动国产算力体系发展。
昇腾960DT版本FP8算力达2 PFLOPS、FP4算力达4 PFLOPS,片上HBM最大支持288GB,访存带宽9.6 TB/s,推出时间较原目标提前3个季度,2027年一季度准备就绪。昇腾960PR版本FP4算力达8 PFLOPS,较原计划提前1季度,2027年三季度准备就绪。两个版本均体现了华为在AI芯片算力上的快速迭代,为市场提供更高性能的AI计算平台。
华为光互联技术取得突破,业界首个量产NPO光引擎即将规模量产,单引擎传输容量7.2 T,与灵衢总线协议共同构建可规模扩展的超节点互联系统。该技术大幅提升数据中心内部互联效率,降低延迟和能耗,为大规模AI计算提供更强支撑。华为的灵衢全光网技术支持最大4096节点,具备256 TB统一内存池,进一步推动超节点算力发展。
研报对国产算力产业链的风险提示主要涉及技术迭代速度和市场竞争。虽然国产算力体系发展迅速,但与国际领先水平仍存在差距,技术迭代速度需持续加快。市场竞争方面,国内外厂商竞争激烈,国产芯片产业链公司需提升产品性能和可靠性,增强市场竞争力。此外,产业链上下游协同仍需加强,以应对快速变化的市场需求。