智算需求高企
- 全球智算算力需求持续高景气:美国方面,OpenAI、xAI、Meta等企业正构建超大规模AI算力集群,阿联酋、欧盟也积极布局主权AI算力。国内方面,大模型Token日消耗量快速增长,垂类应用加速落地,推理需求呈指数级扩张。
- 资本开支结构性倾斜智算基座:弗若斯特沙利文数据显示,2025-2029年中国智算芯片市场CAGR为53.7%,GPU份额将升至77.3%。科智咨询数据显示,2023年以来除基础电信运营商外,新增AIDC投资主要由字节跳动驱动,截至2024年底,国内AIDC累计投入超过1875亿元。
- 政策强驱动,AI芯片国产替代提速:美国实体清单持续扩容,加速国产替代。国家正推进全国一体化算力网络建设,强调“适度超前建设网络设施、丰富算力应用场景”。东数西算二期、算力券与地方智算中心形成需求侧刚性配额,国产GPU市场空间广阔。
硬件性能突破
- 先进制程:国际巨头持续突破物理极限,国内在7nm及以下先进制造环节仍存在瓶颈,但技术追赶步伐加快。中芯国际14nm良率>95%,7nm量产稳步推进;华为昇腾910C以7nm+EUV工艺将FP16算力推至448 TFLOPS。
- 单卡性能:华为昇腾910C采用Chiplet双芯封装,1024芯片集群FP16算力达819.2PFLOPS,可对标NVIDIA H100集群;寒武纪思元590支持8芯片级联,FP16集群算力2.048 PFLOPS。
- 架构创新:华为CloudMatrix384单机柜集成384颗昇腾910与192颗鲲鹏CPU,FP16峰值300 PFLOPS,跨节点延迟<1 μs,线性扩展度95%,在DeepSeek-R1预填充效率4.45 tokens/s/TFLOPS,优于SGLang在NVIDIA H100默认配置下的3.18 tokens/s/TFLOPS。
软件生态突围
- CUDA生态垄断:NVIDIA凭借CUDA生态形成“芯片-集群-云”闭环,全球数百万开发者依赖其CUDA-XAI底座、PyTorch/TensorFlow框架及DGX Cloud服务。
- 迁移成本降低:国内企业通过自主研发与协同创新突破封锁:华为CANN、海光DTK、寒武纪BANG+MagicMind等自研软件栈同步落地;商汤DeepLink跨10余款国产芯片完成千亿参数模型20天不间断训练,效率保持95%。
- 生态全栈贯通:信通院AISHPerf、无问芯穹Infini-AI、阶跃星辰“模芯联盟”,推动国产模型与芯片从适配走向全链路协同。伴随《算力互联互通能力要求》、400G ROADM网络落地,全国算力正由“可用”向“可交易、可调度、可度量”升级。
投资建议
- 建议关注算力产业方向:
- 芯片:寒武纪、海光信息、景嘉微、芯原股份、瑞芯微、龙芯中科
- 服务器:中科曙光、浪潮信息、华勤技术、沃尔核材、欧陆通
- 数据中心:万国数据、科华数据、润泽科技、优刻得、宝信软件、金山云、网宿科技、光环新网、世纪互联
- 交换机:锐捷网络、紫光股份、光迅科技、华工科技
- 硬件/端侧:恒玄科技、瑞芯微、移远通信、乐鑫科技、中科创达、云天励飞、智微智能等
风险提示
- 大模型应用落地不及预期
- 技术发展不及预期
- 市场竞争加剧