核心结论
2026年4月24日,DeepSeek发布V4模型预览版并开源权重,分为总参数1600B的高性能版V4 PRO(激活参数49B)和轻量型V4Flash(总参数284B,激活参数13B),均支持1Mtoken上下文,采用MIT协议开源。V4模型支持三档推理强度,针对Agentic Coding优化,输入价格1元/百万Tokens,输出价格24元/百万Tokens。
分析与判断
- 模型架构创新促进算力落地:DeepSeek V4采用全新注意力机制,结合DSA稀疏注意力,大幅降低计算量和显存开销。受限于高端算力,V4Pro服务吞吐有限,预计2026年下半年昇腾950超节点交付后价格将下调。
- 算力芯片厂商协同参与:华为确认昇腾950PR全面适配DeepSeekV4,开源PyPTO编程范式;寒武纪基于vLLM框架完成Day 0适配并开源代码,表明模型厂商与算力芯片厂商存在技术协同,加速模型商业化。
研究结论
国产模型与算力有望开启正向循环,模型发展促进算力落地,国产算力为模型提供商业化基础。国产超节点加速落地背景下,国产模型实质性进展将推动下游应用普及,驱动头部算力厂商实现增长。
建议关注
- AI算力芯片:寒武纪、海光信息、天数智芯、沐曦股份
- 互联技术:盛科通信、华丰科技
- AI服务器:浪潮信息、华勤技术、中科曙光
- IT分销:深圳华强
风险提示
下游需求不及预期;生成式AI落地和商业化不及预期;宏观经济不及预期。