核心观点与关键数据
Agent能力大幅提升,处于国内第一梯队,性能比肩全球顶级闭源模型
- DeepSeekV4在AgenticCoding评测中达到当前开源模型最佳水平,交付质量接近Opus4.6非思考模式。
- 第三方评测显示,V4Pro在代码开源模型榜单中位列第3位,综合第14位,被Arena.ai称为"相较DeepSeekV3.2的重大飞跃"。
Deepseek通过注意力层改进,推动百万上下文进入普惠时代
- V4采用全新注意力机制(CSA和HCA),实现全球领先的长上下文能力,大幅降低计算和显存需求。
- 在1M上下文设置下,V4-Pro的单token推理FLOPs为V3.2的27%,KV Cache为10%;V4-Flash分别压到10%和7%。
- 价格方面,DeepSeek-V4-Pro输入/输出百万Token价格12元/24元,V4-Flash为1元/2元,远低于国内1T模型。
Deepseek与国产芯片进行适配,包括华为、寒武纪等
- V4在英伟达GPU和华为昇腾NPU平台验证细粒度EP方案,下半年昇腾950批量上市有望推动V4Pro降价。
- 昇腾950通过融合kernel和多流并行技术提升推理性能,昇腾A3超节点系列产品全面适配。
- 寒武纪基于vLLM推理框架完成Day0适配,适配代码已开源,得益于其自研NeuWare软件生态与芯片设计技术。
投资建议
- 密切关注国产模型和国产芯片进展,特别是Deepseek在架构设计层面的"降本增效"。
- 寒武纪、华为昇腾的Day0适配表明国产算力已达到商业可用成熟度。
风险提示
- 宏观经济波动风险、下游需求不及预期风险、核心技术水平升级不及预期风险、AI快速迭代平权化下竞争加剧等。