DeepSeek V4 系列发布,提升模型能力和效率
DeepSeek 于 2026 年 4 月 24 日发布了其新的旗舰模型 V4 系列的预览版本,这是自 2025 年 1 月 R1 发布以来的首次重大模型更新。该系列包含两个 MoE 模型:DeepSeek-V4-Flash(284B 参数,13B 激活)和 DeepSeek-V4-Pro(1.6T 参数,49B 激活),两者都扩展了上下文长度至 1M,Daly Li 分析师认为 V4-Pro 在推理和代理任务上取得了顶尖的编码基准性能,并显著缩小了与领先封闭源模型之间的差距。
V4 系列的关键创新
与 DeepSeek-V3 相比,V4 系列在架构和优化方面引入了几个关键创新,提高了长上下文效率、建模能力和训练稳定性。它采用了一种混合注意力架构,结合了压缩稀疏注意力 (CSA) 和 heavily 压缩注意力 (HCA),将单 token 推理 FLOPs 降低 27%,KV 缓存降低 10%。此外,它还包含了流形约束超连接 (mHC),升级了传统的残差连接以增强建模能力,以及 Muon 优化器,以更快、更稳定地进行训练。
华为 Ascend 超节点全面支持 DeepSeek V4
华为表示,其 Ascend 超节点产品系列都能够支持 DeepSeek V4 系列。通过融合内核和多流并行,Ascend 950 AI 显着提高了推理性能,而多种量化算法则使 V4 模型能够实现高吞吐量和低延迟部署。
对中国数据中心和公共云行业的积极影响
分析师认为,中国本土 LLM 开发者(如 DeepSeek、Moonshot AI、Zhipu)和互联网公司(阿里巴巴、字节跳动和腾讯)的持续模型迭代将进一步推动模型训练的计算能力需求。开源 API 的更便宜的价格将推动更广泛的 AI 应用,从而提高 AI 推理接口需求。国内 AI 芯片性能的提升将逐渐缓解 AI 加速器的供应紧张。预计公共云提供商将获得更大的收入增长潜力,并更快地看到随着 AI 需求激增而带来的根本性改进。