DeepSeek最快下周将发布大模型V4,标志着其在2025年1月R1发布后一年多静默期的技术积累成果。
核心进展与技术突破
自2025年1月R1发布以来,DeepSeek通过渐进式更新持续打磨技术,完成V3、R1的多轮升级,实现模型能力融合、引入稀疏注意力机制、达成数学竞赛金牌级表现,并首次将思考能力整合到工具调用中。其核心架构基于2025年1月发布的流形约束超连接和Engram条件记忆技术,Engram技术实现超100万token的上下文处理能力。
V4多模态与性能升级
V4完成模型能力核心升级,成为原生支持图片、视频和文本同步理解与生成的多模态大模型。轻量版本V4 Lite已进入内测,拥有100万token上下文窗口,表现显著优于网页版和应用版,SVG图像生成质量超越V3.2思考模型;据透露,V4编码性能优于GPT和Claude模型。此外,V4具备成本优势,API每百万token输入成本据称仅0.27美元,较竞争对手便宜超50倍,或对全球头部AI模型形成影响力。
国产算力适配战略
V4最具战略意义的突破是放弃英伟达适配,选择与国产芯片厂商合作完成深度调优,实现推理阶段国产芯片全面适配。这一转向提升了国产算力重要性,释放了国内AI坚定走国产算力适配路线的信号,加速构建国产模型与芯片协同发展的自主AI产业生态。
相关标的
算力&CPU:海光信息、禾盛新材、寒武纪等;
IDC&算租:金开新能、宏景科技、利通电子、协创数据等;
存储:海力士、三星、香农芯创、闪迪、美光;
上游:华正新材、呈和科技、宏和科技、延江股份、德福科技等;
服务器:中科曙光、浪潮信息;
云计算:首都在线、优刻得、青云科技。
风险提示
政策进展不及预期;下游需求不及预期;人工智能风险等。