2026.08.0212:18星期日 电报解读 题材解读 DeepSeekV4Flash0731在其自有API上的单任务成本比GPT-5.6Luna低约60% 7月31日,DeepSeek-V4-Flash正式版API上线公测。同时预告DeepSeek-V4-Pro正式版也将会在8月初上线。此前4月,DeepSeekV4预览版上线。 DeepSeek-V4-Flash正式版采用MoE架构,总参数规模达到284B(激活13B),并支持最长100万token上下文。支持非思考与思考模式切换,其模型结构、尺寸均与DeepSeek-V4-Flash-preview保持一致,仅重新进行了后训练。DeepSeekV4Flash正式版原生支持OpenAl的ResponsesAPI格式并针对性适配Codex。 据DeepSeekAPI文档,DeepSeek-V4-Flash正式版的Agent能力大幅增强,基准测试远超4月上线的DeepSeek-V4-Pro-PrevieW。整体看V4flashAgent编程测试中领先GLM-5.2,弱于k3。综合能力略低于Opus 4.8、Luna。 根据ArtificialAnalysis:DeepSeekV4Flash0731在人工智能分析智能指数(All)中获得50分,比DeepSeekV4Flash(2026年4月发布)高出10分,比DeepSeekV4Pro高出6分,智能指数比GPT-5.6Luna(最高51分)仅低1分。 同时V4flash展现出极高的性价比,即使OpenAl近期将GPT-5.6Luna的价格下调了80%,DeepSeekV4Flash0731在其自有API上的单任务成本仍然比GPT-5.6Luna(最高51分)低约60%。造成这一差异的关键因素是DeepSeek为其自有API提供了约98%的缓存命中折扣,这一折扣力度远超业内大多数厂商提供的90%缓存命中折扣。 申万宏源黄忠煌指出,V4Flash由于其超高性价比,有可能对GPT/GLM/Claude的同代模型产生冲击,同时继续期待V4Pro上对同类模型产生较大影响。根据DeepSeek,V4-Flash-0731的模型结构、尺寸和DeepSeek-V4-Flashpreview保持一致,仅重新进行了后训练,智能水平就提升显著。因此,期待V4Pro正式版在更大参数规模前提下,进行更多后训练和强化后,对智能水平上限冲击。 相关上市公司 哈药股份:公司高度重视生成式AI技术对产业升级的赋能价值,已部署7B/14B/32B参数规模的DeepSeek蒸馏版本,目前仅用于自测。未来将在合同智能审核、财务智能化、AI+人力、ChatBI以及知识管理等业务领域逐步实施应用。 紫光股份:公司旗下新华三基于1+N大模型策略,积极拥抱国内外各类先进大模型,自研一站式大模型服务平台软件-灵犀使能平台(LinSeerHub)已经实现对DeepSeekV3/R1模型的纳管和上架,适配了不同尺寸的蒸馏模型及原生模型,并支持演示体验(linseer.h3c.com);新华三参与并支持的图灵中试基地也在积极推进DeepSeek在行业侧的商业价值落地。