您的浏览器禁用了JavaScript(一种计算机语言,用以实现您与网页的交互),请解除该禁用,或者联系我们。 [未知机构]:广发传媒互联网AI专题:DeepSeek后训练优化带来的行业变化 - 发现报告

广发传媒互联网AI专题:DeepSeek后训练优化带来的行业变化

2026-08-10 未知机构 申明华
报告封面

发布时间:2026-08-10 一、核心要点 1. DeepSeek V4 Flash(0731版本)无底层架构变更,性能来自后训练深度优化,参数284b、激活量13b,上下文100万token2. 该版本coding能力提升显著,Agent能力大幅追赶模型,世界知识提升相对有限,推理成本延迟显存占用与预览版一致3. 后训练是此前被忽视的模型进化核心,能提升小参数模型能力,降低单任务成本,还会加速模型迭代速度 二、投资线索 1. 重点关注模型后训练版本,如MiniMax、智朴5.3等,有望在coding等领域有超预期表现2. 国内模型通过后训练获得差异化优势,应用端因模型降本有望迎来更多机会,未来3-6个月关注相关产业落地3. 国内云厂商推理需求加速,GPU需求及租赁价格上涨,相关收入有望提升 三、风险与关注 1. 参数扩张趋势未停,国内厂商及海外头部模型均在加大参数投入,需关注参数扩张后的需求匹配情况2. 应用端产业落地尚未完全成熟,当前更多为主题炒作,需关注真正由降本驱动的业务变化3. DeepSeek V4正式版即将发布,需关注其优化效果对行业带来的进一步影响四、后续安排 1. 广发传媒互联网团队每两周推出模型相关报告及专题电话会,欢迎投资者持续跟进