您的浏览器禁用了JavaScript(一种计算机语言,用以实现您与网页的交互),请解除该禁用,或者联系我们。 [国新证券]:GPT-5.6降价与DeepSeek定价转向 - 发现报告

GPT-5.6降价与DeepSeek定价转向

信息技术 2026-08-06 钟哲元 国新证券 静心悟动
报告封面

2026年8月6日 GPT-5.6降价与DeepSeek定价转向 看好 事件 2026年7月末至8月初,OpenAI对GPT-5.6家族落地结构性调价,中低端档位大幅让渡价格空间;DeepSeek先于7月31日上线V4 Flash正式版,将高频场景调用成本压至行业新低,随即在8月初预告API整体上调定价。 核心观点 大模型行业已迈过同质化降价阶段,形成中美分层、国内双轨的定价格局,核心支撑是算力成本刚性约束与场景价值分化。美国市场率先转向高端溢价,OpenAI旗舰模型2026年重回提价通道,依托复杂Agent、专业编码等高价值场景重建能力溢价。中国市场双轨并行:智谱等年内多次上调API定价,调用量仍实现高增长,在代码、企业智能体场景拿到局部定价权;DeepSeek以极致成本优势抢占全球份额。2025年末至2026年上半年GPU算力价格回升近四成,终结行业普降基础,推动竞争转向分层化。 数据来源:Wind,国新证券整理 相关研究 2026年7月OpenAI为GPT-5.6搭建Sol、Terra、Luna三层产品矩阵并快速调价,执行“高端守价、中端巩固、低端抢量”策略:Sol维持原价并推出付费加速模式,守住能力溢价与品牌上限;Terra承接中等复杂度需求,优化家族路由效率;Luna大幅降价80%,主动下沉应对国产模型竞争。此次调整标志其收入逻辑从“旗舰溢价驱动单用户收入”转向“分层路由驱动总调用量与客户留存”,中低端模型不再具备稳定提价权。 DeepSeek V4 Flash通过架构与工程优化,能力接近GPT-5.6Luna,高比例缓存折扣大幅降低Agent规模化落地门槛。随后其预告API整体涨价,标志策略从低价抢量转向平衡规模与盈利质量,行业价格战阶段性降温,竞争回归能力、服务与场景适配的综合比拼。 当前全球市场分层清晰:高端高失败成本场景以能力为核心,头部厂商保有强定价权;中端规模化自动化市场竞争激烈,价格为选型核心变量。智能路由与聚合平台兴起,侵蚀闭源模型广谱溢价,兼具模型、算力与生态的云厂商优势凸显。中美竞争进入定价权争夺阶段,中国模型凭借显著性价比优势,周调用量连续十四周领跑全球,市场份额持续重构。 分析师:钟哲元登记编码:S1490523030001邮箱:zhongzheyuan@crsec.com.cn 投资线索 本轮定价转移标志产业步入商业化成熟期,利润池呈结构性迁移。基础模型赛道关注两类厂商:在高端场景具备不可替代性、可持续维持定价权的厂商,以及拥有极致工程效率、能在低价市场实现规模化盈利的厂商。云与MaaS平台是主要受益方,调用量增长叠加算力利用率提升,头部厂商有望实现收入利润双增。推理优化与AI 证券研究报告 中间件确定性较强,将持续受益于企业降本诉求。垂直AI应用依托场景理解与工作流壁垒具备长期估值弹性,办公自动化、开发工具等赛道落地节奏有望加快。 风险提示 1、 技术发 展不及 预期;2、 市场 竞争加 剧;3、 地缘政 治影响 。 目录 一、定价格局从普降潮到分层双轨............................................................................................................................................3二、GPT-5.6分层调价:OPENAI的分层防守策略................................................................................................................3三、DEEPSEEK定价转向:从极致成本优势到商业化修复..................................................................................................4四、全球大模型市场新生态........................................................................................................................................................6五、投资建议................................................................................................................................................................................7六、风险提示................................................................................................................................................................................8 一、定价格局从普降潮到分层双轨 大模型行业早已迈过同质化降价的初期阶段,形成了清晰的中美市场分层、国内双轨并行的格局,背后最核心的支撑来自算力成本的刚性约束与场景价值的持续分化。 美国市场率先完成了从降价抢量到高端溢价的切换。OpenAI旗舰模型定价在经历两年下行后,于2026年重回上行通道,从GPT-5迭代到GPT-5.6 Sol,旗舰层输入价格稳定在每百万Token 5美元、输出30美元的水平。这一轮定价抬升的核心逻辑,是头部厂商商业目标的转向--在复杂Agent、专业编码、高风险工作流等场景中,客户为任务成功率付费的意愿远强于对Token单价的敏感度,头部厂商因此得以重建高端场景的能力溢价。 中国市场则走出了双轨路线。智谱在2026年一季度累计上调API调用定价83%,其中2月GLM Coding Plan结构性调价涨幅30%起、3月GLM-5-TurboAPI价格上调20%、4月GLM-5.1再提价10%;即便如此,一季度调用量仍增长400%。腾讯云、阿里云等平台的算力服务与部分模型也出现不同幅度涨价,既反映出上游算力紧张向服务端的传导,也说明部分国产模型在代码、企业智能体等高价值场景中,已经拿到了局部定价权。另一部分厂商则延续规模优先的路线,此前DeepSeek通过多轮永久降价,以极致成本优势抢占全球市场份额。 这种分化的底层支撑是上游算力供给的刚性约束。2025年末到2026年上半年,GPU云算力租赁价格并未延续此前的下降趋势,反而出现阶段性回升,一年期H100合同价格从2025年10月的每卡每小时1.7美元,上涨至2026年3月的2.35美元,涨幅接近四成,新卡价格上行更为明显。算力成本的回升,让全行业无差别降价失去了基础,厂商必须根据自身定位与目标场景做出差异化选择,行业也因此从单一的Token单价竞争,演化成不同能力层级、不同任务场景下的分层竞争。 二、GPT-5.6分层调价:OpenAI的分层防守策略 2026年7月,OpenAI围绕GPT-5.6完成了产品与定价的系统性调整,首次在同代内搭建起Sol、Terra、Luna三层产品矩阵,且上线仅三周便快速实施结构性调价:旗舰Sol维持原价(输入$5.00/输出$30.00每百万Token),Terra降价20%(调整后输入$2.00/输出$12.00),Luna大幅降价80%(调整后输入$0.20/输出$1.20),同时为Sol推出双倍价格的Fast加速模式(处理速度提升至标准模式的2.5倍)。整个调整节奏明显快于过往产品周期,透露出明确的竞争应对意图。 这套三层架构标志着OpenAI不再用单一旗舰模型通吃全部市场,转而搭建更贴近企业预算管理的分层供给体系。其中Sol定位旗舰前沿能力,面向复杂推理、科研、长程Agent等高失败成本场景,维持原价的核心目的是守住OpenAI的能力 溢价、利润锚与品牌上限;同步推出的Fast模式则把时延从服务属性拆分为可单独售卖的商品,让旗舰层的商业逻辑从单一能力溢价,延伸为能力与时延的双重溢价。Terra定位为主流生产层,面向日常生产工作流,承担着将原本跑在Sol上的中等复杂度请求拦截在更低成本层的作用,既可以降低客户整体账单,也能提升家族内部的路由效率,是整个经营体系的核心中枢。Luna则定位为高并发放量层,面向分类、摘要、提取、轻量Agent等高吞吐、价格敏感任务,大幅降价后直接切入超低价市场,与中国厂商的高性价比模型展开正面竞争。 从调价幅度的差异不难看出OpenAI的战略意图:高端守价、中端巩固、低端抢量,主动拉大各层之间的价格梯度,形成覆盖不同预算与场景的完整产品矩阵。官方披露的工程优化,包括针对Hopper架构重写的GPU kernel、迭代后的推测解码框架,能够带动端到端成本下降两到三成,但显然不足以支撑Luna高达80%的降幅。这一轮降价的核心驱动力,本质还是来自市场竞争压力。进入2026年二季度后,DeepSeek通过V4 Pro的永久折扣、V4 Flash的低价与激进的缓存折扣,持续下压“足够好用”场景的市场清算价格,其他国产模型也在高性能区间持续发力,不断挤压OpenAI中低端产品的市场空间。如果Luna维持最初的定价,其所在的预算层将快速被中国厂商挤出企业的默认选型清单,OpenAI会失去大量高频调用的流量入口。 因此Luna的大幅降价,本质是OpenAI主动下沉中低价市场的防守动作。它不需要做到绝对最低价,只需要让价格差距缩小到不足以覆盖客户的迁移、合规与生态切换成本,就能守住API流量与开发者入口。整体来看,这一次分层调价标志着OpenAI的收入模型,正式从“旗舰溢价驱动单用户收入”切换为“分层路由驱动总调用量与客户留存”。OpenAI并没有放弃定价权,而是在重新定义定价权,把过去单一旗舰的每Token溢价,转化为全家族在不同任务层级上的预算占有率。这也意味着,单纯依赖代际升级持续抬价的阶段已经结束,至少中低层能力不再具备稳定的提价权,闭源龙头必须接受模型层毛利率中枢下移的现实,通过生态绑定与工作流绑定来巩固自身的市场地位。 三、DeepSeek定价转向:从极致成本优势到商业化修复 7月31日上线的DeepSeek V4 Flash 0731正式版,真正的冲击力在于以接近GPT-5.6 Luna的能力水平,通过架构与工程优化重构了高频场景的成本函数;而紧随其后的API涨价预告,则让市场看到了国产头部模型从规模扩张期进入商业化修复期的明确信号。 从能力层面看,新版本的V4 Flash维持了284B总参数、13B激活参数与1M上 下 文 窗 口 的 基 础 架 构 , 仅 通 过 后 训 练 就 实 现 了 能 力 的 大 幅 跃 升 。ArtificialAnalysis的数据显示,V4 Flash 0731在智能指数(Intelligence Index)上拿到50分,仅比GPT-5.6 Luna的51分低1分,二者综合智能水平极为接近。在分项基 准上二者互有胜负:V4 Flash在AutomationBench(25.1%vs14.9%)、Toolathlon(70.3%vs53.4%)等Agent工具调用类基准上领先Luna;而Luna在Agents'LastExam(50.3%vs25.2%)、DeepSWE(67.2%vs54.4%)、Terminal-Bench2.1(84.7%vs82.7%)等深度推理与代码基准上仍保持优势,且Luna支持多模态输入而V4 Flash仅支持文本。这种能力提升没有伴随参数规模的扩大与价格的上涨,完全来自后训练对执行能力的强化,也说明2026