海外科技 2026年08月03日 ——港股行业深度报告 投资评级:看好(维持) 初敏(分析师)chumin@kysec.cn证书编号:S0790522080008 荀月(分析师)xunyue@kysec.cn证书编号:S0790524110001 杨哲(分析师)yangzhe@kysec.cn证书编号:S0790524100001 模型:Claude 4.6/4.8级别区间竞争愈加拥挤,中美模型差距持续收窄 2026年7月全球AI产业进入“前沿模型密集迭代+Token经济加速放量+资本市场高波动再定价”三线并行阶段。模型层面,7月上半月先后出现腾讯Hy3正式版、SpaceXAI Grok 4.5、OpenAI GPT-5.6、Meta Muse Spark 1.1、月之暗面KimiK3等关键节点,模型竞争焦点已从早期参数规模竞赛进一步转向Agent能力、长上下文、单位Token智能密度、推理效率与成本结构的综合竞争。 ARR& Agent跟踪:头部大模型ARR增长斜率短期有所波动,codex突破千万周活用户,腾讯WorkBuddy初露锋芒 ARR:7月份因为OpenAI发布GPT-5.6并为了获取codex用户量,多次重置套餐、加大价格战竞争,ARR一阶导或有所回落,造成短期数据波动,但月度增长基本维持10+B美元的增长水平。我们认为,模型收敛是当前的竞争趋势,但scaling law仍然是大模型的成长主线,SOTA模型相继发布将扩大前沿AI应用场景,有望持续推动ARR的增长斜率上行。 数据来源:聚源 相关研究报告 《AI硬件迎来三重催化,ASMPTQ2业绩表现强劲—行业周报》-2026.8.2 Agent:GPT-5.6推出后,在其性价比优势及OpenAI官网多次重置的背景下,ChatGPT Work和Codex的每周活跃用户数达到1000万,比一周多前的600万增长了67%,比3月份增长了5倍。根据易观分析2026年6月中国桌面端AI原生办公智能体监测数据,腾讯WorkBuddy以2097万月度访问量位居行业首位,显著高于第二名TRAE IDE(国内版,1279万),拉开清晰的第一梯队优势。 《教育/时代天使/美图2026H1业绩高增 , 奢 牌 加 码 女 表—行 业 周 报 》-2026.8.2 《全球需求与技术共振,中国牙科从“替代”走向“定义”—行业深度报告》-2026.7.27 算力:海外GPU租赁价格及Token消耗量显示需求仍强 2026年7月算力侧关注核心在于模型效率提升和价格战持续的情况下,Token需求是否仍然快于单位成本下降。短期需求弹性仍强,一方面,DeepSeek、MiniMax、GLM等模型通过MoE、Sparse Attention、GQA、投机解码等方式持续压低单位推理成本;另一方面,编程、生产力、Agent、多模态任务正把总调用量推向更高数量级。中长期仍需关注Blackwell放量、H100代际下沉及模型效率提升从而带动部分通用推理场景的卡需求紧张缓解。 投资建议 Kimi K3与千问Qwen3.8等国产模型的接连突破,不仅是参数和榜单数字的跃升,标志着中国AI产业进入新阶段,有力地证明了开源模型的天花板同样很高,在国际竞争力进一步提升,在性能和成本的平衡下有望打开全球AI需求天花板。模型端:需求天花板提升,推荐标的智谱,受益标的minimax、德适-B。 算力端:多模态落地与Agent规模化带动训练、推理算力需求长期刚性扩张,推荐标的阿里巴巴、百度集团-SW、联想集团,受益标的腾讯控股、天数智芯、中芯国际。 风险提示:软件及产品推出不及预期,产能及供应链风险,监管政策变动,宏观经济增长放缓,地缘政治风险。 目录 1、模型:Claude 4.6/4.8级别区间竞争愈加拥挤,中美模型差距持续收窄............................................................................41.1、Anthropic:Opus 5发布,以一半的成本提供Fable 5级别的模型,通往AGI的路径仍未降速...........................71.2、Kimi:发布K3,基于KDA和AttnRes构建2.8T大参数模型,缩小与海外SOTA模型身位差.........................91.3、OpenAI:发布GPT-5.6系列,进一步缩小与Anthropic的差距.............................................................................111.4、腾讯Hy3:小激活参数+快慢思考融合+真实业务闭环...........................................................................................141.5、阿里巴巴Qwen3.8:以Agent原生设计追求复杂任务能力上限.............................................................................152、ARR跟踪:头部模型ARR维持快速增长,因OpenAI竞争投入加大,短期增长斜率或有所波动.............................163、Agent跟踪:codex突破千万周活用户,腾讯WorkBuddy初露锋芒................................................................................174、算力:高端算力持续紧平衡,Token需求走向指数扩张....................................................................................................194.1、供给侧:GPU成熟卡种继续温和上涨,新一代卡种维持高位溢价.......................................................................194.2、需求侧:生产力场景及Agent驱动Token消耗指数级增长....................................................................................204.3、北美CSP高资本开支或为算力价格及Token消耗提供支撑...................................................................................214.3.1、谷歌云2026Q2收入利润持续超预期,上调全年CAPEX指引...................................................................214.3.2、Meta或进军云计算,关注内部算力利用效率................................................................................................224.4、科技企业裁员跟踪:本轮调整并非单纯行业收缩,而是资本开支结构重构........................................................245、投资建议..................................................................................................................................................................................256、风险提示..................................................................................................................................................................................25 图表目录 图1:根据deepSWE榜单,Claude Sonnet 4.6至Opus 4.8之间的已有多个模型...................................................................4图2:根据Arena竞技场Agent榜单,Kimi K3大幅缩窄了国产模型相较Fable 5的差距....................................................5图3:单位成本下的任务完成度取代纯参数或纯榜单分数,成为新一轮竞争核心................................................................6图4:中美模型差距持续收窄.......................................................................................................................................................7图5:Opus 5在多个维度上对齐Fable 5......................................................................................................................................8图6:在Frontier-Bench v0.1榜单中,Opus 5在更低的单项成本下,性能是Opus 4.8的2倍.............................................9图7:Kimi K3是首个达到2.8万亿参数规模的开源模型.....................................................................................................10图8:Kimi K3基于KDA和AttnRes构建................................................................................................................................10图9:多项测评中Kimi K3排名靠前.........................................................................................................................................11图10:Terminal-Bench 2.1榜单上GPT-5.6 Sol优于竞品.........................................................................................................12图11:ExploitBench榜单上,GPT-5.6 Sol与Claude Mythos Preview持平,但成本明显更低...