智谱发布GLM-5.3-Flash,Qwen3.8-Flash-Next开源 —计 算 机行 业 周 报 投资要点 推荐(维持) ▌算力:百度发布Agent沙箱夯实智能体底座,智谱开源GLM‑5.3‑Flash实现性能与成本双优化 分析师:任春阳S1050521110006rency@cfsc.com.cn 2026年8月26日智谱AI开源GLM‑5.3‑Flash原生多模态大模型,依托稀疏注意力等架构优化,在代码、Agent任务性能达到国际前沿水平,推理成本大幅下降,同时完成国产算力适配,有望推动大模型在高频场景规模化落地 行 业 相 对 表 现 ▌AI应 用 :NotionAI周 访 问 量 环 比+7.76%,Qwen3.8-Flash-Next开源 2026年8月26日,阿里千问团队正式开源了基于下一代Qwen4架构构建的多模态MoE模型——Qwen3.8-Flash-Next。该模型主体参数量达到125B,并额外配备了51B的N-gramEmbedding,每token激活6B参数。在上下文处理能力方面,该模型原生支持262144 token的窗口长度,并可借助YaRN扩展技术将有效上下文进一步提升至100万Token的量级。 ▌AI融资动向:鹏行智能完成超9亿美元首轮融资,投后估值超63亿美元 鹏行智能完成超9亿美元首轮股权融资,投后估值63亿美元,由IDG资本领投。资金将投入人形机器人本体、AI模型训练与产线建设,本轮融资体现资本对国内具身智能赛道的高度看好。 相 关 研 究 1、 《 计 算 机 行 业 点 评 报 告 :Roblox:Q2营收与自由现金流强劲增长,AI赋能UGC创作生态再扩容》2026-08-302、 《 计 算 机 行 业 点 评 报 告 :DoorDash(DASH):会员飞轮驱动稳健增长,AI与自动驾驶拓展长期空间》2026-08-303、《计算机行业周报:DeepSeek上线全新多模态模型,CodexHarness开源》2026-08-24 ▌投资建议 近日,英伟达发布2027财年第二季度财报。当季收入962.21亿美元,同比增长106%、环比增长18%,增速连续第四个季度环比抬 升;其 中数 据中心收入890亿 美元,同 比增长117%、环比增长18%,超大云厂商(hyperscale)收入490亿美元、环比增长13%,边缘计算收入72亿美元,同比增长27%;GAAP与Non-GAAP毛 利 率 均 为75.0%( 上 年 同 期72.4%/72.5%) ;GAAP净 利 润596.88亿 美 元 , 同 比 增 长126%,摊薄EPS2.46美元,同比增长128%;当季自由现金流213.41亿美元(上季485.54亿美元),环比回落主因应收账款增加及为VeraRubin量产备货;当季回购与股息合计回馈股东约260亿美元;当季新发债约249亿美元。指引方面,3QFY27收入预期1,080亿美元±2%(不含中国数据中心计算收入),毛利率74.0%±50bp;公司预计FY2028收入将增长 约70%,并强调该预期为供给受限口径。公司CFO在财报电话会上表示,当前云行业积压订单已超2万亿美元,并预计前五大超大云厂商2026/2027年资本开支分别接近8,000亿/1.3万亿美元。财报同步披露,公司与Apollo、BlackRock、Blackstone、Brookfield、高盛、KKR达成战略合作,拟设立独立算力融资平台、撬动超5,000亿美元第三方资本投向AI基 础 设 施 ;VeraRubin平 台 已 进 入 全 面 量 产 , 机 架 在CoreWeave、GoogleCloud、MicrosoftAzure、OCI、Nebius等伙伴处上线运行。 本次财报的核心信号在于需求端与投入端同时进一步加速:需求端,去年同期全球AI算力建设基本由单一大客户拉动,本季已变为多家前沿实验室集体大规模扩建,叠加AI创业公司、各国主权AI项目及机器人等新需求放量;1,080亿美元的下季指引对应环比约12%的增长,表明算力需求仍在加速兑现。投入端,公司首次通过"自己发债+联合六大资管机构设立算力融资平台"的方式,为下游客户筹措超5,000亿美元建设资金,商业模式从单纯出售芯片进一步延伸至为客户提供融资支持;库存与应收账款同步大增,也指向VeraRubin量产爬坡的确定性较高。我们认为,英伟达财报所呈现的需求信号与算力融资平台的设立相互印证,全球AI基础设施投入仍处加速期,公司管理层对前五大云厂商2027年资本开支接近1.3万亿美元的预期将进一步打开算力产业链空间。 中长期,建议关注专注于功率半导体及模拟芯片测试系统研发的联动科技(301369.SZ)、专注于半导体等高端制造业的罗博特科(300757.SZ)、新能源业务高增并供货科尔摩根等全球电机巨头的唯科科技(301196.SZ)、AI智能文字识别与商业大数据领域巨头的合合信息(688615.SH)、深耕工业AI与 软 件 并 长 期 服 务 高 端 装 备 等 领 域 头 部 客 户 的 能 科 科 技(603859.SH)。 ▌风险提示 1)AI底层技术迭代速度不及预期。2)政策监管及版权风险。3)AI应用落地效果不及预期。4)推荐公司业绩不及预期风险。 正文目录 1、算力动态:百度发布AGENT沙箱夯实智能体底座,智谱开源GLM‑5.3‑FLASH实现性能与成本双优化..51.1、Tokens跟踪.......................................................................51.2、云厂动态:百度智能云发布智能体沙箱AX,持续完善Agent云基础设施...................71.3、产业动态:智谱发布GLM-5.3-Flash,性能持续提升,推理成本大幅下降..................82、AI应用动态:NOTIONAI周访问量环比+7.76%,QWEN3.8-FLASH-NEXT开源.......................102.1、周流量跟踪:NotionAI周访问量环比+7.76%..........................................102.2、产业动态:Qwen3.8-Flash-Next开源,GDN与QSA双轨协同破解长文本记忆与检索难题.....103、AI融资动向:鹏行智能完成超9亿美元首轮融资,投后估值超63亿美元.......................134、行情复盘..............................................................................155、投资建议..............................................................................176、风险提示..............................................................................18 图表目录 图表1:TOKENS规模LEADERBOARD(TOKEN消耗量为统计口径).....................................7图表2:文本类模型市场份额占据示意图(REQUEST调用量为统计口径).............................7图表3:GLM-5.3-FLASH基准测试结果...........................................................8图表4:主流前沿模型性能与价格对比..........................................................9图表5:2026.8.21-2026.8.27 AI相关网站流量.................................................10图表6:QWEN3.8-FLASH-NEXT与DEEPSEEK-V4系列模型价格对比(单位:元/百万TOKENS)..............11图表7:90%PREFIX CACHE命中率下的相对PREFILL吞吐量.......................................11图表8:QWEN3.8-FLASH-NEXT模型架构.........................................................12图表9:上周AI初创公司融资动态............................................................13图表10:上周(2026.8.24-2026.8.28日)指数日涨跌幅.........................................15图表11:上周(2026.8.24-2026.8.28日)AI算力指数内部涨跌幅度排名..........................15图表12:上周(2026.8.24-2026.8.28日)AI应用指数内部涨跌幅度排名..........................16图表13:FICONTEC2025年年中至今公告订单....................................................17图表14:重点关注公司及盈利预测............................................................18 1、算力动态:百度发布Agent沙箱夯实智能体底座,智谱开源GLM‑5.3‑Flash实现性能与成本双优化 1.1、Tokens跟踪 根据OpenRouter公开数据,2026年8月24日至8月30日,周度Token消耗量显著上涨,消耗量为113T,环比上周增加24.04%。在Tokens规模Leaderboard前五名中,stealth的Ox Alpha以15.7T tokens位列榜首;Deepseak的Deepseek V4 Flash0731以12.3Ttokens位居第二;Xiaomi的MiMo-V2.5以9.14T tokens位居第三;Openai的GPT-5.6Luna以7.79Ttokens位居第四;Tencent的Hy3以6.66Ttokens位居第五。 文本类模型的市场份额,Deepseek以1.11B requests占据23.5%的份额,位列第一。google,openai,z-ai则分别以1.01B、927M、295M requests,对应占据21.5%、19.7%、6.3%的市场份额。 图像生成类模型调用量略上升,调用量为5.76M requests,环比上周增加约0.52%。在ImageLeaderboard中,Google的Nano Banana系列包揽榜单前四名席位,其中,NanoBanana2 (Gemini 3.1 Flash Image)以1.32M requests位居第一;Banana 2 Lite (Gemini3.1Flash Lite Image)、Nano Banana 2(Gemini 2.5 Flash Image)、Nano Banana 2(Gemini 3.1 Flash Image Preview)分别以1.13M、607K、479K requests位居第二、第三和第四;OpenAI的GPT Image 2以456K requests位列第五。从市场份额来看,Google以4.12Mrequests占据71.5%的份额,位居第一;OpenAI以137K requests占据12