您的浏览器禁用了JavaScript(一种计算机语言,用以实现您与网页的交互),请解除该禁用,或者联系我们。 计算机行业周报20260829:GLM5.3-Flash全面激活国产算力 - 国联民生证券 | 发现报告

计算机行业周报20260829:GLM5.3-Flash全面激活国产算力

报告封面

GLM5.3-Flash全面激活国产算力 glmszqdatemark2026年08月30日 推荐 维持评级 市场回顾 本周(8.24-8.28)沪深300指数下跌0.21%,中小板指数上涨0.15%,创业板指数下跌3.42%,计算机(中信)板块上涨1.11%。板块个股涨幅前五名分别为:楚天龙、中安科、汇金股份、鼎捷数智、兆日科技;跌幅前五名分别为:ST佳缘、魅视科技、和达科技、格灵深瞳、达梦数据。 行业要闻 智谱发布并开源GLM-5.3-Flash腾讯混元正式发布新一代大语言模型Hy4 preview亚马逊将加购200万块英伟达GPU阿里巴巴宣布800亿港元港股配售 分析师吕伟执业证书:S0590525110033邮箱:lvwei_yj@glms.com.cn 分析师郭新宇执业证书:S0590525110034邮箱:guoxinyu@glms.com.cn 公司动态 浪潮信息:2026年上半年实现营业收入843.79亿元,同比增长5.22%;归母净利润29.52亿元,同比增长269.59%。公司已推出兆瓦级两相液冷AI整机柜方案,单芯片解热能力突破3000W,单位面积解热能力达每平方厘米250W以上,前瞻适配未来GW级AI数据中心建设需求;元脑智算算力仓则通过算力、液冷及基础设施一体化设计,在京津冀、西南、西北等地区持续落地。 中国长城:公司2026年上半年实现营业收入79.58亿元,同比增长25.00%;归属于上市公司股东的净利润3.12亿元,同比增长125.71%。公司计划不派发现金红利,不送红股,不以公积金转增股本。公司扣除非经常性损益后的净利润为-3.16亿元,上年同期为-4.27亿元,亏损有所收窄。 卓易信息:2026年上半年营业收入1.78亿元,同比增长2.00%;归属于上市公司股东的净利润1.06亿元,同比增长291.66%,2025年同期为2712.55万元;归属于上市公司股东的扣除非经常性损益的净利润4730.32万元,同比增长126.12%。 相关研究 1.计算机行业周报20260823:算力网与模算协同国产化机遇-2026/08/232.计算机行业周报20260817:大模型竞相“打榜”:如何评估谁最强?-2026/08/173.计算机行业周报20260809:大模型进入量价齐升的商业化黄金期-2026/08/094.计算机行业事件点评:AI应用弹性方向之金融与支付-2026/08/035.计算机行业事件点评:从“码农”到FDE:计算机行业重估的关键-2026/08/03 投资建议 算力网建设在"十五五"万亿级别直接投资的政策驱动下进入加速落地期,叠加国产算力公司业绩高增与大厂资本开支持续加码,国产算力景气度有望延续。同时,发展自主大模型与自主算力的紧迫性与战略意义持续凸显,国模加国芯的模算协同、全国产大模型迎来重大战略机遇。建议关注:1)国产算力:寒武纪、海光信息、云天励飞等。2)超节点及算力网等算力服务提供商:浪潮信息、软通动力、紫光股份、中国长城、联想集团、神州数码、思特奇等。3)算力租赁方向的宏景科技、集智股份(ARM Token工厂)、协创数据、利通电子、行云科技、智微智能、阿里巴巴、优刻得、金山云等标的。 风险提示:人工智能政策不及预期,行业竞争加剧。 目录 1本周观点.................................................................................................................................................................31.1国产大模型:从架构与系统层面对国产算力进行适配优化.......................................................................................................31.2国产算力:适配沿多条路线快速成熟,头部公司业绩高增验证行业高景气.........................................................................41.3投资建议..............................................................................................................................................................................................82行业新闻.................................................................................................................................................................83公司新闻..............................................................................................................................................................104本周市场回顾........................................................................................................................................................115风险提示..............................................................................................................................................................13插图目录..................................................................................................................................................................14表格目录..................................................................................................................................................................14 1本周观点 1.1国产大模型:从架构与系统层面对国产算力进行适配优化 架构层面,大模型推理中注意力计算是显存消耗与带宽压力的最大来源。在此背景下,稀疏注意力与低激活参数成为国产大模型优化的主要方向之一。观察部分头部模型厂的新一代架构,可以看到高度趋同的解法——用稀疏/线性注意力压缩注意力计算,同时大幅压低激活参数量: 智谱GLM-5.3-Flash总参数量355B(与GLM-4.5的320B基本相当),激活参数量由32B压缩至18B、层数由92层减至45层,采用线性注意力与稀疏注意力混合架构,稀疏注意力引入IndexPool索引器;DeepSeek-V4在token维度压缩上下文,结合DSA稀疏注意力,1M上下文成为全系服务标配。稀疏/线性注意力将注意力计算的显存与带宽需求大幅压缩,缓解显存消耗与带宽压力。 资料来源:智谱官方公众号,国联民生证券研究所 系统层面,智谱GLM-5.3-Flash公开服务全部由国产算力支撑,验证国产芯片的可行性边界。GLM-5.3-Flash公开服务在试用期间全部由国产算力支撑,依托国产芯片集群与自研高带宽互联网络,首次在大规模流量场景下承担前沿模型推理。最终效果是端到端服务性能较同一硬件基线提升3倍,硬件效率与单token成本达到与主流英伟达GPU相当的水平。另一个值得注意的细节:全部构建与优化工作由GLM-5.3驱动的infra agent协助完成(算子开发、瓶颈诊断、部署栈改进),模型能力开始反哺算力优化效率本身。商业化方面,GLM-5.3-Flash已全球开源,接入ZCode等编码平台,纳入GLM Coding Plan(每天限量发放10,000张体验卡)并开放API。 1.2国产算力:适配沿多条路线快速成熟,头部公司业绩高增验证行业高景气 芯片自建软件栈:以龙头为例,积极适配国产生态。2026年8月26日,寒武纪在GLM-5.3-Flash发布当天完成适配。寒武纪Neuware软件栈原生支持PyTorch、vLLM等主流AI框架,MLA、MHC、MoE、MTP等适配基础设施开箱即用,并利用Triton的社区兼容性快速完成算子开发。 资料来源:寒武纪开发者官方公众号,国联民生证券研究所 针对模型线性注意力与稀疏注意力混合架构,寒武纪对IndexPool索引器完成Token粒度到Pool粒度的地址换算、在Decode阶段对全历史Gather分块控制峰值;线性注意力以循环状态替代传统KV Cache,寒武纪在Decode路径采用批量张量化、Prefill路径采用递推结构分块并行,并自研MLU Triton内核完成核 心计算,线性注意力性能获得量级提升。 向商业化进发,海光信息加速国产生态布局。海光信息在2026数博会首发“Agent to Token开放计算架构”:依托CPU与DCU双芯协同与开放互连,贯通Agent任务执行与词元生产的完整计算周期。CPU承担任务编排、实时决策及通用计算,DCU专注AI计算与词元生产加速。该架构在算力、互连、安全、软件栈四个维度开放对接,支持异构算力灵活组合、多协议互连协同、全链路安全防护及全栈软件适配。生态方面,以海光为核心的光合组织已汇聚六千余家生态伙伴,覆盖数据处理、算力供给、模型运行与智能应用全链条,为词元经济规模化落地提供体系化支撑。 开源跨芯片公共底座:FlagOS已形成“核心库—插件—领域项目—工具与服务”多层开源组件体系。国产芯片种类较多,过去每款模型需在每款芯片上重复适配。FlagOS是一个完全开源的异构AI芯片系统软件栈,允许AI模型一次开发即可无缝移植到广泛的AI硬件平台,实现最小化的适配成本。1)核心库是底座:FlagGems通用算子库及多个细分算子库提供计算支撑,FlagTree统一编译器让同一套算子代码运行在多家国产芯片上,FlagScale覆盖模型训练到部署全流程,FlagCX解决跨芯片通信。2)插件层负责“连接”:把vLLM、SGLang等主流推理框架,以及Megatron-LM等训练、强化学习框架接入FlagOS,兼顾推理与训练全流程。3)领域项目向具身智能和量子模拟延伸。4)工具与服务层面,KernelGen可用自然语言自动生成算子,FlagOS Skills兼容Claude Code等主流Agent,FlagRelease自动完成模型跨芯片迁移与发布,FlagPerf负责硬件性能评测,FlagCICD打通跨芯片持续集成。 资料来源:众智FlagOS官网,国联民生证券研究所 模型厂商垂直整合:智谱收购中科加禾,进一步加强国产大模型与国产算力的适配优化能力。智谱收购AI异构算力软件公司中科加禾。中科加禾技术源头为中 科院计算所编译实验室,对上为AI模型提供统一标准接口,对下适配华为昇腾、寒武纪、海光等主流国产