您的浏览器禁用了JavaScript(一种计算机语言,用以实现您与网页的交互),请解除该禁用,或者联系我们。 [未知机构]:智谱 推动大型数据中心建设 仍有能力保持模型sota 东吴传媒互联网张良卫团队 - 发现报告

智谱 推动大型数据中心建设 仍有能力保持模型sota 东吴传媒互联网张良卫团队

2026-07-21 未知机构 小酒窝大门牙
报告封面

事件:根据彭博社报道,智谱已完成一座仅搭载国产芯片的大型数据中心的建设,目标功率1GW。 观点重申: 算力瓶颈背景下先优化,后放大——以上下文从200k拓展到1M为例。长上下文不是免费午餐。扩展上下文窗口意味着:1)训练时要用更长的序列,序列长度会让单步训练成本暴增;2)需要重新调整位置编码;3)需要大量高质量长文本训练数据——而这部分数据本身就稀缺。如果早期就把算力倾注到长序列训练上,会挤占提升推理、代码、数学等核心能力的资源。GLM-5.2架构核心目标是在百万级上下文下,把”计算”和”显存/KVcache”两条瓶颈同时压下来。它围绕三块展开:1)DSA(稀疏注意力);2)IndexShare(indexer复用);3)改进的MTP。基于以上创新,公司实现了GLM5.2能力的稳健提升并达到国内sota,期待后续GLM-5.3的市场表现。 推进大型数据中心建设,再融资落地后算力瓶颈有望快速得到缓解。根据彭博社报道,该大型数据中心将搭载国产算力芯片。公司前期融资节奏及规模在国内大模型初创公司中并不突出。公司7月成功按配售价每股配售股份1,588.00港元发行合共19,780,000股新H股,所得款项总额合共约为314亿港元,公司仍计划于科创板上市,拟募投项目规模150亿人民币。融资落地后,将加速公司模型训练及ARR放量。 前期由于市场对于竞争格局的担心股价出现显著回调,我们认为市场对于公司模型能力的评价过于悲观,看好公司模型能力维持领先及ARR增长潜力,维持公司“买入”评级。 风险提示:公司新模型进展不及预期,市场系统性风险。 联系人:张良卫/周良玖