事件:智谱上线并开源GLM-5.3-Flash(320B-A18B),核心要点如下: 1)模型能力优秀,前期已获市场认可,匿名发布阶段社区关注度极高,但参数规模仍然令人惊喜。正式发布前以匿名模型Ox-Alpha在OpenCode和OpenRouter进行了大规模测试,迅速成为当周最受欢迎模型,创下双平台调用量新高。具体指标上,GLM-5.3-Flash总参数320B,能力超过GLM-5.2(参数量高出一倍的模型),AA综合智能指数57分,进入全球前沿区间,与Claude Opus 4.8持平;Z.ai Code Bench编程体感与Opus 4.8相当。同时,GLM-5.3-Flash是GLM-5系列首个原生多模态模型,模型可自主判断何时"观察"并用视觉反馈指导下一步行动。 2)定价具有吸引力,体现公司极强工程能力。GLM-5.3 flash定价为GLM-5.3的1/10,限时折扣内为1/20,为Claude Opus 4.8的1/40。体现公司极强工程能力:模型总参数量与GLM-4.5相当,激活参数18B(GLM-4.5为32B)、层数45(GLM-4.5为92),几乎减半;30T Token多模态预训练。首个采用稀疏注意力+线性注意力混合架构的开源前沿模型,线性注意力捕获局部依赖,稀疏注意力经轻量级索引器召回全局上下文;引入IndexPool(加权池化将4个索引器缓存向量压缩为1个)降低1M上下文开销。 3)过去一周匿名测试的免费服务全部由国产芯片集群承载,系公司首次以国产芯片集群服务大规模流量,且硬件效率和单token成本已达主流英伟达GPU相当水平,验证了国产芯片可在大规模场景下高效经济地支撑前沿模型推理,为未来推理放量奠定实践基础。 观点重申:近期海外头部模型ARR预期波动,导致市场对于LLM观点出现分歧,我们仍坚定看好智谱投资机会,公司模型能力维持领先优势,融资落地后公司算力规模持续扩大,将有助于提升ARR的增长预期及能见度,维持公司“买入”评级。 风险提示:行业应用进展不及预期 联系人:张良卫/周良玖