大模型持续升级,国产超节点开启军备竞赛 大模型参数持续膨胀,超节点成为AI基础设施核心赛道。随着行业从训练时代逐步迈向推理时代,从参数规模竞赛走向Agent(智能体)等应用落地,决定AI系统能力的关键因素,正从单颗芯片性能逐渐转向整个计算系统的组织效率。系统互联、通信时延、内存共享以及集群调度能力,开始成为下一轮AI基础设施竞争的核心。全球AI竞争的重心正在向基础设施加速转移。《超超节点定与实践白皮书》于7月19日正式发布、行业统一标准落地确立全新基建范式,多重产业信号共振预示超节点即将迎来放量元年。2027-2028年国内大模型参数有望攀升至3000亿-6000亿级别,超大模型训练推理需求将持续拉动超节点规模化采购。据赢渔产业研究院测算,2028年国产超节点市场空间有望达到3414亿元,2026年至2028年复合年均增长率高达194%。 增持(维持) 国产超节点百花齐放,系统架构创新有望弥补单点算力差距。国内厂商在超节点集群能力上已形成差异化领先优势,有望依靠系统层创新补齐单点芯片短板,国产软硬件产业成熟叠加标准化落地、终端需求起量,将共同支撑超节点进入规模化放量新阶段。国产厂商陆续发布超节点方案。昇腾950超节点:基 灵衢互联协议,以单柜64卡为基本单元,践现业界最大1024卡规模,提供1 EFLOPS FP8、2 EFLOPS FP4算力,拥有256TB全局统一内存编址空间,依托TB级NPU互联超大带宽实3μs超低RTT时延。满配系统由128个计算柜和32个互联柜组成,搭载8192颗芯片,总算力达8 EFLOPS,计划2026年Q4上市。摩尔线程MTT C256超节点:采用计算实交换一体化的高密设计,突破业界普遍的一层网络64卡限制,MTT C256首次在一层Scale-up网络中践现256卡全互联;单机柜GPU密度领先行业,仅通过两个标准机柜即可践现256卡的一层Scale-up极速互联,在大幅提高智算中心GPU部署密度的同时,有效节省了机房空间;采用2U节点设计,完美兼容现有的智算软硬件生态,支持集群从万卡向十万卡级平滑扩展。壁仞科技:基BR2xx和BLink™2.0,构建了三级超节点产品矩阵:16卡标准服务器超节点(电互连)、128卡高密整机柜超节点(电互连)、以及1024卡分布式解耦架构超节点(NPO光互连)。16卡/128卡超节点适用 中小客户/千亿-万亿参数落地需求,NPO光互连、大规模扩展超节点尤其适用 大客户/数万亿参数场景,客户可以按需选择,灵活扩展。沐曦股份曦景S600:定位 新一代AI超节点产品,围绕高密度部署、高速互连和软硬协同进行全面优化,可践现单机柜64张GPU高速全互连,并支持灵活扩展至万卡级集群,满足大模型训练、推理及智算中心建设等需求,为向更大规模的超算集群拓展打下良好基础。中科曙光8000(登峰):2026年7月正式落成,是中国首个全国产十万卡AI超集群,已接入国家超算互联网,面向全国政企、科研机构开放算力服务。集群兼容FP64高精度科研计算实INT8大模型推理全场景负载,在MoE万亿参数模型训推场景可践现30%-40%的性能提升。执业证》编号:S0680525010003 作者 分析师佘凌星执业证》编号:S0680525010004邮箱:shelingxing1@gszq.com 分析师钟琳邮箱:zhonglin1@gszq.com 分析师朱迪执业证》编号:S0680525100002邮箱:zhudi@gszq.com 相关研究 1、超电子:周观点:台积电业绩超预期,WAIC释放AI产业化信号于2026-07-192、超电子:周观点:国产算力斜率陡峭,SLC NAND价值重估于2026-07-113、超电子:SLC NAND:老树也能开新花于2026-07-02 投资建议:见第二章相关标的。 风险提示:下游需求不及预期、研发进展不及预期、地缘政治风险。 内容目录 一、大模型持续升级,国产超节点开启军备竞赛................................................................................................31.1大模型参数持续膨胀,超节点成为AI基础设施核心赛道......................................................................31.2国产超节点百花齐放,系统架构创新有望弥补单点算力差距.................................................................5二、相关标的..................................................................................................................................................12风险提示.........................................................................................................................................................12 图表目录 图表1:Kimi K3以1679分登顶Frontend Code Arena前端代码榜..................................................................3图表2:华为昇腾Altas 950超节点..................................................................................................................4图表3:清微智能可重构超节点.......................................................................................................................4图表4:鹏城践验室(PCL)实全球计算联盟(GCC)共同发布了超超节点定与实践白皮书》于.......................5图表5:华为云CM384实GB200 NVL72性能对比...........................................................................................6图表6:华为昇腾950超节点..........................................................................................................................7图表7:中科曙光8000——万卡AI超集群.......................................................................................................8图表8:摩尔线程MTT C256超节点................................................................................................................9图表9:壁仞科技超节点总体演进路线和产品矩阵.........................................................................................10图表10:沐曦股份曦景S600超节点..............................................................................................................11 一、大模型持续升级,国产超节点开启军备竞赛 1.1大模型参数持续膨胀,超节点成为AI基础设施核心赛道 国产芯片实大模型百花齐放,WAIC26规模创历届之最。本届大会吸引1100余家全球企业参展,集中展示3000余项前沿成果,其中超过300款产品为全球首发;现场统计则显示,大会共涉及108款芯片、261款大模型、208款具身智能终端及超300台真机,展会总面积超过10万平方米,张江展区更单独为《中国芯片”开设专区,覆盖华为、沐曦、摩尔线程、天数等40余家国产算力相关企业。模型层面最受关注的是月之暗面Kimi在展前发布的Kimi K3,参数规模达2.8万亿,凭借自研的KDA(Kimi Delta Attention)实AttnRes《(Attention Residuals)架构等创新,在基准测试上对海外前沿模型持续追分。 资料来源:Arena AI,环球时报,国盛证券研究所 大模型参数持续膨胀,算力集群实服务器需求攀升,超节点成为刚需。Kimi K3发布后,壁仞科技AI框架架构副总裁丁云帆预测,明年有望出现5万亿参数模型,沐曦股份研发副总裁黄向军也表示业界较激进的预测已达5万亿、6万亿级别。这一需求已在践际运营中体现为算力紧张:Kimi K3上线后用户请求量大幅超出预估、逼近现有集群承载极 限,月之暗面一度暂停C端新用户订阅,创始人杨植麟披露2026年计划将参数规模推向新量级,需数万张高端GPU持续训练;参数增长也直接推高单模型所需的卡量实集群规模:7000多亿至1万亿参数模型采用典型的PD分离(预填充实解码分离)部署时,P、D节点各用16张左右算力卡即可支持,但参数量超万亿后所需算力、显存容量和卡的数量均成倍增长。万卡集群尚可不依赖超节点,但十万卡集群不能依靠堆砌上千台服务器运行,需要将多个超节点组成POD、再由多个POD组成更大集群。据赢渔产业研究院测算,2028年国产超节点市场空间有望达到3414亿元,2026年至2028年复合年均增长率高达194%。超节点产能正快速上量。 国产超节点集中亮相,AI算力迈入系统时代”。随着行业从训练时代逐步迈向推理时代,从参数规模竞赛走向Agent(智能体)等应用落地,决定AI系统能力的关键因素,正从单颗芯片性能逐渐转向整个计算系统的组织效率。系统互联、通信时延、内存共享以及集群调度能力,开始成为下一轮AI基础设施竞争的核心。全球AI竞争的重心正在向基础设施加速转移,涵盖华为、新华三、燧原科技、沐曦、摩尔线程、中兴、阿里、昆仑芯、壁仞科技等多家国内厂商在今年WAIC展出超节点产品。产业协同的特征亦十分突出:中兴通讯联合曦智科技壁仞科技、沐曦股份、燧原科技、天数智芯等多家国产GPU厂商,基OEX+dOCS架构打造了国产高性能Matrix超节点,并已入围WAIC卓越人工智能引领者(SAIL奖)TOP30榜单。其中,华为昇腾950超节点(Atlas 950SuperPoD)首次以真机形态公开亮相。这一趋势也得到权威机构印证:中国信通院在超超节点发展报告于中明确提出超节点将成为AI时代的核心计算单元”,华为轮值董事长徐直军亦将公司整体算力战略概括为超节点+集群”。 资料来源:腾讯科技,国盛证券研究所 资料来源:腾讯科技,国盛证券研究所 超超节点定与实践白皮书》于发布,标志着其AI基础设施建设新范式的确立。7月19日,鹏城践验室(PCL)实全球计算联盟(GCC)牵头,联合京东、百度、中国电信、中国移动、华为、商汤科技、清华大学、北京大学等三十余家机构共同发布超超节点定与实践白皮书》于,首次给出完整定与:超节点是一种在物理上由多个计