牵头单位 鹏城实验室 全球计算联盟 参编单位(按拼音顺序) 安谋科技中国有限公司百度在线网络技术(北京)有限公司北京大学北京神州鲲泰信息技术有限公司北京沃东天骏信息技术有限公司哔哩哔哩股份有限公司得瑞领新(重庆)科技有限责任公司东莞立讯技术股份有限公司广东远图未来科技有限公司杭州劲群科技有限公司杭州天宽科技有限公司华南理工大学华为技术有限公司京东集团股份有限公司科大讯飞股份有限公司浪潮计算机科技有限公司 联想集团有限公司木犀智能(北京)科技有限公司鹏城实验室清华大学奇异摩尔(上海)半导体技术有限公司软通计算机有限公司锐捷网络股份有限公司上海壁仞科技股份有限公司上海国创驭算人工智能科技有限公司上海阡视科技有限公司上海商汤科技开发有限公司苏州盛科通信股份有限公司武汉长江计算科技有限公司行吟信息科技(上海)有限公司(小红书)新华三技术有限公司益思芯科技(上海)有限公司浙江大学中国电信股份有限公司研究院中国科学技术大学中国移动通信有限公司研究院中科寒武纪科技股份有限公司中研益企(北京)信息技术研究院有限公司 编写组成员(按参编单位字母排序) 吴枫、田永鸿、陈文光、李诚、余跃、张士勋、贺志学、杨建坤、王孝国、张子尧、陈锴、武正辉、高洪福、张泽华、齐浩、吕宏、陆汉城、杨博程、陈琼南、罗振、王小泉、邢星、马永昊、杨昊、张晓波、龚徐建、张帆、陆璐、张羽、蒋铭、王贵林、席朝飞、鲍中帅、崔希琳、尹宏伟、李鑫、周韬、刘宜龙、朱斌、包贵新、刘军、李亚军、程旭升、孙鹏、辛博、朱鑫、程秋林、宣善明、代文斌、成伟、王俊杰、易超、吴新豫、陈立波、马瑜、汪新新、郭维锋、吴飞、王则可、王总辉黄志兰、刘圆、李聪聪、陈忞、于涌、张广彬 版权声明 本研究报告版权属于鹏城实验室和全球计算联盟。 使用说明:未经鹏城实验室和全球计算联盟事先的书面授权,不得以任何方式复制、抄袭、影印、翻译本文档的任何部分。凡转载或引用本文的观点、数据,请注明“来源:鹏城实验室、全球计算联盟”。 序 当前,人工智能正以前所未有的广度和深度影响人类社会的生产与生活方式。万亿甚至十万亿参数模型、超长上下文、多模态融合与世界模型等大规模应用,将算力需求推向指数级增长的新高度。然而,单芯片性能的提升远远无法满足这一需求,依靠简单规模堆叠的传统扩展路径也面临着边际收益递减的困局。由多芯片紧密协同组成“超节点”,进而实现算力基础设施的系统级架构重构,已成为突破现有算力瓶颈的必然选择。 鹏城实验室长期深耕前沿算力基础设施的探索与实践。为筑牢国家算力主权根基,实验室正牵头推进“中国算力网(C²NET)”建设。在以“鹏城云脑”大科学装置为核心枢纽,持续开展大规模智能计算系统的建设与运行中,我们深刻认识到,重构算力基础设施底层架构,已成为支撑智能计算纵深演进的必然选择。基于这一科学研判,实验室不仅积极推动超节点技术的理论研究与概念体系构建,更率先建设了国内首个采用超节点架构的国产智算集群“鹏城云脑Ⅲ”,并广泛汇聚产业界在算力互联与体系架构创新上的探索与实践。 在全面深化全国一体化算力网总体布局的背景下,鹏城实验室将围绕算力网的基础理论、关键技术、系统架构和工程实践,规划出版算力网系列白皮书。本白皮书作为该系列的开篇之作,由鹏城实验室与全球计算联盟联合发起,汇聚了科研机构与产业界的研究成果和实践经验,系统阐述了超节点的核心定义、架构特征与底层技术体系,探讨了智算、通算及通智融合等核心场景的实践验证,并构建了从物理层到功能层的总线分层能力框架。此举旨在进一步凝聚产业共识、沉淀工程经验,推动自主可控的技术标准加速形成。 期待本白皮书能够成为深化产业协作的新起点,推动芯片、互联、软件与运维全链条的协同创新,加速超节点技术走向开放化、标准化与生态化。我们愿与 各界同仁一道,为构建自主领先的先进算力基础设施、推动全球人工智能产业高质量发展贡献力量。 鹏城实验室主任高文二〇二六年七月 序 当前,人工智能正以前所未有的深度重塑人类社会的生产与生活方式。大模型技术的快速演进,对算力基础设施提出了从“规模堆叠”向“系统级重构”的范式跃迁要求。超节点作为契合AI计算特征的系统性架构创新,应运而生。 传统集群架构在应对AI大模型“紧耦合、同步并行”的计算特征时,面临通信瓶颈与效率衰减的双重挑战。超节点技术通过构建全局统一内存地址空间、实现内存语义跨节点访问、打造超高带宽与超低时延互联,将分散的物理计算单元融合为逻辑一体的“超级计算机”,从根本上突破了算力扩展的架构层面约束,为ScalingLaw的持续演进提供了坚实的工程底座。 本白皮书由鹏城实验室、全球计算联盟联合业界科研机构与产业伙伴共同编制,系统阐述了超节点的核心定义、架构特征及技术特征,面向大模型预训练、推理、智能体、科学计算等应用场景进行了深度探索,同时涵盖了智算、通算及通智融合超节点的产业界实践验证,对超节点技术的研究、应用与标准化具有重要参考价值。 超节点正加速推动算力产业从单点硬件竞争迈向系统架构创新。期待本白皮书为“政产学研用”各界提供有益参考,推动超节点技术走向开放与标准化,助力全球人工智能基础设施的高质量可持续发展。 全球计算联盟金海理事长 序 当前,人工智能正处于从能力涌现迈向规模化应用的关键阶段。以ScalingLaw为代表的规模化路径仍在持续拓展,多模态、稀疏专家、超长上下文、推理时扩展和智能体等技术加速演进,不断打开大模型能力的边界。与此同时,模型规模、数据规模和Token消耗的快速增长,也使算力基础设施面临前所未有的挑战:制程演进趋缓,单芯片性能提升的边际成本不断上升,存储容量、访存带宽、互联效率、能源供给与工程交付日益成为制约智能发展的关键因素。人工智能的持续演进,正在推动计算体系由依赖单点器件突破,转向芯片、互联、存储、软件与工程基础设施协同创新的新阶段。 面对这一趋势,算力竞争的基本单元也在发生深刻变化——从单颗芯片、单台服务器,逐步走向整机柜、超节点乃至数据中心级计算系统。对于我国计算产业而言,正视单芯片能力与国际顶尖水平之间的客观差距固然必要,但更为重要的是认识到:未来算力的竞争,并不只是单颗芯片峰值性能的竞争,更是将大量计算、存储与网络资源高效组织起来的系统能力之争。通过架构创新释放系统潜力,以系统级扩展弥补单点能力的不足,并进一步形成面向具体负载的整体效率优势,是构建先进算力基础设施、提升产业自主创新能力的重要路径。 超节点正是这一计算范式变革的重要载体。它通过高速、低时延、大带宽的互联协议,将数十乃至数百个计算单元紧密连接,在跨物理节点的统一内存编址和内存语义访问基础上,构建逻辑上具备“一台计算机”特征的Scale-Up计算系统。超节点是对计算、内存、存储、网络、供电、散热以及系统软件的协同重构。其核心价值,在于打破传统服务器边界,缩短数据移动路径,降低大规模并行中的通信与同步开销,使更多计算单元能够以接近整体化的方式高效协同,为万亿乃至十万亿参数模型、超长上下文、稀疏专家模型、复杂推理与智能体等新型负载提供可持续扩展的算力底座。 架构边界的重构,也必然带来新的复杂性。统一地址空间如何构建,内存语义如何跨节点延伸,互联拓扑与通信协议如何设计,计算、网络和存储如何协同,软件如何感知并利用硬件能力,以及高密度系统如何保障可靠、安全、可运维和可持续演进,都需要产业界形成更加清晰的技术共识与协作框架。超节点要真正从单一产品创新走向广泛产业实践,不仅需要局部技术突破,更需要统一的概念体系、架构语言、能力分级、设计规范和测试评价体系。 本白皮书围绕超节点的核心定义、架构特征、关键技术、设计要求与产业实践展开系统论述,力求厘清超节点“是什么、为什么需要、如何设计、如何应用”,并通过智算、通算及通智融合等场景的实践,呈现其技术价值与演进方向。白皮书的发布,有助于统一产业认知、降低应用与开发复杂度、沉淀可复制的工程经验,促进芯片、系统、软件、网络、存储及基础设施等产业环节协同创新。 期待本白皮书成为产业交流与技术协作的新起点,推动超节点走向开放化、标准化和生态化,加快形成可扩展、可演进、可持续的先进计算体系,为大模型技术持续突破和人工智能产业高质量发展奠定坚实基础。 美团谢语宸二〇二六年七月 目录 引言:问题与挑战.............................................................................................................1第一章超节点发展趋势和影响..............................................................................21.1超节点的发展阶段.............................................................................................21.2产业影响..............................................................................................................31.3总结......................................................................................................................4第二章超节点的核心定义与特征..........................................................................52.1“Scale-Up”计算系统架构..............................................................................62.2“内存语义”跨节点内存访问.........................................................................72.3超低时延..............................................................................................................82.4超大带宽..............................................................................................................82.5多算力协同..........................................................................................................82.6超节点规模..........................................................................................................92.7软硬件协同..........................................................................................................9第三章超节点架构.................................................................................................103.1总线与协议概述.....................................