2025年10月22日00:36 关键词关键词 人工智能算力超节点英伟达GPU大模型数据中心华为阿里AMD英特尔微软开源开放垂直整合协议开放AI算力训练推理供应链G200 全文摘要全文摘要 本周将举行一系列关于计算机板块投资机会的电话会议,重点关注人工智能作为全球科技竞争焦点及资本市场高度关注的领域。会议将从算力、算法模型、应用及测试验四个维度深入探讨,特别强调“超节点”概念的重要性,它在支撑大规模AI处理器高效系统、实现高速数据传输、高密度计算、灵活拓展性及高能效比方面的作用。会议将介绍超节点的发展历程、国内外主要厂商的进展、技术优势以及潜在投资机会。 算力服务器和超节点算力服务器和超节点20251020_导读导读 2025年10月22日00:36 关键词关键词 人工智能算力超节点英伟达GPU大模型数据中心华为阿里AMD英特尔微软开源开放垂直整合协议开放AI算力训练推理供应链G200 全文摘要全文摘要 本周将举行一系列关于计算机板块投资机会的电话会议,重点关注人工智能作为全球科技竞争焦点及资本市场高度关注的领域。会议将从算力、算法模型、应用及测试验四个维度深入探讨,特别强调“超节点”概念的重要性,它在支撑大规模AI处理器高效系统、实现高速数据传输、高密度计算、灵活拓展性及高能效比方面的作用。会议将介绍超节点的发展历程、国内外主要厂商的进展、技术优势以及潜在投资机会。此外,后续会议将更多地探讨人工智能的其他方面,鼓励与会者积极参与讨论。 章节速览章节速览 ● 00:00超节点算力新机遇:人工智能领域的投资视角超节点算力新机遇:人工智能领域的投资视角本次电话会议聚焦于人工智能算力方向,特别是超节点概念在算力领域的应用和发展。从概念背景、发展历程、 发展路径、国内外主流超节点情况及发展优势与投资机会五个方面进行了深入分析,旨在探讨算力服务器在人工智能快速发展的背景下,如何抓住新的产业和资本市场的投资机会。 ● 02:18大模型算力需求与超级点架构的兴起大模型算力需求与超级点架构的兴起讨论了自2022年起,大模型训练和推理对算力需求的爆发性增长,特别是参数量突破万亿级别后,对显存容量、 带宽及通信需求的提升。指出传统横向扩展架构已成AI算力发展的瓶颈,强调了超级点架构作为解决方案的兴起,以应对大规模分布式训练的挑战。 ● 04:39超节点技术发展历程与产业界布局超节点技术发展历程与产业界布局超节点技术通过高密度集成计算单元和专用高速互联技术,实现近似单机性能的超大规模运算系统,突破传统服 务器内部及服务器间的通信瓶颈。自2014年英伟达推出NV link总线协议以来,超节点技术不断发展,2016年首次提出超节点概念,2022年NV switch芯片独立成交换机,2024年英伟达发布集成Grace CPU和black ground CPU的超节点产品。2025年,国内厂商如华为、阿里等纷纷布局超节点产品,产业界和资本市场高度关注超节点技术。 ● 07:16超级节点技术路径与发展方向探讨超级节点技术路径与发展方向探讨 对话深入探讨了超级节点的发展路径,分为两类技术路径:一是以NVLink为代表的垂直整合路径,通过软硬件一体化将整机柜GPU视为巨型单机;二是以华为为代表的互联协议创新路径,实现跨主机内存直接访问。两种路径分别体现了强大的生态构建能力和通信领域优势。 ● 08:36算力生态构建的三种模式分析算力生态构建的三种模式分析对话探讨了算力生态构建的三种模式:英伟达的垂直整合模式,其追求效率但存在供应链风险;由AMD 、微软等组成的协议开放模式,旨在构建基于开放标准的多元化生态系统,但面临性能优 化难题;以及以华为为代表的开源开放模式,通过开源技术体系加速生态共建,有望孕育更高效的算力生态。 ● 13:22国内外主流超节点技术与市场分析国内外主流超节点技术与市场分析对话深入探讨了国内外主流超节点技术,重点介绍了英伟达 G200NA72撤离点、华为SM4与M384超节点、阿里盘9128超级检验服务器等产品,分析了它们在算力密度、通信带宽、冷却技术及AI框架兼容性方面的优势。此外, 还提到了字节、浪潮、中兴和联想等厂商的创新方案,指出超节点技术在高性能计算、低成本高能效方面的潜力,以及其对AI算力市场的深远影响。 ● 16:27超级点技术:超大带宽、高效密度与灵活拓展性的优势超级点技术:超大带宽、高效密度与灵活拓展性的优势超级点技术通过超大带宽和超低时延互联,实现系统性能突破,通信带宽提升15 倍,时延降低十倍。其高效率密度设计,如英伟达G200集成72个GPU,提供强大算力支持单元模型训练。灵活拓展性源于内存统一编制,实现全局管理和任意设备间联合访问,简化大模型训练参数同步流程。 ● 18:21超级点技术:资源池化、灵活配比与高能效比超级点技术:资源池化、灵活配比与高能效比 超级点技术通过资源池化将分散资源抽象为统一云资源池,实现动态弹性调度,消除资源孤岛。其灵活资源配比能力根据业务特征自动调整CPU、NPU、内存等资源比例,支持高效扩展。此外,该技术在提升效率的同时保持高能效比,通过优化硬件与软件技术降低能耗,展现出未来发展的挑战与机遇。 ● 19:49算力板块与超级点软件栈的投资机会算力板块与超级点软件栈的投资机会 对话聚焦于算力板块中超级点软件栈、散热挑战及电能储备等领域的投资机会,强调了软件栈作为硬件性能放大器的重要性,以及芯片集成密度增加带来的散热和电能供应挑战,指出未来这些领域蕴含的投资潜力,并预告了后续人工智能系列汇报的内容。 问答回顾问答回顾 发言人发言人问:在计算机板块投资机会的系列电话会议中,本周的主题是什么?问:在计算机板块投资机会的系列电话会议中,本周的主题是什么? 发言人答:本周的主题是人工智能系列,我们认为它代表了当前全球特别是中美科技竞争的重要方向,并且是目前资本市场关注度最高的领域。 发言人发言人问:为什么说算力在人工智能领域中具有重要意义?问:为什么说算力在人工智能领域中具有重要意义? 发言人答:随着人工智能技术的快速发展,对算力的需求呈现出爆发式的增长。大模型训练和推理过程中对显存容量、带宽以及并行计算方式的需求都对传统服务器架构提出了挑战,而超级点概念的出现正是为了解决这些问题,以满足大模型分布式训练和AI应用对算力的需求。 发言人发言人问:超级点是什么,它的作用是什么?问:超级点是什么,它的作用是什么? 发言人答:超级点是一个物理机柜或一组紧密耦合计算单元,通过高密度集成计算单元和专用高速互联技术,实现近似单机性能的超大规模运算系统。其旨在突破传统服务器间的通信瓶颈,支持新的计算需求,特别是针对高并行计算任务,能够提供更高带宽和更低延迟的内部通信环境。 发言人发言人问:超级点技术的发展历程是怎样的?问:超级点技术的发展历程是怎样的? 发言人答:超级点技术最早可追溯到2014年英伟达推出的NV link总线协议,该协议使得GPU之间能够实现高速点对点通信。2016年,英伟达首次提出了超节点概念,并通过不断迭代升级NV link技术和独立 出NV link交换机,逐步实现了由多台服务器和网络设备共同组成超带宽、超节点的计算机群,从而承载起超级点的概念。 发言人发言人问:国内外有哪些厂商在超级点方向上进行了布局?问:国内外有哪些厂商在超级点方向上进行了布局? 发言人答:英伟达是引领超级点发展的公司,而国内如华为、阿里等AI巨头也开始推出自己的超级点产品,表明超级点这一概念已得到产业界和资本市场的高度关注,并正被国内外众多厂商纷纷布局和发力。 发言人发言人问:超级点的发展历程中,技术路径上可以分为哪两类?问:超级点的发展历程中,技术路径上可以分为哪两类? 发言人答:超级点的技术路径主要分为两类:第一类是以NV link为代表的垂直整合发展路径,通过极致的硬件垂直整合,将整机柜GPU打造成一台逻辑上的巨型单机;第二类是以华为等企业为代表,通过创新面向超节点的互联协议,实现跨主机的内存直接访问和大带宽低时延的集群互联。 发言人发言人问:英伟达和华为在构建超级点生态布局上采取了什么不同的策略?问:英伟达和华为在构建超级点生态布局上采取了什么不同的策略? 发言人答:英伟达采取的是垂直整合模式,通过控制从底层AI处理器芯片到上层编程模型和软件库的端到端技术,以实现最优系统效率,但这种模式可能导致客户过度依赖并面临供应链风险。而华为则采取了从通信协议创新出发,构建开放生态,与其他科技公司共同对抗英伟达的垂直整合模式,意图构建一个基于开放标准的多元化生态系统。 发言人发言人问:英伟达垂直整合模式的主要优缺点是什么?问:英伟达垂直整合模式的主要优缺点是什么? 发言人答:英伟达的垂直整合模式优点在于能够实现高效的系统性能和对整个生态系统的控制,但缺点是如果英伟达在软硬件供应方面出现问题,将可能导致客户被迫接受高昂的成本并承受供应链安全隐患。 发言人发言人问:协议开放模式是如何对抗英伟达的垂直整合模式的?问:协议开放模式是如何对抗英伟达的垂直整合模式的? 发言人答:协议开放模式由AMD、微软等科技公司组成联盟,通过兼容性和选择权来对抗英伟达的封闭性,目标是构建一个基于开放标准的多元化生态系统,以弥合性能差距并提高竞争力,但此模式面临标准化和技术整合难度大、性能优化困难以及生态系统碎片化的挑战。 发言人发言人问:国内华为所代表的开源开放模式有何特点及优势?问:国内华为所代表的开源开放模式有何特点及优势? 发言人答:华为引领的开源开放模式是在协议开放模式基础上进一步构建开源技术体系,通过一套软件架构满足不同场景的产品需求,并将核心计算架构全面开放,降低配套软件开发门槛,加速开源社区共创共建,旨在打造出效率更高的超级点算力生态。 发言人发言人问:目前海外典型主流超级点产品有哪些?问:目前海外典型主流超级点产品有哪些? 发言人答:海外典型主流超级点产品是英伟达的G200 NA72超级点,它通过将72个GPU连接至18个专用交换机,实现高达1800GB每秒的通信带宽,大幅提升单季度的算力密度,适应大模型训练的数据交互需求,并具备高性能、低成本和高能效的优势,在全球AI算力市场占据主导地位。 发言人发言人问:华为在超级计算领域发布了什么样的新产品?问:华为在超级计算领域发布了什么样的新产品? 发言人答:华为在2025年全球大会上发布了其SM4超级点产品,并在今年进一步更新了metric 3超级点,该产品面向政企客户,通过集成384GPU实现了极高算力。华为M384超级点采用液冷技术和优化的互联架构,确保高效率,并支持多种AI框架应用,具有良好的兼容性和扩展性。 发言人发言人问:阿里云推出的超级计算服务器有何特点?问:阿里云推出的超级计算服务器有何特点? 发言人答:阿里云在今年的2025年七大会上发布了盘9128超级计算服务器,该产品通过集成128个GPU实现了强大的算力能力。同样采用了先进的冷却技术和优化的互联架构以保证性能效率,同时最大限度地支持多种AI框架和应用,以实现高兼容性和扩展性。 发言人发言人问:国内还有哪些厂商发布了相关的超级计算方案?超节点产品或生态技术具备哪些主要优问:国内还有哪些厂商发布了相关的超级计算方案?超节点产品或生态技术具备哪些主要优势?势? 发言人答:国内的浪潮、经销商、中兴和联想等传统服务厂商及芯片厂商都推出了各自的联合方案。这些方案可能具体实现方式各异,但整体解决方案思路相似,旨在提供高效、高密度、灵活扩展及高能效比的超级计算能力。超节点产品主要优势包括:1)超大带宽与超低时延互联,通过高效互联协议支持大规模AI处理器系统,实现更高数据传输速率和系统性能突破;2)高效密度,通过集成紧凑空间内大量GPU实现高算力密度设计,适合单元模型训练和推理任务;3)灵活拓展性,通过内存统一编制和多级存储资源池化技术,提供全局管理和灵活访问机制,以及资源池化和稳定性架构深度融合,实