NVIDIA 发布了 Rubing 平台,包含六款全新芯片,旨在打造卓越的 AI 超级计算机,并设定构建、部署和保护全球最大、最先进 AI 系统的新标准,以最低的成本加速主流 AI 的普及。
Rubin 平台通过对 NVIDIA Vera CPU、NVIDIA Rubin GPU、NVIDIA NVLink™ 6 Switch、NVIDIA ConnectX®-9 SuperNIC、NVIDIA BlueField®-4 DPU 以及 NVIDIA Spectrum™-6 Ethernet Switch 进行极致协同设计,大幅缩短训练时间并降低推理 Token 成本。与 NVIDIA Blackwell 平台相比,Rubin 平台可将推理 Token 成本降低高达 10 倍,并将训练 MoE(混合专家)模型所需的 GPU 数量减少 4 倍。
Rubin 平台引入了五项创新技术:
- 第六代 NVIDIA NVLink:提供快速、无缝的 GPU 间通信,支持海量 MoE 模型。
- NVIDIA Vera CPU:专为代理式推理设计,具有高能效和强大的性能。
- NVIDIA Rubin GPU:搭载第三代 Transformer 引擎,为 AI 推理提供强大的算力。
- 第三代 NVIDIA 机密计算:在 CPU、GPU 和 NVLink 域之间维护数据安全,保护专有模型和训练/推理工作负载。
- 第二代 RAS 引擎:具备实时健康检查、容错和主动维护功能,最大限度提高系统生产力。
NVIDIA Rubin 平台还推出了 NVIDIA Inference Context Memory Storage Platform,这是一种新型的 AI 原生存储基础设施,旨在实现千兆级规模的推理上下文扩展。该平台由 NVIDIA BlueField-4 驱动,能够高效共享和重用键值(KV)缓存数据,提高响应速度和吞吐量,并实现代理式 AI 的可预测且高效节能的扩展。
Rubin 平台提供了多种形态,包括:
- NVIDIA Vera Rubin NVL72:集成了 72 个 NVIDIA Rubin GPU、36 个 NVIDIA Vera CPU、NVIDIA NVLink 6、NVIDIA ConnectX-9 SuperNIC 以及 NVIDIA BlueField-4 DPU。
- NVIDIA HGX Rubin NVL8:通过 NVLink 连接 8 个 Rubin GPU,支持基于 x86 的生成式 AI 平台。
NVIDIA DGX SuperPOD™ 为大规模部署基于 Rubin 的系统提供了参考,集成了 NVIDIA DGX Vera Rubin NVL72 或 DGX Rubin NVL8 系统,并配备了 NVIDIA BlueField-4 DPU、NVIDIA ConnectX-9 SuperNIC、NVIDIA InfiniBand 网络以及 NVIDIA Mission Control™ 软件。
NVIDIA Spectrum-6 Ethernet 是专为 AI 网络打造的下⼀代以太⽹,旨在通过 200G SerDes 通信电路、共封装光学器件(CPO)和 AI 优化⽹络结构,以更⾼的效率和更强的韧性扩展基于 Rubin 架构的 AI 工⼚。Spectrum-X Ethernet Photonics 共封装光学交换机系统,可为 AI 应⽤提供 10 倍的可靠性和 5 倍的运⾏时间,同时实现 5 倍的能效提升。
NVIDIA Rubin 已进入全面生产阶段,基于 Rubin 的产品将于 2026 年下半年由合作伙伴推出。首批部署基于 Vera Rubin 实例的云服务提供商将包括 AWS、Google Cloud、Microsoft 和 OCI,以及 NVIDIA 云合作伙伴 CoreWeave、Lambda、Nebius 和 Nscale。微软将部署 NVIDIA Vera Rubin NVL72 机架级系统,作为其下一代 AI 数据中心的⼀部分,其中包括未来的 Fairwater AI 超级⼯⼚站点。CoreWeave 将从 2026 年下半年开始,将其 AI 云平台与基于 NVIDIA Rubin 的系统进⾏整合。
NVIDIA 与红帽(Red Hat)扩大合作,通过 Red Hat Enterprise Linux、Red Hat OpenShift 和 Red Hat AI,为 Rubin 平台提供优化的完整 AI 堆栈。