CES 2026:英伟达六大芯片协同升级,算力+存力迈入新纪元
Vera Rubin:六大芯片协同升级,推理性能大幅提升
英伟达在CES 2026上发布Rubin平台,由六款全新芯片协同设计,大幅提升AI超级计算机的推理性能和降低成本。平台包括Vera CPU、Rubin GPU、NVLink 6交换机、ConnectX-9 SuperNIC、BlueField-4 DPU和NVIDIA Spectrum-6以太网交换机。
算力:NVFP4推理性能提升5倍,推理成本显著下降
- Vera CPU:拥有88个英伟达定制Olympus核心,支持CPU:GPU统一内存,系统内存达1.5TB,数据处理性能翻倍提升。
- Rubin GPU:引入Transformer引擎,NVFP4推理性能高达50PFLOPS(是Blackwell GPU的5倍),NVFP4训练性能达到35PFLOPS(是Blackwell的3.5倍)。
存储:针对大量KV Cache问题,推出推理上下文内存存储平台
- HBM:每个GPU最高配备288GB HBM4,总内存带宽提升至22TB/s(是Blackwell的2.8倍)。
- DRAM:每个Vera CPU搭载最高1.5TB的LPDDR5X内存子系统,带宽达1.2TB/s。
- NAND:引入由BlueField-4驱动的NVIDIA推理上下文内存存储,支持跨节点高速共享,将每秒tokens数提升高达5倍,能效提升5倍。
PCB:从 Cable Tray 到 Cableless 互联,PCB价值量显著提升
Rubin NVL72采用cableless无缆互联架构,组装速度比上一代托盘架构快18倍,降低部署时间和运营成本。
Rack:系统协同设计显著提升,ODM环节核心受益
NVIDIA DGX SuperPOD采用8套DGX Vera Rubin NVL72系统,训练相同规模的MoE模型仅需1/4的GPU数量,大型MoE模型的token成本降低至1/10。
开源模型:从数据到代码全覆盖,Nemotron 3重构Agentic AI范式
英伟达扩展其开源模型生态(Open Model Universe),新增和更新了一系列模型、数据集、代码库和工具,覆盖六大领域:生物医学AI(Clara)、AI物理模拟(Earth-2)、Agentic AI(Nemotron)、物理AI(Cosmos)、机器人(GR00T)和自动驾驶(Alpamayo)。
Nemotron 3
覆盖推理、RAG、安全和语音四个应用方向,包括Nemotron 3 Nano、Nemotron 2 Nano VL等小型化推理模型,以及NeMo RL、NeMo Gym等强化学习训练工具。
物理AI:从 Cosmos到 Alpamayo,走向商业化落地
- Cosmos:开源的物理AI世界基础模型,用海量视频、真实驾驶与机器人数据,以及3D模拟做过预训练,能理解世界是怎么运行的,可以把语言、图像、3D和动作联系起来。
- Alpamayo:面向自动驾驶领域的开源工具链,也是首个开源的视觉-语言-行动(VLA)推理模型,能理解复杂场景中的因果关系,预测其他车辆和行人的意图。
投资建议
英伟达Rubin平台正式发布开启AI算力新纪元,全球算力设施向“AI工厂”范式全面转型。建议关注:
- 海外AI:工业富联/沪电股份/鹏鼎控股/胜宏科技/生益科技/生益电子等
- 国产AI:寒武纪/芯原股份/海光信息/中芯国际/深南电路等
- 存储:德明利/江波龙/兆易创新/聚辰股份/普冉股份等
- SoC:瑞芯微/乐鑫科技/恒玄科技/晶晨股份/中科蓝讯等
风险提示