GTC大会要点总结
1. AI服务器架构迭代变化
- 发布Vera Rubin全新AI平台,重构AI服务器整机架构。
- 核心机型NVL72搭载第六代NVLink高速互联技术,算力与互联效率大幅跃升。
- 大模型单Token推理成本降至原先1/10,能效比、算力密度实现代际突破。
- 适配万卡级AI工厂规模化部署。
2. 液冷散热技术升级
- 明确风冷散热瓶颈,Vera Rubin平台、NVL72机架全液冷标配。
- 创新采用45℃温水冷却技术,舍弃高能耗制冷压缩机。
- 兼顾散热效率与数据中心能耗优化,破解高功耗芯片散热难题。
3. AI服务器电源、超容与HVDC高压直流
- Vera Rubin平台要求对AI供电方式重新思考。
- NV将800V高压直流(HVDC)作为所有AI工厂的标准。
- 相比传统54V系统,以45%更少的铜材和40%更低的电力损耗提供单机柜250kW功率。
- 结合全液冷技术,800V HVDC是将AI计算扩展到兆瓦级水平的唯一途径。
- NVL72系统采用四个110kW电源架,配置为N+1冗余。
- 引入智能功率平滑技术,机架级储能增加6倍,使GPU持续监控电容充电状态。
- 平滑功率曲线,将峰值电流需求降低高达25%。
4. 太空算力
- 推出NVIDIA太空计算平台,包含Space-1 Vera Rubin模块、IGX Thor和Jetson Orin。
- Space-1太空AI推理性能比当前基于H100的系统高出25倍。
- 支持实时地理空间智能和自主太空操作。
- 太空无对流、无传导,设计使数据中心级AI计算可在轨道部署。
- 连接到NVIDIA Earth-3D云平台,创建从轨道边缘→地面AI工厂→云端分析的无缝计算连续体。
- 通过在轨AI推理将数据下行链路需求减少90%。