云栖大会发布了新一代训推一体AI芯片真武V900,其性能是真武M890的3倍,搭载216GB显存,片间互联带宽达1200GB/s,原生支持FP8、FP4低精度计算。同时,阿里云发布了超节点服务器,内置真武V900、ICN Switch、磐脉智能网卡及镇岳SSD主控芯片,实现算、存、网全栈系统级协同,单一AI集群可扩展至50万卡。此外,阿里云还推出了AgentCore与Agent Sandbox等企业级智能体构建治理平台,以及新一代高性能存储CPFS与KVCache加速引擎,旨在降低AI存储成本并加速百万卡训练。
AI算力赛道正朝着更高性能、更大规模和更智能化方向发展。真武V900等新一代AI芯片通过提升单芯片性能、扩大显存容量和优化互联带宽,推动单集群可扩展至50万卡。同时,超节点服务器的全栈系统级协同能力,以及智算中心网络架构的升级,进一步提升了AI集群的扩展性和效率。企业级智能体的构建、治理与运行底座(AgentCore与Agent Sandbox)的推出,标志着AI从算力驱动向算力与智能协同演进,未来AI算力将更加注重自主运行、可信协作和动态推理等能力。
本报告重点分析了AI算力、智能体和AI存储三大方向。在算力方面,聚焦真武V900等新一代AI芯片的性能提升和超节点服务器的全栈协同能力;在智能体方面,深入探讨了AgentCore与Agent Sandbox等企业级智能体构建治理平台的特性与应用场景;在AI存储方面,分析了新一代CPFS和KVCacheStore如何通过提升吞吐、降低成本和优化缓存命中率,加速AI训练和推理。报告还结合阿里云的技术布局,展示了其在AI基础设施领域的综合实力。
当前AI算力市场正处于快速发展阶段,国产AI芯片厂商如寒武纪、海光信息、摩尔线程等正通过技术创新提升产品性能,推动国产算力替代进程。超大规模AI集群的建设成为热点,如阿里云的50万卡集群,展示了AI算力向更高规模、更高效率发展的趋势。企业级智能体市场也逐渐兴起,AgentCore与Agent Sandbox等产品的推出,为企业构建智能化应用提供了基础支撑。AI存储技术也在不断突破,CPFS和KVCacheStore等新一代存储方案有效解决了AI训练和推理中的存储瓶颈问题。
本报告提示了国产算力芯片性能、生态与供应链的不确定性风险。虽然国产AI芯片在性能上取得显著进步,但仍需关注其与国外先进水平的差距,以及产业链上下游的协同和供应链稳定性问题。此外,50万卡集群的落地和量产商用进度可能存在不确定性,其能效数据是否达到预期也需持续关注。AI算力市场竞争激烈,技术迭代迅速,投资者需关注技术路线选择和商业化落地能力,谨慎评估相关投资风险。