华为于2025年11月21日发布并开源了AI容器技术Flex:ai,旨在解决算力资源利用效率低下的问题。当前行业内算力资源平均利用率仅为30%至40%,而Flex:ai通过将单张GPU/NPU算力卡切分为多份虚拟算力单元(粒度精准至10%),实现单卡承载多个AI工作负载,平均利用率可提升30%。
Flex:ai对标英伟达Run:ai,在虚拟化和智能调度方面具备独特优势。Flex:ai支持本地虚拟化技术,可将单个物理GPU/NPU算力卡切割为数个虚拟算力单元,并通过弹性资源隔离技术实现按需切分;在智能调度方面,Flex:ai可自动感知集群负载与资源状态,结合AI工作负载的优先级、算力需求等多维参数,对本地及远端的虚拟化GPU、NPU资源进行全局最优调度。
Flex:ai秉承开源与兼容异构算力的理念,进一步强化国产算力实力。该技术将在发布后开源在魔擎社区中,与华为此前开源的Nexent智能体框架、AppEngine应用编排、DataMate数据工程、UCM推理记忆数据管理器等AI工具共同组成完整的ModelEngine开源生态。此外,Flex:ai可通过软件创新实现对英伟达、昇腾及其他第三方算力资源的统一管理和高效利用,有效屏蔽不同算力硬件之间的差异。
核心观点:Flex:ai围绕“XPU池化+算力细粒度切分+全局智能调度”三大支柱,通过对GPU/NPU等异构智算资源的容器化管控、跨节点聚合与弹性分配,致力于大幅提升AI集群的算力利用效率、降低生态迁移门槛、加速模型训练与推理的落地进程。其秉持“开源兼容+跨生态适配”的核心定位,进一步强化了国产算力软件层的统一调度能力,构成了“以软件能力补齐硬件短板”的确定性突破。
研究结论:建议关注AI容器和国产算力相关公司,包括博睿数据、浩瀚深度、普元信息、青云科技、寒武纪、云天励飞、浪潮信息等。
风险提示:技术发展不及预期、政策落地不及预期、行业竞争加剧等。