本周观点
“自如式”算力服务有望解决AI应用落地的“最后一公里”难题
当前从算力平台建设到模型应用部署面临诸多挑战,包括:大规模集群、软硬一体强耦合的复杂交付、模型训练底层机制、新兴技术领域的软硬件适配调优及专业人才获取等。“自如式”算力服务能够高效整合算力资源并灵活满足客户在不同层次的需求,解决AI应用落地的“最后一公里”难题。其核心是专注赚装修和增值服务的钱,采取统一装修的标准化运营,并提供各类增值服务。
英伟达AI Foundry引领“自如式”算力服务发展
英伟达AI Foundry是一项使企业能够使用数据、加速计算和软件工具创建并部署自定义模型的服务,用于使用企业数据和特定领域的知识构建自定义生成式AI模型。其输出形式是一个NVIDIA NIM™推理微服务,包括自定义模型、经过优化的引擎和标准API——可随时随地部署。NVIDIA NIM具有可随时随地部署、可使用行业标准API进行开发、满足特定领域的模型需求、优化推理引擎、支持企业级AI、支持多领域AI模型等核心优势,能够显著降低千行百业AI应用落地的门槛。
“自如式”算力服务有望进入快速渗透期
目前,我国正在大力推进智算中心和智算网络的建设,以进一步完善算力产业链上的基础设施。头部大模型厂商已经开始逐渐落地软硬协同优化提升实践,AI算力资源的模型调优与算力调优协同解决方案或进入快速渗透的拐点。例如,阿里云的HPN通过创新的非堆叠双ToR设计和双平面架构,有效提升了大型语言模型训练的吞吐量和可靠性;字节跳动的MegaScale系统采用全栈方法,显著提升了模型训练的效率和稳定性;月之暗面的Mooncake平台通过KVCache中心化的调度策略,优化了大型语言模型服务的吞吐量和响应速度;深度求索的DeepSeek-V2模型通过MLA和DeepSeekMoE架构,显著减少了键值缓存需求,提高了生成吞吐量。
国内AI模型与算力协同优化标杆项目持续落地
- 慧辰股份:联合中科信控、棱镜数聚发布算力服务管理平台赋能AI+HCR,通过全新的服务平台解决智算运营精细化的需求。
- 恒为科技:智算可视化解决方案已经落地恒为智云•前海智算中心,为智算中心提供资源调度、运维管理、数字孪生、训推可视化、集群测试工具等一体化服务。
- 浪潮信息:以开放创新的全向Scale应对大模型Scaling Law,提出开放算力模组OCM规范,旨在建立基于处理器的标准化算力模组单元,通过统一不同处理器算力单元对外高速互连、管理协议、供电接口等,实现服务器主板平台的深度解耦和模块化设计。
- 中科曙光:上线“模型仓库”打造智算中心,开放百余款模型源码下载,创新“算法分享×算力支持”模式,为千行百业开发者搭建起易用高效的大模型平台。
投资建议
“自如式”算力服务能够有效解决大模型训练、部署、应用环节的痛点,或成为全新范式。建议关注慧辰股份、恒为科技、浪潮信息、中科曙光、星网锐捷、网宿科技等具备AI模型调优与算力调优相结合能力的行业龙头。
风险提示