大模型引发全球算力需求的指数级增长,推动AI产业进入新拐点,从“感知”走向“生成”,从专用走向通用。大模型创新需要澎湃算力支撑,未来10年AI算力将再增长500倍,数据集规模和Token长度也将大幅提升。
聚焦业务创新,企业需要全栈算力服务。大模型是人类迄今为止最复杂的软件、硬件系统,云化的全栈算力服务可避免重复解决问题,让企业聚焦创新。昇腾AI云服务提供触手可及的澎湃AI算力服务,独有的多级恢复机制和完备的工具链可实现千卡训练连续30天不中断,任务恢复时长小于30分钟。
昇腾AI云服务满足多样化算力使用模式、管理方式和部署模式。AI开发生产线ModelArts提供Standard和Lite两种模式,支持端到端AI开发、全周期AI工作流管理。昇腾AI云服务通过云网边端芯算力协同,为端侧提供更充沛算力,让终端应用更智能。
昇腾AI云服务打造6A算力沃土,构建百模千态首选云底座。云上可获得更快速的运维保障,集群故障可做到1分钟发现,5分钟诊断,10分钟恢复。模型训练可一键接入多个AI算力中心,支持业界各类框架、加速库及三方社区生态,快速、无损实现模型和应用的迁移适配。
云上推理投资更优,资源按需付费,避免业务波谷时资源闲置。云上推理服务可就近接入,实现超低时延优质服务体验。云上通过持续的算子优化、显存优化、通讯优化可以显著提升集群性能,线性度>90%。
昇腾云服务开放兼容支持百模千态,AI Gallery构建一站式AI社区服务平台,D-Plan推出生态伙伴计划。华为小艺、科大讯飞、华为云数字人、网易伏羲、美图、HKGAI、合合科技等客户案例表明,昇腾AI云服务助力企业快速创建模型应用,加速AI应用落地。