算力层——算力精分调度平台
ZStack AIOS平台“智塔”具备裸金属、虚机与容器多引擎能力,通过GPU切割精分量化,对异构AI算力实现可达1%的量化管理,大幅降低算力成本。算力层的另一大核心在于,在AI算力精分量化基础之上,通过分布式协同调度能力,实现异构算力的统一管理和动态调度,达到算力的精细化资源复用,进一步降低算力成本。
企业痛点

多架构多品牌GPU需要管理,AI算力分配情况不透明、利用率低,维护成本高

AI 算力稀缺,价格昂贵

异构AI算力无法互通形成算力竖井,资源利用率低
方案亮点

支持裸金属、虚机和容器多引擎部署AI 模型,降低AI应用门槛

异构AI算力统一管理和动态调度,实现精细化资源复用

对AI算力实现可达1%的量化管理,降低AI算力成本

GPU透传可达95%物理性能,vGPU切割无需GPU厂商授权,提升AI 算力利用率

异构算力协同,广泛兼容主流AI芯片

实时监控资源利用率,服务故障自愈,降低运维成本
模型层——AI MaaS平台一站式AI训推
ZStack AIOS平台“智塔”一方面通过动态模型自适应平台,提供从模型训练、评估、推理到更新的全生命周期管理,高效实现模型服务优化;另一方面通过将AI任务智能解构,动态优化路由、分布式并行训推,自适应负载均衡等能力,结合算力层的算力精分协同调度平台,显著提升模型训推性能和模型服务体验。
企业痛点

模型训推难以快速部署

多个模型易形成烟囱式架构,运维管理复杂

多个模型不能高效协同工作,资源利用率低
方案亮点

一体化 AI 训推、应用开发和运维运营体验

实现模型压缩与性能优化,训推高效部署与自适应调度

支持生成式AI、自然语言处理 、计算机视觉、机器学习、深度学习以及多模态AI,并支持数百种大模型。
运营层——全域感知自服务平台
ZStack AIOS平台“智塔”以AI为核心提供更全面更直观的可视化统一视图,实现精细化管理;在动态调度资源方面,跨多智算中心、多集群全域调度自适应模块,可以根据需要实现跨平台的自动扩缩和调度功能;在训推服务高可用方面,弹性容错自愈模块具备快速故障定位与故障自愈能力,可以实现跨平台的容错与灾备;在安全与隐私方面,融合敏感数据检测能力,实现端到端的数据安全保障作为运营基础;在系统运营方面,可实现多租户隔离和资源配额管理,训推计量计费服务。
企业痛点

缺乏跨平台的计量计费,企业AI普及率低。

发生故障灾难需要较长时间来恢复,导致业务停滞

企业集私有部署需要高等级数据安全
方案亮点

提供多智算中心、多集群、多租户的按量计费运营,实现AI自服务化。

具备可视化统一门户,弹性跨域容错,实现精细化的自服务运营体系。

融合敏感数据检测能力,实现端到端的数据安全保障作为运营基础