全域纳管
支持超过5000台设备的统一观测,同时纳管OpenStack、Kubernetes等异构资源池
全栈资源统一纳管
统一纳管主机、GPU、容器、作业、网络、存储与控制器指标
全域数据融合治理
支持全域数据采集、对齐、清洗与转换,形成算网一张图
业务健康统一度量
用统一度量口径把"业务健康"映射到基础设施状态
多视角全景观测
提供算力资源、作业、网络、业务四大视角的全方位观测
支持超过5000台设备的统一观测,同时纳管OpenStack、Kubernetes等异构资源池
不仅监控基础设施,更深入AI作业内部,提供算子级、数据流级的剖析能力
支持x86/ARM服务器,兼容NVIDIA、华为昇腾、天数智芯、海光DCU等主流算力芯片,支持华为、H3C等主流网络设备
智能体操作具备完整的安全围栏与审计日志,支持人工审查介入,确保运维操作安全可靠