产品功能

ZStack Zaku提供容器编排、制品仓库、容器运维、集群管理和设置多个功能模块 ,本节主要针对ZStack Zaku提供的完整功能范围进行介绍。

类别 特性 描述
首页 资源概况 实时监控并展示集群、节点、应用、工作负载、任务、容器组的允许概况
实时统计多租户、本地仓库的信息情况
近七日未读报警统计 展示近7日未读报警消息情况
集群资源使用率统计 实时监控并展示总集群CPU、内存资源使用情况
展示CPU、内存使用率Top3的集群排行
实时监控并展示集群近24小时的CPU、内存资源使用情况
集群内资源使用率统计 展示GPU和GPU显存申请及使用情况
展示容器组CPU、内存和数据卷的使用率Top10排行
容器编排 应用 支持应用的发布、删除等基本生命周期管理
支持通过当前部署包/新部署包更新应用 ,并查看版本对比
支持管理应用历史版本 ,包括查看、回滚、删除
支持集中管理应用的关联资源 ,包括 :容器组、数据卷、服务、 路由等
工作负载 支持Deployment、StatefulSet、DaemonSet三种工作负载类型
支持为工作负载可视化配置健康检查、环境变量、生命周期回调
支持为工作负载挂载数据卷模板 (仅StatefulSet类型)、数据卷、 主机路径、配置集和保密字典
支持为工作负载容器组设置GPU配置,包括使用的GPU卡数量、每GPU显存、每GPU算力百分比
支持按GPU规格选择要使用的GPU卡,或直接指定GPU卡
支持多个容器共享一张GPU卡且显存隔离,支持单个容器使用多张GPU卡
支持为工作负载容器组设置节点调度策略、亲和性、反亲和性、容忍
支持为工作负载设置更新策略
支持为工作负载设置网络配置,配置使用容器组网络或容器组外部网络
支持工作负载的创建、更新、重启、删除等基本生命周期管理
支持管理工作负载历史版本 ,包括查看Yaml、回滚
支持通过Yaml和表单两种方式修改工作负载配置
支持修改工作负载容器镜像
支持工作负载弹性伸缩 ,包括手动伸缩和自动伸缩两种伸缩方式
支持集中管理工作负载关联资源,包括 :容器组、关联服务等
支持集中查看工作负载事件
支持工作负载列表导出为CSV文件,方便统计分析
任务 支持两种任务类型 :Job、CronJob
支持通过表单或模板创建任务
支持为任务可视化配置健康检查、环境变量
支持为任务挂载数据卷、配置集、保密字典
支持为任务设置GPU配置,包括使用的GPU卡数量、每GPU显存、每GPU算力百分比
支持按GPU规格选择要使用的GPU卡,或直接指定GPU卡
支持多个容器共享一张GPU卡且显存隔离,支持单个容器使用多张GPU卡
支持任务的创建、更新、删除、启用、停用等基本生命周期管理
支持集中管理任务关联资源 ,包括 :容器组、数据卷
容器组 支持容器组的查看和删除
支持集中管理容器组中的容器 ,包括查看监控数据、容器信息、容器日志、将容器保存为镜像等
支持访问容器组终端
支持集中查看容器组事件
支持容器组列表导出为CSV文件,方便统计分析
服务 支持ClusterIP、NodePort、Load Balance、Headless四种服务类型
支持为LoadBalancer服务自定义指定外部网络IP地址
支持服务的创建、更新、删除等基本生命周期管理
支持通过Yaml和表单两种方式修改服务配置
支持集中查看服务事件
路由 支持路由的创建、更新、删除等基本生命周期管理
支持集中管理路由规则 ,包括添加、修改、删除规则
支持查看路由网关地址和转发策略访问地址
支持集中查看路由事件
网络策略 支持为工作负载创建网络策略 ,控制工作负载的通信行为 ,保护 应用程序免受网络攻击
支持网络策略的创建、删除等基本生命周期管理
支持通过Yaml和表单两种方式修改网络策略配置
数据卷 支持基于分布式存储 ,提供数据卷以持久化存储工作负载数据
支持数据卷的创建、扩容、删除等基本生命周期管理
支持集中查看数据卷事件
配置集 支持配置集的创建、更新、删除等基本生命周期管理
保密字典 支持Opaque、TLS证书、镜像仓库登录密钥三种保密字典类型
支持保密字典的创建、更新、删除等基本生命周期管理
微服务应用 微服务应用是一组工作负载、服务、服务网格资源等资源对象的集合
支持微服务应用的创建、删除等基本生命周期管理
支持将微服务应用接入平台进行可视化治理
支持多种微服务应用的灰度发布策略,可按照流量比例和请求内容对新老版本进行流量路由,确保应用平滑升级
提供灰度发布过程中新老版本的流量监控
服务拓扑 提供可视化应用拓扑,直观展示微服务应用间的调用、依赖关系和流量监控数据
支持拓扑图的历史和实时查看
支持对微服务应用配置负载均衡、连接池、熔断器等流量治理规则
链路追踪 提供链路追踪功能,支持通过服务名称或TraceID 查询当前命名空间中服务之间的调用链
全方位监控调用链中服务的调用状态、调用耗时等关键指标
制品仓库 本地仓库 支持公开、私有两种仓库类型
支持本地仓库的创建、修改、删除等基本生命周期管理
支持集中管理仓库中的镜像 ,包括上传、导出、下载镜像 ,和删除镜像标签等
支持3种镜像上传方式:在线上传、文件上传、命令上传
支持集中管理仓库中的Chart部署包,包括上传、下载Chart,查 看、删除Chart版本,和基于Chart发布应用等
支持设置本地仓库所属的项目
模板仓库 模板仓库用于管理YAML模板
提供多种资源的示例模板供用户参考,用户可根据示例直接创建 模板
支持模板的创建、修改、删除等基本生命周期管理
应用市场 提供 nfs、nginx、nginx-ingress-controller 等官方Chart部署包
支持将应用市场中的Chart部署包一键发布,部署为应用实例
容器运维 一键巡检 提供基础服务、计算、网络、存储三大巡检类别,涵盖平台管理集群和业务集群关键资源和服务
内置正常、警告、故障三大巡检等级,和巡检资源、巡检项、集群、平台四级健康评分机制,显示集群和平台整体健康得分
支持为警告和故障状态的巡检资源提供巡检建议
提供巡检概述、巡检总结以及巡检结果,并支持查阅异常巡检项详情及相关巡检建议
支持免登录执行一键巡检
支持根据类别自定义选择集群和巡检项进行一键巡检
支持设置自动巡检,定时对平台执行巡检
支持取消一键巡检、重新检测、导出Word巡检报告操作
监控面板 支持一键跳转监控面板,查看集群详细监控数据
支持查看集群整体资源使用情况,包括CPU使用率、内存使用率、网络流量等
支持查看节点上容器组的CPU、内存资源使用情况
支持查看工作负载资源使用情况
支持查看工作负载、容器组的网络资源使用情况
容器日志 提供统一入口供用户集中查看集群内所有容器日志
支持按集群、命名空间、工作负载、容器组、容器、关键词、时间范围 查询日志
支持导出日志
支持查看日志上下文;支持按关键字搜索上下文;支持导出日志 上下文
事件 支持采集和持久化保存 Kubernetes 事件
支持按命名空间、时间、资源名称、事件类型、原因、资源类型查询事件
报警消息 支持集中查看和管理平台所有报警消息
支持按资源名称、时间段筛选报警消息
支持对报警消息标记已确认/未确认状态;支持筛选确认状态
报警器 支持报警器的创建、启用、停用、删除等基本生命周期管理
支持三种报警级别:紧急、严重、提示
支持按需开启重复告警通知
一个报警器支持同时对多个资源进行监控
支持按需开启报警恢复通知,开启后,报警器内的任一资源从报警状态恢复至正常状态,系统将接收到一次恢复通知
通知对象 通知对象是用户接收报警消息的方式 ,支持系统、邮件、企业微 信、钉钉、Webhook五种通知对象类型
支持通知对象的创建、修改、删除等基本生命周期管理
消息模板 报警器向通知对象发送消息时,支持使用文本模板
支持消息模板的创建、修改、删除等基本生命周期管理
支持文本场景类型:报警消息文本、恢复消息文本
支持将模板设置为默认;未设置消息模板的通知对象将使用项目默认模板
当前任务 支持集中查看和管理正在进行中的操作
支持查看当前任务详情
操作历史 支持集中查看历史任务
支持按时间段、任务结果、操作源筛选历史任务
支持查看历史任务详情
集群管理 集群 支持多集群的创建、重试安装、删除等基本生命周期管理
支持创建与管理Kubernetes 1.30、1.35 版本集群
支持 Kubernetes 高可用集群
支持在集群自定义部署功能组件,包括:微服务治理组件、ZStone-RBD-CSI、ZCE-iSCSI-CSI、ZCE-NFS-CSI
支持纳管1.24~1.30版本的Kubernetes集群
支持CPU、GPU异构集群统一建设管理和资源统一规划调度
支持节点异构,同一集群的节点支持使用不同的操作系统和架构
支持实时查看集群CPU、内存、存储等资源的使用情况
支持设置集群内日志数据的保留时间、日志数据卷的大小
支持对日志数据卷使用率进行监控告警,并在达到阈值时自动启动写入保护,以免数据卷写满导致服务异常
节点弹性伸缩组 支持基于 Pod Pending 状态、CPU / 内存使用率等自动触发节点弹性伸缩
可关联节点选择器、节点亲和性 / 反亲和性配置,确保扩容节点符合 Pod 调度要求
支持节点弹性伸缩组的创建、修改基础配置、修改节点配置、故障恢复、删除等基本生命周期管理
支持查看和导出节点弹性伸缩组的伸缩日志
节点 支持节点的添加、删除等基本生命周期管理
支持停止/恢复节点调度,便于节点维护
支持实时查看节点的CPU/内存使用率、申请率、限制率,便于及时了解节点资源分配情况
支持集中查看节点上GPU卡的信息,包括GPU卡基本信息、显存使用情况、已调度容器组信息、实时监控数据等
支持节点列表导出为CSV文件,方便统计分析
GPU池 支持按集群查看当前集群下所有的GPU卡,集群下所有GPU总的使用情况,包括:显存使用率、显存申请率、GPU使用率
支持查看GPU卡的详细信息,包括:厂商、型号、显存、显存使用率、显存申请率、GPU使用率、GPU申请率等
支持对GPU进行可视化监控,包括:GPU使用率、显存使用率、功耗、温度
支持集中查看GPU上已调度的容器组信息
支持的GPU厂商包括:NVIDIA、华为、海光、天数、阿里巴巴
存储类 支持存储类的创建、更新、删除等基本生命周期管理
外部网络 支持外部网络的创建、删除等基本生命周期管理
支持统计外部网络IP使用情况,提高IP规划效率
支持两种网络段类型:服务外部网络、容器组外部网络
容器组外部网络支持从Kubernetes集群外直接访问容器组IP
支持网络段的创建、删除
支持网络段的IP范围管理,包括添加、删除
支持设置网络段的共享模式,允许全局或指定项目使用网络段资源
项目 支持项目的创建、编辑、删除等基本生命周期管理
支持为项目添加成员和命名空间,并进行集中管理
支持通过项目实现资源隔离和权限控制
用户 支持本地用户和第三方用户
支持本地用户的创建、启用、禁用、删除、重置密码等基本生命周期管理
支持第三方用户的同步、删除等基本生命周期管理
支持将用户设为管理员,以获得平台权限
支持将用户取消管理员
支持将用户加入项目,以获得项目权限
支持将用户从项目移除
命名空间 支持命名空间的创建、删除等基本生命周期管理
支持设置命名空间资源配额,有效控制用户/团队资源用量
支持按厂商设置命名空间的GPU显存配额、GPU数量配额,有效控制用户/团队GPU资源用量
支持设置命名空间默认资源限制
支持将命名空间加入项目/从项目移除
支持为命名空间添加标签、注解
设置 邮箱服务器 支持邮箱服务器的添加、修改、删除等基本生命周期管理
支持STARTTLS、SSL/TLS、NONE三种加密类型
主题外观 支持自定义设置平台主题外观,如外观主题、平台标题、Logo等
第三方认证 支持通过添加第三方认证服务器,无缝接入第三方登录认证系统,使相应账户免密登录云平台
支持添加第三方认证服务器类型:OIDC、CAS
支持为第三方认证服务器设置同步映射规则,包括:用户映射规则
支持第三方认证服务器的添加、修改、删除等基本生命周期管理
AccessKey管理 提供访问平台API的身份凭证,具有创建者完全的权限
支持AccessKey的生成、启用、停用、删除等基本生命周期管理