容器服务
图表名称 | 单位 | 图表说明 |
APF 当前执行请求数量(维度:FS + PL) | 个 | 按 FlowSchema + PriorityLevelConfiguration 维度统计请求数量的相关指标。包括以下指标:
|
APF 当前在队列中待处理请求数量(维度:FS + PL) | 个 | |
APF 名义并发限制席位数 | 个 | 按 PriorityLevelConfiguration 维度统计 APF 席位数量的相关指标。包括以下指标:
|
APF 当前并发限制席位数 | 个 | |
APF 当前在执行的席位数量 | 个 | |
APF 当前在排队的席位数量 | 个 | |
APF 请求执行时间 [P90] | 秒 | 每个 FlowSchema 以及对应 PriorityLevelConfiguration 的请求从开始执行到最终完成所花费的时间 90 分位数。 |
APF 请求等待时间 [P90] | 秒 | 每个 FlowSchema 以及对应 PriorityLevelConfiguration 的请求从进入队列到开始执行之间的等待时间 90 分位数。 |
APF 成功调度并处理的请求 QPS | req/s | 每个 FlowSchema 以及对应 PriorityLevelConfiguration 成功调度并处理的请求QPS。 |
APF 拒绝请求 QPS | req/s | 每个 FlowSchema 以及对应 PriorityLevelConfiguration 中因超出并发限制或队列容量而被拒绝的请求QPS。 |
图表名称 | 单位 | 图表说明 |
Resource(资源用量) | | |
存活的 kube-controller-manager 实例 | 个 | kube-controller-manager 组件的健康实例数量。
说明 |
kube-controller-manager 进程驻留内存 | MiB | kube-controller-manager 组件的常驻内存使用量。
|
kube-controller-manager CPU 核心使用量 | 毫核 | kube-controller-manager 组件的 CPU 使用率。
|
Workqueue(队列) | | |
Workqueue 入队速率 | 个 | kube-controller-manager 组件每个控制器(如节点、Service、端点控制器)在单位时间内的新增任务数量。
|
Workqueue 深度 | 个 | kube-controller-manager 组件每个控制器(如节点、Service、端点控制器)各工作队列的平均深度(即队列中待处理的任务数)。
|
Workqueue 处理时延 | 秒 | kube-controller-manager 组件每个控制器(如节点、Service、端点控制器)各工作队列中,任务在队列中等待时长的分位数(例如配置quantile为0.9时,代表 90% 任务的等待时长)。 说明
|
Kube API | | |
请求 APIServer 的 QPS | 个 | kube-controller-manager 组件在单位时间内向 API Server 发起的 HTTP 请求数量。基于请求方法(Method)和响应码(Code)进行分析。
|
请求 APIServer 的延迟分布 | 秒 | kube-controller-manager 组件调用 API Server 的请求耗时分位数(例如配置quantile为0.9时,代表 90% 请求的耗时)。 说明 建议关注 0.9 分位(反映 90% 任务的请求的耗时)和 0.99 分位(暴露极端慢请求问题)。 |