- 文档首页
容器服务
容器服务 VKE
用户指南
可观测性
基础观测
开启观测
开启观测
云原生基础观测服务能够提供免运维、高性能、高稳定的集群观测与告警服务。本文为您介绍基础观测中的常见概念以及如何开启云原生基础观测功能。
容器服务集群中将云原生基础观测的指标范围划分为基础、标准和全量三档,主要是为了帮助用户在观测覆盖范围、使用成本和排障深度之间做更合适的取舍。三档能力按照覆盖范围逐级递增,便于用户根据集群规模、业务复杂度和运维目标,选择当前阶段真正需要的观测级别,避免一开始配置过多或观测不足。
说明
选择不同的观测指标范围及托管 Prometheus 工作区存储时长时,计费方式和费用有所不同,详情请参见 按量计费。 云原生基础观测基于 托管 Prometheus 服务实现,使用 prometheus-agent 组件作为集群中的采集器,实现集群基础资源、控制面组件和自定义业务的指标采集和监控。当您在集群中安装 prometheus-agent 时,系统会同时安装 vmagent、vmoperator、kube-state-metrics、node-exporter 等组件,以及 ServiceMonitor、PodMonitor 等自定义资源。更多组件详情,请参见 prometheus-agent。 注意
修改指标范围会导致您集群中采集的指标数量发生变化,当增加指标采集范围时,会产生额外费用。详情请参见 按量计费。 -
- 在弹出的配置框内,选择修改后的指标范围,并勾选 已安装组件即刻生效。
-
- 在 容器观测 配置中,单击 Prometheus 工作区 后的
,修改工作区。
-
- 在弹出的配置框内,选择修改后的工作区,并勾选 我已知悉并同意告警规则组的 Prometheus 工作区将一并修改更新。
-
开启云原生基础观测功能后,在左侧导航栏中,选择 云原生观测 > 概览,并选择 观测概览 页签,支持查看集群观测概览信息。
- 观测配置概览:展示集群绑定的托管 Prometheus 工作区和采集组件状态。
-
- 基础观测概览:展示了集群中已开启基础观测的组件比例和指标范围。
-
- 全栈观测概览:展示全栈观测功能状态,支持单击 开启,配置全栈观测功能。详情请参见 开启全栈观测。
-
开启云原生基础观测功能后,支持查看集群概况信息,包括:节点运行情况和工作负载应用性能概况。
节点运行情况提供了集群中所有节点的状态信息和资源使用信息。
- 节点状态信息:展示当前集群节点统计信息,包括:Ready 状态、非 Ready 状态、磁盘可用量低、内存可用量低、进程过多、网络不可用等状态的节点总数。
- 资源使用信息:展示了当前集群所有节点中,CPU 使用率、内存使用率、网络流入流量、网络流出流量、磁盘使用率、磁盘 IO 饱和度、文件描述符饱和度、inodes 饱和度等指标的 Top5 列表。
- 在集群管理页面的左侧导航栏中,选择 云原生观测 > 概览 页面,选择 监控概览 页签。
-
工作负载应用性能概况提供了集群中所有工作负载的性能信息,包括:错误率、响应时间(P90)等。
- 在集群管理页面的左侧导航栏中,云原生观测 > 概览 页面,选择 监控概览 页签。
- 在 工作负载应用性能情况 中,查看集群工作负载的性能监控信息。
最近更新时间:2026.07.03 17:05:28