功能 | 描述 |
工作区 | 工作区(Workspace)是托管 Prometheus 中数据和采集规则的抽象整合,为用户提供标准的云端 Prometheus 能力。支持创建、更新、删除工作区。 |
认证方式 | 工作区支持 2 种认证方式,包括:火山引擎 AK/SK 认证、Basic Auth 认证。 |
读写地址 | 提供独立的 Remote Write URL 内网地址、Query URL 内网地址、Push Gateway URL 内网地址和联邦查询地址,用于对工作区进行数据读写操作。 |
Recording Rule |
|
工作区监控 | 提供工作区自监控能力,支持查看工作区筛选时间内的指标写入、查询、存储数据趋势,帮助您进行自助排障时查看限流、指标不合法等情况。 |
功能 | 描述 |
云服务接入 | 支持监控火山引擎云原生产品,实现对云原生产品指标、工作状态、资源用量的监控和告警。已接入的产品包括:容器服务(VKE)、云服务器(ECS)、云监控(CloudMonitor)、微服务引擎(MSE)、API 网关(APIG)等。 |
自建 Kubernetes 集群接入 | 提供原生 Prometheus 采集器和高可用采集器方案,方便用户自建 Kubernetes 集群接入。 |
自定义业务接入 | 支持开源社区提供的各种 SDK,在应用开发时对业务的监控指标进行定义,然后通过托管 Prometheus 实现对应用或服务的监控。 |
Exporter 接入 | 支持开源社区提供的各种 Exporter,实现对各种环境、中间件、自定义应用的监控。 |
功能 | 描述 |
指标消耗统计 | 汇总展示基础指标、其他指标及自定义指标的上报量与写入量。提供过去 24 小时和过去 14 日累计数据,用于快速判断消耗规模。 |
指标上报趋势 | 按类型展示上报量变化趋势,支持 Min、Max、Avg 统计。用于观察采集规模波动,辅助异常排查。 |
指标写入趋势 | 按类型展示写入量变化趋势,支持 Min、Max、Avg 统计。用于分析数据写入规模,辅助成本分析与治理。 |
指标排行分析 | 支持基于工作区、Metric 和 Job 查看指标排名。帮助用户了解系统中的指标数量分布,并合理调整指标采集规则。 |
功能 | 描述 |
指标查询 |
|
功能 | 描述 |
联系人 |
|
告警通知渠道 | 支持多种类型的告警通知渠道,包括:
|
告警规则 |
|
告警规则模板 |
|
告警通知策略 | 支持配置告警通知策略。允许基于不同的告警级别(P0、P1 和 P2),分别配置告警的通知对象和通知方式。 |
通知消息模板 | 支持配置通知消息模板,允许基于 Markdown 语法 和 Go Template 语法自定义消息通知样式。 |
告警聚合策略 | 支持配置告警聚合策略,允许配置聚合周期和通知周期。减少告警风暴的产生。 |
告警静默策略 | 支持配置告警静默策略,当某些告警暂时无法解决时,您可以配置告警静默策略,屏蔽对应告警的通知。 |
查看告警 |
|
功能 | 描述 |
创建任务 | 支持配置数据过滤条件和数据查询偏移,并选择导出目标(Kafka 消息队列、自建 Prometheus 或 TOS),按需控制导出范围和投递方式。 |
任务查询 | 支持按工作区和任务名称筛选,快速定位目标任务。 |
任务管理 | 展示任务名称、导出目标、状态、标签及所属工作区,统一查看任务信息。 |
任务操作 | 支持编辑、暂停、删除任务,按需调整或停止导出。 |