文档中心
登录
注册
托管 Prometheus
文档指南
托管 Prometheus
托管 Prometheus
文档指南
请输入
产品动态
新功能发布记录
历史功能发布记录
新功能发布记录(2024 年)
新功能发布记录(2023 年)
产品公告
【计费变更】托管 Prometheus 新增按写入量计费
【产品变更】控制台登录入口切换至全栈可观测平台
【产品变更】OpenAPI(ListWorkspaces)变更通知
【产品变更】容器服务 Prometheus-agent 组件升级
【产品变更】托管 Prometheus 正式商业化公告
关于运营商禁止短信内容包含链接、IP地址、联系方式的公告
【产品变更】VMP 告警通知功能迁移至全栈可观测平台告警中心
产品简介
什么是托管 Prometheus
产品优势
产品功能
应用场景
地域和可用区
基本概念
使用限制
Prometheus 基础知识
数据格式和指标类型
Prometheus 时序数据格式
Prometheus Metrics 类型
指标 Relabel
PromQL 入门
什么是 PromQL
PromQL 基本用法
PromQL 选择器
PromQL 操作符
PromQL 聚合操作
PromQL 常用函数
产品计费
计费概述
计费方式
按量计费
资源包
资源包概述
购买资源包
查看资源包
续订资源包
退订和更配
价格计算器
欠费说明
项目分账
标签分账
税率和发票
快速入门
用户指南
工作区
工作区概述
工作区类型
如何配置工作区规格参数
创建工作区
创建通用工作区
创建本地工作区
创建聚合查询工作区
工作区更配
修改工作区计费类型
修改工作区数据存储时长
修改工作区规格参数
获取工作区地址
工作区监控
管理工作区
Recording Rule
创建 Recording Rule
管理 Recording Rule
流量管控
配置子用户或角色限流
管理 PromQL 封禁策略
慢查询
跨账号/地域工作区聚合
接入中心
资源消耗
Explore
查询指标
查询历史
监控看板
预置看板
基础操作
告警中心
告警概述
查看告警事件
告警规则
创建告警规则
管理告警规则
创建告警规则组
管理告警规则组
常见告警规则建议
告警规则模板
预置告警规则模版
自定义告警规则模板
告警通知策略
创建告警通知策略
管理告警通知策略
创建通知对象
创建联系人
创建联系人组
通知消息模板
创建通知消息模板
管理通知消息模版
扩展函数与变量
告警聚合策略
创建告警聚合策略
管理告警聚合策略
告警静默策略
创建告警静默策略
管理告警静默策略
指标导出
导出指标至 Kafka 消息队列
导出指标至自建 Prometheus
导出指标至 TOS 对象存储
权限管理
IAM 概述
配置 IAM 权限
配置项目级权限
项目和标签
项目管理
标签管理
接入指南
接入概述
云服务接入
容器服务接入
容器集群接入
自定义采集
云服务器接入
GPU/RDMA 毫秒级监控接入
云监控接入
其他云服务接入
Kafka 接入
Nacos 接入
Prometheus Federation 接入
SGLang 接入
Ray 接入
vLLM 接入
Dynamo 接入
ETCD 接入
健康巡检(Blackbox)接入
容器存储指标接入
自建 Kubernetes 集群接入
采集方案概述
部署脚本
获取脚本
脚本使用指南
高可用采集方案
部署 VM Agent
管理 VM Agent
组件扩容
告警和运维建议
自定义接入
自定义业务接入
Golang 应用接入
Exporter 接入
Nginx Exporter 接入
Kafka Exporter 接入
Redis Exporter 接入
MySQL Exporter 接入
PostgreSQL Exporter 接入
MongoDB Exporter 接入
ElasticSearch Exporter 接入
RabbitMQ Exporter 接入
最佳实践
跨云/跨地域工作区访问
使用代理实现工作区公网访问
使用专线连接和私网连接实现跨云工作区访问
使用云企业网和私网连接实现跨地域工作区访问
Prometheus 数据采集与接入
使用本地工作区关联本地 Prometheus 实例
使用 Pushgateway 推送数据
使用 Federate 端点抓取工作区中的时间序列
Prometheus-agent 稳定性提升最佳实践
开源 Prometheus 的 Agent 模式性能优化最佳实践
资源与业务监控
监控容器服务中的 AI 训练任务
使用 node-exporter 监控 ECS 实例
监控 ECS 实例中的应用
监控 veImageX 云服务
监控腾讯云资源
监控自定义 Kubernetes 集群
监控自定义 Kubernetes 集群中的 GPU
工作区数据写入和查询
通过 curl 方式访问 VMP Query 接口
使用 Python 语言实现工作区数据写入和查询
使用 Java 语言实现工作区数据写入和查询
使用 Go 语言实现工作区数据写入和查询
通过 Remote Write 地址将开源 Prometheus 数据写入托管 Prometheus 工作区
使用 Recording Rule 预聚合加速查询
自建 Grafana
在容器服务集群中部署 Grafana 并接入工作区
在云服务器实例中部署 Grafana 并接入工作区
多渠道告警通知
使用邮件接收告警通知
使用飞书自定义机器人接收告警通知
使用飞书应用机器人接收告警通知
使用钉钉接收告警通知
使用企业微信接收告警通知
使用电话接收告警通知
使用短信接收告警通知
使用 vmalert 对接 VMP 进行告警
智能运维
对话即运维:基于MCP服务管理VMP
API 参考
API 发布历史
使用前必读
API 列表
API 错误码列表
调用方式
请求结构
服务地址
公共参数
签名机制
返回结构
工作区
CreateWorkspace
UpdateWorkspace
DeleteWorkspace
ListWorkspaces
ListWorkspaceInstanceTypes
ListWorkspaceStatus
GetWorkspace
GetWorkspaceAuthInfo
Recording Rule
CreateRuleFile
DeleteRuleFile
GetRuleFile
ListRuleFiles
ListRules
UpdateRuleFile
告警中心
联系人
CreateContact
DeleteContacts
ListContacts
UpdateContact
CreateContactGroup
DeleteContactGroups
ListContactGroups
UpdateContactGroup
SendValidationMessage
TestWebhook
TestLarkBotWebhook
TestDingTalkBotWebhook
TestWeComBotWebhook
告警通知策略
CreateNotifyPolicy
DeleteNotifyPolicy
ListNotifyPolicies
UpdateNotifyPolicy
告警规则
CreateAlertingRule
DeleteAlertingRules
DisableAlertingRules
EnableAlertingRules
ListAlertingRules
UpdateAlertingRule
告警聚合策略
CreateNotifyGroupPolicy
DeleteNotifyGroupPolicy
ListNotifyGroupPolicies
UpdateNotifyGroupPolicy
通知消息模版
CreateNotifyTemplate
UpdateNotifyTemplate
ListNotifyTemplates
DeleteNotifyTemplate
告警静默策略
CreateSilencePolicy
UpdateSilencePolicy
EnableSilencePolicies
DisableSilencePolicies
DeleteSilencePolicies
ListSilencePolicies
查看告警
ListAlertSamples
ListAlerts
资源标签
TagResources
UntagResources
ListTagsForResources
接入任务
CreateIntegrationTask
UpdateIntegrationTask
GetIntegrationTask
DeleteIntegrationTask
ListIntegrationTasks
EnableIntegrationTasks
DisableIntegrationTasks
SDK 参考
SDK 概览
指标参考
容器服务指标
API Server 指标
metrics-server 指标
kubelet 指标
nvidia-device-plugin 指标
npu-a-device-plugin 指标
mgpu 指标
rdma-device-plugin 指标
vpc-cni 指标
node-exporter 指标
kube-state-metrics 指标
cAdvisor 指标
csi-ebs 指标
core-dns 指标
node-local-dns 指标
cr-credential-controller 指标
image-accelerator 指标
p2p-accelerator 指标
ingress-nginx 指标
katalyst 指标
kube-controller-manager 指标
云服务器指标
API 网关指标
微服务引擎指标
常见问题
存量标准版实例数据迁移说明
如何在集群中创建 ServiceMonitor 等 CRD 资源?
如何删除服务发现配置?
通用 Webhook 格式说明
使用通用 Webhook 无法收到告警信息
如何查看指标数据?
无法正确查看到预期的指标?
提示“AccessDenied,Code:403”错误如何解决?
如何提升配额(Quota)?
托管 Prometheus 中 increase 查询结果为什么和预期不一样?
哪些查询能够自动匹配加速规则?
视频帮助
玩转容器服务 VKE 监控
相关协议
托管 Prometheus 专用服务条款
托管 Prometheus 产品服务等级协议
文档首页
托管 Prometheus
用户指南
告警中心
告警规则
创建告警规则组
复制全文
下载 pdf
我的收藏
告警规则
创建告警规则组
复制全文
下载 pdf
我的收藏
创建告警规则组
文档反馈
问问助手
托管 Prometheus 为您提供了容器服务等云产品的预置告警模版,覆盖产品监控的主要应用场景。方便您快速完成云产品的告警规则配置。本文为您介绍如何通过告警模版配置告警规则组。
前提条件
已完成
创建告警通知策略
和
创建告警聚合策略
。
操作步骤
登录
VMP 服务控制台
。
在左侧导航栏选择
告警中心 > 告警规则
,前往告警规则管理页面。
单击
创建 > 基于模版创建
,选择合适的模版,并根据实际场景配置基础信息、告警资源、告警通知等信息,完成后单击
确定
。
选择
模板
:选择使用场景匹配的模版,支持选择
预置告警规则模版
和
自定义告警规则模板
。
基础信息
:配置告警规则相关基础信息。
配置项
说明
名称
自定义告警规则组名称。
项目
告警规则组所属项目。项目管理是平台提供的一种资源管理方式,可以对不同业务或项目使用的云资源进行分组管理。基于项目进行 IAM 授权,有利于维护资源独立、数据安全,同时可从项目维度查看资源消费账单,便于计算云资源使用成本。
更多详细介绍参见:
项目管理
。
标签
告警规则组附带的标签,用于识别告警规则组的键值对,配合选择器,可以用于快速筛选目标告警规则组。资源标签由一组 KV 键值对组成,可以通过资源标签从不同维度对云资源进行分类和聚合管理,并且使用于标签制授权和资源分账等场景。
更多详细介绍参见:
标签管理
。
说明
最多添加 50 个标签。
告警资源
:配置告警资源相关信息。
配置项
说明
工作区
监控数据保存的工作区。
变量
配置告警规则组的变量信息。
说明
变量用于对监控数据中的云产品资源对象进行更细粒度的筛选,例如:在
VKE 节点
模版中,您可以通过变量选择 VKE 集群。
不同告警模版中的预置变量可能不同,请根据实际告警的需要合理配置。
规则预览
:预览模版中的规则,并基于单条规则配置触发条件和触发策略信息。
配置项
说明
规则开关
启用/关闭规则。单击规则右侧开关按钮,允许启用或关闭该规则。
触发条件
勾选 P0、P1 或 P2,表示设定不同的告警等级。取消勾选,则表示不设定该等级的告警。
触发策略
配置告警触发策略。指定告警等级、条件、阈值和条件持续时间。
勾选 P0、P1 或 P2,表示设定不同的告警等级。取消勾选,则表示不设定该等级的告警。
比较条件
:指定 PromQL 语句和阈值之间的比较条件。支持多个比较条件,包括:
大于
、
大于等于
、
小于
、
小于等于
、
等于
和
不等于
。
阈值
:配置指标的阈值。
条件持续时间
:配置指标符合条件的持续时间,包括:
立即触发
:满足告警条件后,立即触发告警。
自定义持续时间
:选择告警触发的时间,支持 1 分钟、2 分钟、5 分钟、10 分钟、20 分钟、30 分钟、1 小时、3 小时、6 小时、12 小时。例如:1 分钟表示满足告警条件,并持续 1 分钟后,再触发告警。
告警通知
:从统一告警中心或原 VMP 告警策略中选择合适的通知策略和聚合策略。
配置项
说明
通知策略
在下拉菜单中选择告警通知策略。系统会使用通知策略中配置的告警等级和联系人组,将告警发送给指定的联系人。详情请参见
创建告警通知策略
。
聚合策略
在下拉菜单中选择告警聚合策略。详情请参见
创建告警聚合策略
。
最近更新时间:2026.09.04 14:32:33
这个页面对您有帮助吗?
有用
有用
无用
无用