You need to enable JavaScript to run this app.
文档中心
全栈可观测平台

全栈可观测平台

复制全文
下载 pdf
告警历史
告警概览
复制全文
下载 pdf
告警概览
告警概览汇聚云监控、托管 Prometheus、应用性能监控全产品线告警数据,既能直观掌握整体故障风险水平与告警来源,又能通过告警趋势识别告警爆发节点与变化规律,帮助运维人员快速掌控全域告警态势,提升故障排查效率,支撑告警降噪与常态化运维治理。本文为您介绍如何查看告警概览数据大盘。
操作步骤
  1. 在左侧导航栏选择 告警中心 -> 告警概览,前往告警概览页面。
  1. 通过产品、告警类型、地域信息进行数据筛选。
  • 序号
    筛选项
    说明
    1
    产品筛选
    按产品进行数据筛选,目前支持查看告警概览的产品包括:云监控、托管 Prometheus、应用性能监控。
    2
    看板切换
    按告警类型进行数据筛选,目前提供告警中和历史大盘两个看板。
    • 告警中:仅展示正在告警中的数据大盘,主要展示 24 小时内指标数据。
    • 历史大盘:最多展示两周内的数据大盘,可根据相对时间范围或绝对时间范围进行数据筛选。
    3
    地域筛选
    按地域进行数据筛选。
  1. 数据筛选完成后,即可查看告警概览大盘。
  • 指标
    说明
    图例
    正在告警总数
    正在进行的告警总数,以及未恢复的告警总数。直观掌握故障体量,快速判断整体系统是否处于异常高危状态。
    各产品正在告警数
    以产品维度统计正在进行的告警数量。快速区分受故障影响的业务产品,实现故障按业务维度拆分认领。
    近 24h 新增告警数趋势
    最近 24 小时内新增告警数量的趋势图。通过告警增长走势判断故障是突发爆发还是缓慢恶化,验证故障处置效果。
    近 24h 告警区域 TOP 10
    最近 24 小时内告警数量排名前 10 的地域。迅速识别机房、地域级地域性故障,区分局部故障与全网故障。
    近 24h 告警策略 TOP 10
    最近 24 小时内告警数量排名前 10 的告警规则。定位高频告警规则,区分真实故障与告警风暴,辅助优化告警规则实现降噪。
    说明
    • 单击策略名称,可跳转到告警规则详情页查看详细信息。
    • 单击目标策略右侧操作列中的 查看 按钮,可跳转到告警事件页面,查看当前告警相关告警历史。
    近 24h 云产品告警 TOP 10
    最近 24 小时内告警数量排名前 10 的云产品。精准锁定故障对应的底层云组件,帮助运维快速定位故障根因所在资源。
    说明
    单击目标云产品名称或右侧操作列中的 查看 按钮,可跳转到告警事件页面,查看当前云产品相关告警历史。
    近 24h 云产品事件 TOP 10
    最近 24 小时内事件数量排名前 10 的云产品。结合事件与告警数据,判断告警是否由运维变更操作引发,规避变更故障。
    说明
    单击目标云产品名称或右侧操作列中的 查看 按钮,可跳转到告警事件页面,查看当前云产品相关事件历史。
    告警总数
    指定时间范围内的告警总数,以及未恢复的告警总数。统计周期内整体告警体量,用于故障量级统计、运维健康度考核。
    各产品告警数
    指定时间范围内各个产品触发的告警数量。统计各业务周期告警频次,量化各产品稳定性,针对性优化薄弱产品。
    告警数趋势
    指定时间范围内触发告警的数量趋势图。复盘历史告警波动规律,挖掘周期性故障、业务高峰期故障隐患。
    告警区域 TOP 10
    指定时间范围内告警数量排名前 10 的地域。统计各地域长期故障高发情况,为机房扩容、地域运维资源调配提供依据。
最近更新时间:2026.08.21 14:04:46
这个页面对您有帮助吗?
有用
有用
无用
无用