You need to enable JavaScript to run this app.
文档中心
全栈可观测平台

全栈可观测平台

复制全文
下载 pdf
集成市场
集成 VKE 中的服务端应用
复制全文
下载 pdf
集成 VKE 中的服务端应用
集成中心是全栈可观测平台接入各类监控采集组件的统一门户,提供海量模版,支持一键部署、灵活扩展。本文以 VKE 集群中的 Go 应用为例,为您介绍如何通过安装组件方式将 VKE 集群中的服务端应用接入到应用性能监控。
背景信息
集成中心针对 VKE 中的服务端应用提供“安装组件自动集成”、“使用 Collector 集成”、“使用 SDK 集成”等多种集成方式,但不同语言的支持程度存在差异,具体如下:
说明
本文主要介绍“安装组件自动集成”方式。若需要使用 Collector 或 SDK 集成方式,可参考控制台提供的接入指南进行配置(获取步骤见正文说明)。
集成方式
Go
Java
Python
Node.Js
安装组件自动集成
使用 Collector 集成
使用 SDK 集成
前提条件
  • 已经在待接入应用的工作负载中配置 Pod 标签(Label)或注解(Annotation),方便批量筛选应用。更多详细说明参见:工作负载配置
操作步骤
  1. 在左侧导航栏选择 集成中心 -> 集成市场
  1. 单击 服务端应用 分类中的 Go
  1. 火山引擎 页签,根据实际情况配置集成参数,完成后单击 创建接入任务
  • 配置项
    说明
    图例
    地域
    选择应用接入应用性能监控后所属的地域。
    接入协议类型
    选择应用接入应用性能监控时使用的协议类型,目前支持 OpenTelemetry。
    工作区
    选择应用接入应用性能监控后所属的工作区。
    接入方式
    采集数据的上报方式,当前场景选择 VKE 环境自主接入
    说明
    若选择 Collector 或 SDK,将提供详细的接入指南,可参考控制台提供的接入指南进行接入配置。
    服务授权
    跨服务授权 VKE 服务,确保能够获取 VKE 集群和组件安装情况。
    说明
    跨服务授权仅需配置一次,若当前并未完成跨服务授权,可根据界面引导进行配置。
    集群准备
    选择待接入应用所属集群,并确保当前集群已经安装 apmplus-opentelemetry-collector 组件。
    说明
    若所选集群未安装 apmplus-opentelemetry-collector 组件或安装失败,可根据界面引导进行安装。
  1. 配置集成任务相关参数,完成后单击 确定
说明
采集配置、数据上报涉及多个配置入口,生效优先级为:服务级别的参数配置 > 集成任务中的参数配置 > 工作区级别的参数
  • 配置项
    说明
    图例
    任务名称
    自定义集成任务名称。
    自定义 Pod 筛选
    根据 Pod 标签(Label)和注解(Annotation)筛选待接入的应用,进行探针注入,实现可观测数据采集。
    注意
    自定义 Pod 筛选规则的优先级高于默认筛选规则。
    若不配置自定义 Pod 筛选,默认筛选含有指定注解的 Pod。不同语言的指定注解不同,具体如下:
    • Go:instrumentation.apmplus.volcengine.com/inject-sdk: "true"
    • Java:instrumentation.apmplus.volcengine.com/inject-java: "true"
    • NodeJs:instrumentation.apmplus.volcengine.com/inject-nodejs: "true"
    • Python:instrumentation.apmplus.volcengine.com/inject-python: "true"
    采集配置
    Trace 数据的采集规则,支持固定采样、错慢采样和自定义属性采样。若不启用任何采集配置,默认为 100% 固定采样。
    • 固定采样:根据自定义配置的采样率进行 Trace 数据采样。其中,0% 表示丢弃所有 Trace 数据,不进行上报;100% 表示上报所有 Trace 数据,不进行采样。
    • 错慢采样:根据自定义配置的 Trace 耗时阈值下限和错误采样规则进行数据上报,匹配到错慢采样规则的所有 Trace 数据将被上报。
    说明
    • 错慢采样的耗时依据为 Trace 总耗时,并非 Span 耗时。数值配置时,需要针对一个完整调用链路耗时的区间值进行配置。
    • 若开启错慢采样,Trace 耗时阈值下限和错误采样至少启用一项。
    • 若开启错慢采样且同时配置 Trace 耗时阈值下限和错误采样,满足任一规则的 Trace 数据均被上报。
    • 自定义属性采样:根据自定义配置的 Span 属性匹配规则进行数据采样。
    数据上报
    数据上报相关配置,包括:指标数据上报、日志数据上报、链路数据上报。默认开启,可根据实际需求开启或关闭。
    -
    接口配置
    接口相关配置,可根据实际情况配置 Path 收敛、RPC 服务接口列表、无效接口调用过滤、HTTP 状态码白名单。
    注意
    变更 Path 收敛或 RPC 服务接口列表配置后,历史数据将无法通过新的 Resource 值做筛选查询,请谨慎操作。
    • Path 收敛:URL 中 Path 地址的收敛规则,默认关闭。启用后,HTTP 服务的接口名称将根据实际 URL 的默认 URL 收敛规则生成。
    • 收敛原理是保留有意义路径信息的同时,将路径中的数字 ID 替换为通配符“?”,实现相对路径的聚合。
    注意
    • 仅对作为 Server 调用的 HTTP 服务生效。
    • 最大长度默认为 24 字符,支持按账号进行修改。若需要修改最大长度,请联系官方技术支持获取帮助。
    • RPC 服务接口列表:RPC 服务相关接口名称的赋值来源,默认为方法级别。其中,方法级别表示 Resource 字段由 rpc.method 赋值;服务方法级别表示 Resource 字段由 rpc.service + rpc.method 赋值。
    • 无效接口调用过滤:针对无需记录观测数据的接口,可将其设置为无效接口。配置生效后,无效接口将不再上报 Trace 数据,对应指标统计也会忽略该接口数据,包括 Span 以及指标统计。
    • HTTP 状态码白名单:默认情况下,HTTP 状态码大于等于 400 则被归类为错误调用。若不希望某类状态码被归类为错误,可根据实际需求配置 HTTP 状态码白名单,配置生效后,白名单 HTTP 状态码将在 RED 指标和错误统计中定义为正确。
  1. 集成任务配置完成后,需要重启目标业务对应的工作负载,采集才会生效。可前往 容器服务控制台,在目标容器集群的工作负载管理页面,重新部署待接入应用对应的工作负载。
注意
重新部署操作,将重启无状态负载下的全部 Pod,建议在业务低峰期操作。
结果验证
工作负载重新部署后,前往 应用性能监控控制台,在服务列表页面使用容器名称搜索服务,检查数据上报状态,“正常”表示近期成功上报数据。
说明
服务名称默认与工作负载中定义的容器名称一致。
后续操作
  • 集成任务创建完成后,可前往集成管理页面查看和管理任务。更多详细说明参见:集成管理
  • 集成任务创建完成后,可前往探针管理页面查看探针及其详细信息。更多详细说明参见:探针管理
最近更新时间:2026.09.08 20:00:02
这个页面对您有帮助吗?
有用
有用
无用
无用