You need to enable JavaScript to run this app.
文档中心
全栈可观测平台

全栈可观测平台

复制全文
下载 pdf
AgentKit 应用监控
模型监控
复制全文
下载 pdf
模型监控
AI 应用监控已经无缝接入 Agentkit,可为其上部署的 Agent 提供 Trace 信息自动收集、Metric 指标自动生成,以及调用链检索、日志检索等全方位观测支持。本文为您详细介绍如何查看大模型相关监控信息。
背景信息
AI 应用监控已经针对 Agentkit 中的应用安装探针,当 AI Agent 使用模型服务时,即可从模型和服务视角直观观测模型调用、Token 消耗、TTFT 等性能指标。
前提条件
AI Agent 使用过程存在大模型调用,例如:执行文本生成、问答等与大模型相关的任务,触发模型调用。
操作步骤
  1. 登录 AI 应用监控,并在顶部导航栏选择项目和地域。
  1. 在左侧导航栏选择 AgentKit 应用观测
  1. 单击 模型监控,选择时间范围和模型,查看指定模型在固定时间段内的监控信息。
看板名称
说明
模型调用总次数
调用指定模型的总次数。
模型调用平均耗时
调用指定模型的平均耗时。
模型调用错误次数
调用指定模型失败的次数。
Token 使用总量
指定模型 Token 消耗总量(input + output)。
模型调用次数
调用指定模型的次数趋势。
模型调用平均耗时
调用指定模型的平均耗时趋势。
模型调用错误
调用指定模型失败的次数趋势。
Token 使用量
指定模型 Token 消耗总量(input + output)趋势。
模型调用 Runtime 排行(TOP5)
调用指定模型次数排名前 5 的运行时列表。
模型调用平均耗时 Runtime 排行(TOP5)
调用指定模型平均耗时排名前 5 的运行时列表。
模型调用错误 Runtime 排行(TOP5)
调用指定模型错误次数排名前 5 的运行时列表。
Token 使用 Runtime 排行(TOP5)
调用指定模型消耗 Token 排名前 5 的运行时列表。
模型请求耗时分位数
调用指定模型耗时分位数 P99/P90/P75/P50。
TTFT 分位数
调用指定模型返回首包数据的平均耗时分位数 P99/P90/P75/P50。
TPOT 分位数
调用模型在首个 Token 输出后,后续输出每个 Token 所需的时间分位数。
最近更新时间:2026.01.27 20:57:48
这个页面对您有帮助吗?
有用
有用
无用
无用