全栈可观测平台
Attribute | 类型 | 描述 | 示例 |
gen_ai.system | string | 大模型系统标识,例如:平台名称、框架名称。 | "openai", "arkitect", "Langchain" 等 |
gen_ai.request.model | string | 请求的模型名称。 | "gpt-4" |
gen_ai.request.type | string | 请求类型分类。 | "chat", "completion" |
gen_ai.response.model | string | 实际响应的模型名称。 | "gpt-4-1106-preview" |
gen_ai.request.max_tokens | int | 请求的最大生成 Token 数。 | 1000 |
gen_ai.request.temperature | float | 请求的生成温度参数,用于控制随机性。 | 0.7 |
gen_ai.request.top_p | float | 请求的 Top-P 采样参数。 | 0.9 |
Attribute | 类型 | 描述 | 示例 |
gen_ai.prompt.{index}.role | string | 输入消息中的角色,例如:用户、系统。 | "user","system" |
gen_ai.prompt.{index}.content | string | 输入消息中的内容。 | "介绍下你自己" |
gen_ai.completion.{index}.role | string | 输出消息中的角色,例如:助手。 | "assistant" |
gen_ai.completion.{index}.content | string | 输出消息中的内容。 | "我是豆包..." |
gen_ai.response.finish_reason | string | 生成完成原因,例如:stop, length。 | "stop" |
gen_ai.response.stop_reason | string | 具体停止条件,例如:触发的停止序列。 | "\n" |
Attribute | 类型 | 描述 | 示例 |
gen_ai.usage.input_tokens | int | 输入 Token 数量。 | 1024 |
gen_ai.usage.output_tokens | int | 输出 Token 数量。 | 512 |
gen_ai.usage.total_tokens | int | 总 Token 数量。总Token 数量 = 输入 Token 数量 + 输出 Token 数量。 | 1536 |
gen_ai.usage.cache_creation_input_tokens | int | 缓存创建时的输入 Token 数。 | 2048 |
gen_ai.usage.cache_read_input_tokens | int | 缓存读取时的输入 Token 数。 | 1024 |
Attribute | 类型 | 描述 | 示例 |
gen_ai.is_streaming | bool | 是否为流式请求。 | true |
gen_ai.chat_completions.streaming_time_to_first_token | float | 首 Token 延迟(秒),适用于 streaming 场景。 | 0.3 |
gen_ai.chat_completions.streaming_time_per_output_token | float | 单个输出 Token 的平均生成耗时(秒),适用于 streaming 场景。 | 0.02 |
Attribute | 类型 | 描述 | 示例 |
gen_ai.user.id | string | 用户 ID。 | "user_#a3f9b2" |
gen_ai.session.id | string | 会话 ID。 | a2b1ee10-22df-42d9-8daa-986a609b1686 |
维度 Key | 示例 | 说明 |
service | llm-demo | 服务名称。 |
gen_ai_system | openai | 大模型系统。 |
stream | true | 是否流式。 |
server_address | 127.0.0.1 | 请求地址。 |
gen_ai_response_model | "gpt-4-1106-preview" | 响应的模型名称。 |
gen_ai_operation_name | "chat" | 操作类型。 |
维度 Key | 示例 | 说明 |
gen_ai_token_type | input, output | Token 类型。 |
gen_ai_response_finish_reason | stop | 生成完成原因。 |
Metric | 类型 | 说明 | 特殊维度 |
gen_ai.chat.count | Counter | 聊天会话总次数。 | 无 |
gen_ai.client.generation.choices | Counter | 生成选项数量,适用于多候选结果场景。 | gen_ai_response_finish_reason |
Metric | 类型 | 说明 | 特殊维度 |
gen_ai.client.token.usage | Histogram | Token 消耗分布。 | gen_ai_token_type |
Metric | 类型 | 说明 | 特殊维度 |
gen_ai.client.operation.duration | Histogram | 请求总耗时(端到端)。 | 无 |
gen_ai.chat_completions.streaming_time_to_first_token | Histogram | 流式请求的首 Token 延迟。 | 无 |
gen_ai.chat_completions.streaming_time_to_generate | Histogram | 首 Token 延迟(秒),适用于 streaming 场景。 | 无 |
gen_ai.chat_completions.streaming_time_per_output_token | Histogram | 单个输出 Token 的平均生成耗时(秒),适用于 streaming 场景。 | 无 |
Metric | 类型 | 说明 | 特殊维度 |
gen_ai.chat_completions.exceptions | Counter | 大模型调用异常次数。 | 无 |