You need to enable JavaScript to run this app.
文档中心
E-MapReduce

E-MapReduce

复制全文
下载 pdf
系统元数据视图
系统元数据视图说明
复制全文
下载 pdf
系统元数据视图说明

本文为您介绍系统元数据视图( Information Schema )​详细字段说明。

视图列表

入口一:登录 LAS 控制台,打开emr_system_catalog> default数据库,即可查看系统视图。
入口二:登录 EMR Serverless 控制台,在左侧导航栏点击 Serverless > 具体队列>​右上角 SQL 编辑器,进入 SQL 编辑器 页面,点击左上角 Information Schema,跳转emr_system_catalog> default数据库,即可查看系统视图。
Image

表名称

说明

视图类型

更新说明

emr_system_catalog.default.emr_job_history

历史作业运行信息

作业历史

每天 7:00 更新 T-1 数据

emr_system_catalog.default.emr_resource_queue

队列资源使用快照信息,时间切片 30s

队列资源

每天 7:00 更新 T-1 数据

emr_system_catalog.default.emr_resource_compute_group

计算组资源使用快照信息,时间切片 30s

计算组资源

每天 7:00 更新 T-1 数据

视图字段说明

emr_job_history

emr_job_history 记录历史作业运行明细,适合用于查询租户内作业历史、作业耗时、资源消耗、失败任务、SQL 来源以及提交渠道等信息。该表按 date 分区。

字段

类型

说明

task_id

STRING

任务 ID。

task_name

STRING

任务名称。

user_id

STRING

提交用户 ID 或 AK。

queue_name

STRING

队列名。

status

STRING

任务状态。

engine_type

STRING

引擎类型。

start_time

STRING

任务开始时间。

end_time

STRING

任务结束时间。

duration

BIGINT

任务耗时,单位为秒。

sum_cuh

DOUBLE

任务总 CU 时,1 CU = 1 Core / 4 GiB。

query_sql

STRING

执行的 SQL。

origin

STRING

提交来源,例如 JDBC、SDK、DataLeap、Console、DataWind 等。

driver_cpu_peak_percent

STRING

Driver CPU 峰值百分比。

executor_cpu_peak_percent

STRING

Executor CPU 峰值百分比。

driver_mem_peak_percent

STRING

Driver 内存峰值百分比。

executor_mem_peak_percent

STRING

Executor 内存峰值百分比。

priority

STRING

优先级。

query_conf

STRING

作业参数。

result_lines

STRING

查询行数。

dorado_instance_id

STRING

DataLeap 实例 ID。

tqs_input_size

STRING

读行数。

shuffle_data

STRING

Shuffle 量。

region

STRING

地域。

date

STRING

日期分区字段,建议按业务日期过滤。

emr_resource_queue

emr_resource_queue 记录队列维度的资源指标快照,适合用于分析队列 CU、CPU、内存分配与使用情况,以及运行中、排队中、成功和失败作业数量。该表按 date 分区。

字段

类型

说明

timestamp_str

STRING

时间戳。

queue_id

STRING

队列 ID。

queue_name

STRING

队列名称。

cu_total

DOUBLE

CU 总量,表示队列 Capacity。

cu_allocated

DOUBLE

CU 分配量。

cu_allocated_rate

DOUBLE

CU 分配率。

cpu_total

DOUBLE

CPU 总量。

cpu_allocated

DOUBLE

CPU 分配量。

cpu_allocated_rate

DOUBLE

CPU 分配率。

mem_total

DOUBLE

内存总量,单位 MB。

mem_allocated

DOUBLE

内存分配量,单位 MB。

mem_allocated_rate

DOUBLE

内存分配率。

cpu_usage

DOUBLE

CPU 使用量。

cpu_usage_rate

DOUBLE

CPU 使用率。

mem_usage

DOUBLE

内存使用量,单位 MB。

mem_usage_rate

DOUBLE

内存使用率。

job_total

BIGINT

作业总数。

job_running

BIGINT

运行中作业数。

job_pending

BIGINT

排队中作业数。

job_success_count

BIGINT

运行成功作业数。

job_failed_count

BIGINT

运行失败作业数。

shuffle_total

DOUBLE

Shuffle Write 总量。

date

STRING

日期分区字段。

emr_resource_compute_group

emr_resource_compute_group 记录计算组维度的资源指标快照,适合用于观察 common 或 spark 类型计算组的资源使用状态。指标明细以 JSON 字符串存储在 metrics_json 字段中。该表按 date 分区。

字段

类型

说明

timestamp_str

STRING

时间戳。

queue_id

STRING

资源 ID。

queue_name

STRING

队列名称。

compute_group_id

STRING

计算组 ID。

compute_group_name

STRING

计算组名称。

type

STRING

计算组类型,取值示例为 commonspark

metrics_json

STRING

指标数据,JSON 格式。

date

STRING

日期分区字段。

最近更新时间:2026.08.17 15:30:36
这个页面对您有帮助吗?
有用
有用
无用
无用