You need to enable JavaScript to run this app.
文档中心
容器服务

容器服务

复制全文
下载 pdf
调度组件
scheduler-plugin
复制全文
下载 pdf
scheduler-plugin
scheduler-plugin 组件为集群拓展调度器组件,拓展原生 kube-scheduler 调度器的调度能力及策略。本文介绍如何在集群中部署和使用 scheduler-plugin 组件。
组件概述
scheduler-plugin 是 VKE 在原生 kube-scheduler 之上提供的拓展调度器组件。它基于 Kubernetes Scheduling Framework 以插件形式补齐 GPU、AI 训练、大数据、在离线混部等场景下的调度能力,是 VKE 丰富调度能力产品优势的核心载体。
scheduler-plugin 组件的典型使用场景如下:
  • 集群中存在容器共享 GPU(mGPU)需求。
  • 在离线混部、批量任务调度,需要按业务自定义装箱或打散策略。
  • 与 vci-virtual-kubelet 配合,支撑 Serverless 容器与弹性突发场景。
scheduler-plugin 组件为托管组件,默认情况下不会在您的业务集群中部署具体的 Kubernetes 资源,不占用集群节点计算资源。
组件版本
系统托管组件无需您关心组件版本、升级、运维等内容。VKE 目前不对外展示关于该组件的历史发布记录。
安装组件
系统托管组件在创建集群时会根据默认配置自动安装,您可以自定义修改组件配置。
注意
  • 首次配置该组件后,在如下 Kubernetes 版本的集群中支持修改部分组件配置:
  • v1.28 及以上版本
  • v1.26.6-vke.7 及以上版本
  • v1.24.15-vke.18 及以上版本
  • v1.20.15-vke.23 及以上版本
  • 支持修改的配置,以控制台显示为准。若您的集群 Kubernetes 版本不满足要求,请先升级集群控制面,详情请见 升级集群。容器服务发布的 Kubernetes 版本记录,请参见 Kubernetes 版本发布记录
  • 托管组件拥有如下特性:
  • 不可卸载:作为集群对接云资源的底座,该组件被系统锁定为核心保护状态,以防误删导致业务断网。
  • 全托管维护:该组件的升级、安全补丁以及日常维护均由 VKE 统一自动管理。
  1. 在左侧导航栏中,选择 集群,单击目标集群名称,进入集群管理页面。
  1. 在左侧导航栏中,选择 组件管理,并选择 调度 页签。
  1. 将鼠标移动到组件卡片上,单击 配置,更新组件配置。
  • 参数
    描述
    节点调度策略
    配置节点的 binpack 和 spread 调度策略:
    • binpack:多个 Pod 优先调度在同一节点。综合评估 CPU、内存(Memory)、GPU 算力和显存等资源得分。
    • spread:多个 Pod 分散调度在不同节点。综合评估 CPU、Memory、GPU 算力和显存等资源得分。
    单击 高级配置,配置节点资源(CPU、Memory、GPU 算力和显存)的权重。详细说明,请参见 配置调度器自定义参数
    节点亲和性权重
    配置原生 NodeAffinity 的打分权重,分值越高,通过节点亲和性控制 Pod 调度时的软需求或者偏好的优先级越高。
    仅满足如下版本要求的 scheduler-plugin 组件中支持配置该参数:
    • 组件版本大于等于 v1.0.8。若不满足版本要求,请 升级组件
    • 组件所在集群的 Kubernetes 版本需满足:
    • v1.24.15-vke.30 及以上版本
    • v1.26.10-vke.17 及以上版本
    • v1.28.3-vke.11 及以上版本
    拓扑打散策略权重
    配置原生 PodTopologySpread 调度策略的打分权重,分值越高拓扑打散调度的优先级越高,Pod 越大几率被调度到分散的拓扑区域。
    GPU 卡调度策略
    配置 GPU 显卡的 binpack 和 spread 调度策略:
    • binpack:多个 Pod 优先使用同一张 GPU 显卡。
    • spread:多个 Pod 分散使用不同的 GPU 显卡。
    若您的工作负载中存在 GPU 计算型节点和 GPU 显卡的情况下,节点调度策略GPU 卡调度策略 的组合方式说明,请参见 配置调度器自定义参数
    VCI 库存感知调度
    默认不开启。通过感知 VCI 不同规格实例剩余可供应资源的数量,提升 VCI Pod 创建成功率。
    说明
    VCI 库存感知调度相关说明,请参见 VCI 库存感知调度
    Gang 调度
    默认不开启。Gang 调度满足 All-or-Nothing 调度场景,即一组需要同时调度的 Pod 要么全部调度成功,要么一个都不成功。
    说明
    Gang 调度相关说明,请参见 Gang 调度
    Capacity 调度
    邀测·申请试用】默认不开启,开启后表示通过弹性配额实现多租户间的资源共享,提升整体资源的利用率。
    说明
    Capacity 调度相关说明,请参见 Capacity 调度
    弹性资源优先级调度
    默认不开启,开启后单击 高级配置,设置工作负载 Pod 被调度到不同类型节点资源的顺序,在缩容过程中按照原调度顺序逆序缩容。
    说明
    弹性资源优先级调度的使用方法,请参见 弹性资源优先级调度
    负载感知调度
    默认不开启。负载感知调度根据节点实际资源负载进行调度,避免出现因单个节点负载过高而导致的应用程序或节点故障。
    开启后,按需设置调度参数:
    • 生效范围:选择负载感知调度的生效范围。支持如下两种范围:
    • 全局:集群上的所有 Pod 负载默认使用负载感知调度。
    • 特定 Pod:仅当 Pod 上配置负载感知调度 Annotation 时,才使用负载感知调度。Pod 上配置负载感知调度的方法,请参见 负载感知调度
    注意
    • 集群中若从未开启过负载感知调度,首次开启时,默认全局生效。
    • 如下Kubernetes 版本集群中支持 生效范围 参数配置:
    • 高级配置:负载感知调度的节点资源相关配置。支持如下参数配置:
    • 节点资源利用率阈值:自定义设置节点的 CPU 和 Memory(内存)使用率,负载感知调度按照该设定值对节点进行筛选。
    • 节点打分资源权重:在负载感知调度插件根据资源利用率对节点进行打分时,不同资源维度对应的权重,取值范围为 1~10,权重越大得分越高。
    存储感知调度
    邀测·申请试用】默认不开启。负载感知调度根据节点所具有的存储资源进行调度,需要安装相应的存储 CSI 组件才可以生效。
    NUMA 拓扑感知调度
    邀测·申请试用】默认不开启。拓扑感知调度提供中心调度器与单机协作的拓扑感知调度能力,为负载提供更好的性能。
    说明
    NUMA 拓扑感知调度的使用方法,请参见 NUMA 拓扑感知调度
    RDMA 拓扑感知调度
    默认不开启。根据 RDMA 网卡的网络拓扑信息对 Pod 进行调度,保障同一个 Job 使用的 RDMA 网卡尽可能拓扑接近,提高 Pod 间的 RDMA 通讯性能。
    说明
    • 该功能仅支持在 VPC-CNI 网络模型集群中使用。
  1. 单击 确认,完成配置。
升级组件
系统托管组件无需您关注组件升级问题。系统托管组件可避免用户侧原因导致的组件故障、性能不达预期等问题。减少用户运维成本,增强组件稳定性。
相关文档
最近更新时间:2026.08.13 15:56:30
这个页面对您有帮助吗?
有用
有用
无用
无用