版本:v2.5.0
配置
设备配置:ConfigMap
备注
以下列出的所有配置都在 hami-scheduler-device ConfigMap 中管理。
你可以通过以下方法之一更新这些配置:
-
直接编辑 ConfigMap:如果 HAMi 已成功安装,你可以使用 kubectl edit 命令手动更新 hami-scheduler-device ConfigMap。
kubectl edit configmap hami-scheduler-device -n <namespace>更改后,重启相关的 HAMi 组件以应用更新的配置。
-
修改 Helm Chart:更新 ConfigMap 中的相应值,然后重新应用 Helm Chart 以重新生成 ConfigMap。
参数名 类型 描述 默认值 nvidia.deviceMemoryScaling浮点 NVIDIA 设备显存缩放比例,可以大于 1(启用虚拟设备显存,实验性功能)。对于具有 M 内存的 NVIDIA GPU,若 nvidia.deviceMemoryScaling设置为 S,则 vGPU 在 Kubernetes 中将总共获得S * M内存。1 nvidia.deviceSplitCount整数 分配给单个 GPU 设备的最大任务数。 10 nvidia.migstrategy字符串 "none" 表示忽略 MIG 功能,"mixed" 表示通过独立资源分配 MIG 设备。 "none" nvidia.disablecorelimit字符串 "true" 表示禁用核心限制,"false" 表示启用核心限制。 "false" nvidia.defaultMem整数 当前任务的默认设备显存(MB)。'0' 表示使用 100% 设备显存。 0 nvidia.defaultCores整数 为当前任务保留的 GPU 核心百分比。0 适用于任何具有足够设备显存的 GPU,100 表示独占整个 GPU。 0 nvidia.defaultGPUNum整数 默认 GPU 设备数量,若配置值为 0,则无效并被过滤。若 nvidia.com/gpu未设置,则 webhook 检查nvidia.com/gpumem、resource-mem-percentage、nvidia.com/gpucores