资源键

HAMi 资源键取决于后端。请使用已安装产品包提供并验证的键。

先选择后端路径:

NVIDIA 后端

Resource key含义单位
nvidia.com/gpualloc作为分配基数使用的物理 GPU 数量count
nvidia.com/gpucores每个物理 GPU 请求的计算比例percent
nvidia.com/gpumem每个物理 GPU 请求的内存Mi
nvidia.com/gpumem-percentage每个物理 GPU 请求的内存比例percent

在容器中使用 nvidia.com/gpumemnvidia.com/gpumem-percentage 其中之一,不要同时使用两者。

有关 NVIDIA 后端工作负载注解和环境变量,请参见 Workload Controls

相关 NVIDIA 键

某些环境中还可能包含来自其他 NVIDIA 共享技术的资源键,例如 MPS 或旧版 vCUDA 资源。除非产品文档明确支持该组合,否则不要在同一工作负载中将这些键与 HAMi 资源键混用。

节点标签

Label目的
gpu=on在通用 NVIDIA 后端安装路径中,选择用于 HAMi 组件的节点。

如果需要在不使用 HAMi 共享语义的情况下进行 NVIDIA 物理 GPU 分配,请使用 Alauda Build of NVIDIA GPU Device Pluginnvidia.com/gpu 资源键。

Ascend 后端

Ascend NPU 和 Ascend vNPU 资源键是特定于型号的。它们可能使用与直接 Ascend NPU 路径相同的 huawei.com/Ascend* 命名空间,因此只能有一个 Device Plugin 拥有一组 Ascend 设备。

HAMi v2.9.0 和 HAMi Ascend Device Plugin v1.4.0 对 Ascend 310P3 硬件使用以下资源族:

Resource key含义单位
huawei.com/Ascend310P作为分配基数使用的物理设备数量。进行整卡分配时仅请求此键。count
huawei.com/Ascend310P-memory硬切片或软切片时每个虚拟设备请求的内存。Mi
huawei.com/Ascend310P-core仅由 hami-core 软切片使用的计算份额。percent

Ascend 910 系列设备使用特定于型号的资源族,例如 huawei.com/Ascend910Ahuawei.com/Ascend910B3huawei.com/Ascend910B4-1,并由已安装的调度器配置定义相应的 -memory-core 键。请从 hami-scheduler-device 获取准确的 count、memory、core 和分配注解名称。使用节点可分配资源确认 count 容量;仅供调度器使用的 memory 和 core 键可能不会显示在那里。

诸如 vir01 的硬切片模板名称是运行时模板值,不是 Kubernetes 资源键。可用模板和内存大小因型号而异。Ascend 310P3 示例请参见 运行硬切片工作负载

节点标签

Label目的
ascend=on在通用 Ascend NPU 和 Ascend vNPU 后端示例中,选择用于 HAMi Ascend 组件的节点。

不要假设芯片产品名称与 Kubernetes 资源键是同一个字符串。例如,Ascend 910 系列节点可能会根据已安装的产品包暴露 huawei.com/Ascend910Ahuawei.com/Ascend910B3 或其他 huawei.com/Ascend* 键。

安装后,请检查调度器配置,并在所选节点上确认 count 资源:

kubectl -n <hami-namespace> get configmap hami-scheduler-device -o yaml
kubectl get node <node-name> -o jsonpath='{.status.allocatable}'

仅使用与 hami-scheduler-device 中目标硬件映射匹配的资源族,并在创建工作负载之前确认节点报告的 count 容量符合预期。

ACP 配额字段

如果 ACP 配额页面需要显示 HAMi 资源,请配置匹配的 ACP 资源元数据。使用与用户在工作负载中请求的相同键注册 ACP 配额元数据。请参见 加速器资源配额