请求 HAMi 资源

HAMi 资源通过 Kubernetes 资源 requests 和 limits 进行请求。资源名称取决于后端和产品配置。

如果需要确认工作负载应使用 NVIDIA GPU 上的 HAMi、Ascend NPU 上的 HAMi,还是 Ascend vNPU 上的 HAMi,请先查看 后端路径

在创建工作负载之前,请确认当前交付包和后端配置中的实际资源 key。节点可分配资源可用于确认数量容量;仅用于调度的 memory 和 core key 可能只会出现在后端配置中。

kubectl get node <node-name> -o jsonpath='{.status.allocatable}'

在工作负载的 requests、limits 和 ACP 配额元数据中使用相同的 key。对于扩展资源,请在 requestslimits 中设置相同的值。

选择工作负载清单

每种后端场景都有其可运行的 Pod 结构和结果解读方式:

工作负载路径清单和检查
NVIDIA 整卡或共享 GPUHAMi on NVIDIA GPU
Ascend 整卡HAMi on Ascend NPU
Ascend 硬切片或软切片HAMi on Ascend vNPU

有关 key 的含义和单位,请参阅 Resource Keys。有关可选的 NVIDIA annotations、调度策略以及 HAMi-Core 调试设置,请参阅 Workload Controls。有关 HAMi 管理的动态 MIG,请参阅 Configure Dynamic MIG

ACP 配额和应用页面

在集群中注册了相应的资源元数据后,ACP 可以在项目、命名空间和工作负载页面中显示 HAMi 资源字段。请参阅 加速器资源配额

避免混合分配路径

除非当前产品版本明确支持组合使用,否则不要在同一个工作负载中混用来自不同加速器共享或直接分配路径的资源名称。如果某个节点为同一物理设备同时暴露了 direct 和 HAMi 资源名称,请在创建工作负载之前先解决 Device Plugin 的所有权冲突。