兼容性

使用此页面检查 Alauda Build of HAMi 支持的后端范围。此范围并不等同于完整的上游 HAMi 或厂商硬件矩阵。

支持的后端范围

后端状态说明
NVIDIA GPU支持使用 HAMi 资源键,例如 nvidia.com/gpuallocnvidia.com/gpucoresnvidia.com/gpumem
Ascend NPU后端支持取决于产品包请使用 Ascend NPU 上的 HAMi 以及当前产品包或版本页面,以确认目标 ACP 版本。
Ascend vNPU后端支持取决于产品包仅当已安装产品包明确支持目标硬件和 ACP 版本时,才使用 Ascend vNPU 上的 HAMi
其他社区后端不在当前 Alauda 支持范围内上游后端或配置中的设备条目,本身并不意味着该后端组合就是 Alauda 支持的产品组合。

ACP 兼容性

请检查发布包,以确认支持的 ACP 版本、Kubernetes 版本、后端驱动版本、运行时集成和 exporter 版本。

下表仅包含产品支持的组合。更广泛的后端细节请参考上游 HAMi 或硬件厂商文档。

支持的组合

后端路径组件组合架构ACP 版本能力
基于 NPU Operator 的 HAMi Ascend 分配Alauda Build of NPU Operator v26.6.0、Alauda Build of HAMi v2.9.0,以及 Alauda Build of HAMi Ascend Device Plugin v1.4.0ARM64v4.0-v4.3通过按型号区分的 huawei.com/Ascend* 资源键,对 Ascend 310P3 和 Ascend 910 系列设备进行整卡分配,以及技术预览版硬切分/软切分。NPU Operator 保留 Driver 和 Runtime,但会禁用其原生 Device Plugin。

v1.4.0 中的硬切分和软切分属于技术预览能力。硬切分存在一个已知的清理竞争条件,可能会在工作负载首次访问 vNPU 之前回收它。若需要稳定的设备访问,请使用整卡分配。使用 KVM 或容器化 Driver 的 HAMi 切分不在当前支持范围内。请参阅 v1.4.0 已知限制

已安装的 scheduler 配置为 Ascend 310P3 和 Ascend 910 系列设备提供按型号区分的映射,包括 910A、910B2、910B3、910B4-1、910B4 和 910C。Kubernetes 资源键是根据此映射派生的,而不是直接来自硬件营销名称。请检查 hami-scheduler-device 和目标节点的 allocatable 资源,以获取已安装组合的实际键值。

Ascend Driver 和 CANN 兼容性

HAMi Ascend Device Plugin v1.4.0 需要 Ascend Driver 25.5 或更高版本。Driver 版本只是一个兼容性门槛:工作负载镜像中的 CANN 库也必须与已安装的 Driver 兼容,并且在软切分场景下,还必须与 HAMi 注入的 libvnpu.so 兼容。

对于 hami-core 软切分,工作负载镜像中的 CANN runtime 必须提供注入的 libvnpu.so 所需的符号。若工作负载镜像不提供 rtStreamGetCaptureInfo,则无法使用此软切分路径。该约束仅适用于软切分 runtime ABI,并不能单独决定同一镜像是否可以使用整卡分配。

不要仅根据可变镜像标签、调度成功或 Pod Running 状态来推断兼容性。请记录工作负载镜像 digest,确认该镜像推荐使用的 Driver 和 CANN 组合,并在接受该环境之前执行一次具有代表性的 CANN 设备打开、内存分配或推理操作。

避免设备暴露重叠

在启用由 HAMi 管理的 Ascend 分配之前,请将 NPUOperatorCtl.spec.devicePlugin.enabled 设置为 false,并等待原生 ascend-device-plugin 退出目标节点。保留 NPU Operator Driver、OCI Runtime、RuntimeClass 和其他必需的基础组件继续运行。有关场景矩阵,请使用 选择 HAMi 部署场景;有关维护步骤,请使用 切换 Ascend Device Plugin 所有者