DRA
Dynamic Resource Allocation (DRA) 是一种 Kubernetes 机制,用于通过 resource claim 对象请求和分配设备。它并不只是 GPU 专属能力。
在 ACP 中,DRA 通过产品驱动程序使用。DRA driver 是 DRA 机制的一种实现,而不是该机制本身。
它如何影响工作负载
当满足以下情况时,DRA 相关:
- 工作负载使用
ResourceClaim或ResourceClaimTemplate,而不是仅使用扩展资源名称; - 加速器产品文档中提到
DeviceClass、ResourceSlice或基于 claim 的分配; - 集群同时存在基于传统 Device Plugin 的产品和基于 DRA 的产品,并且你需要确定工作负载使用的是哪条分配路径。
产品文档
使用本页面了解 DRA 对工作负载资源请求的含义,以及如何将 DRA 与传统的基于 Device Plugin 的分配方式区分开来。有关 DRA driver 的安装、Kubernetes 版本要求、feature gate、节点标签、claim 示例、验证和故障排查,请参阅产品文档。
相关产品
仅当相应的 Alauda 产品或 package 明确支持 DRA driver 时,才应在产品站点中记录该 DRA driver。
- 厂商 DRA driver 属于对应的厂商集成。
- HAMi DRA driver 属于 HAMi 的共享和调度路径,因为 HAMi 负责共享、虚拟化、调度以及资源语义。
- 未来的 GPU、NPU 或其他加速器产品也可能使用 DRA。