实验 9: 使用 Kueue 管理 HAMi vGPU 队列
本实验把 HAMi GPU 切分与 Kueue 准入控制接到一起。HAMi 为 Pod 分配显存和算力切片,Kueue 在 Job 准入前统计这些切片。你将提交三个相同规格的 Job:前两个正常运行,第三个因为 vGPU、显存和算力配额已经用完而保持挂起。
文中的输出来自一套实际环境:Kubernetes 1.36.1、containerd 2.2.4、Kueue 0.18.1、HAMi 2.9.0,GPU 为一张 15 GiB Tesla T4。
版本相关的 API
本实验使用 Kueue 0.18.1 提供的 v1beta2 API 和 ResourceTransformation 配置。若使用其他 Kueue 版本,请先核对对应版本的发布说明。
你将学到什么
- 以 DRA 兼容模式安装 HAMi 2.9.0;
- 验证
4 GiB / 50%扩展资源请求如何转换为 DRAResourceClaim; - 把 HAMi 按单个 vGPU 表达的显存和算力请求转换成 Kueue 总量配额;
- 在准入阶段挂起超额 Job,避免 Pod 进入调度阶段后才 Pending。