Kata Containers中VFIO设备直通的技术实现与优化
2025-06-04 15:55:11作者:董灵辛Dennis
背景介绍
在云原生环境中,Kata Containers作为一种轻量级虚拟机运行时,为用户提供了更强的隔离性和安全性。其中,VFIO(Virtual Function I/O)设备直通技术允许虚拟机直接访问物理设备,这对于高性能计算、GPU加速和存储加速等场景至关重要。
技术挑战
在Kubernetes环境中实现VFIO设备直通面临两个关键阶段:
- 冷插拔阶段:在创建sandbox虚拟机时将VFIO设备添加到客户机
- 资源分配阶段:通过k8s设备插件将VFIO设备资源分配给特定容器
由于k8s设备插件仅在容器创建时生效,如果没有预先将VFIO设备冷插拔到sandbox虚拟机中,设备插件将无法正常工作。
现有解决方案的问题
目前常见的配置方式是通过containerd配置文件传递CDI(Container Device Interface)注解,例如:
[plugins."io.containerd.grpc.v1.cri".containerd.runtimes.kata-qemu]
runtime_type = "io.containerd.kata-qemu.v2"
privileged_without_host_devices = true
pod_annotations = ["io.katacontainers.*", "cdi.k8s.io/vfio*"]
这种方式会在sandbox创建时触发CDI功能,基于配置文件注入VFIO设备。然而,同样的注解会存在于容器spec中,导致在容器创建时再次触发CDI注入,从而产生错误。
技术优化方案
社区开发者提出了一个有效的解决方案:在将设备注入ociSpec后,删除外部的CDI设备注解。具体实现如下:
// 一旦我们将设备注入到ociSpec中,就不再需要来自外部运行时的CDI设备注解
// 运行时将根据设备创建适当的内层运行时CDI注解
for key := range spec.Annotations {
if strings.HasPrefix(key, cdi.AnnotationPrefix) {
delete(spec.Annotations, key)
}
}
这一修改确保了:
- 在sandbox创建阶段正确注入VFIO设备
- 避免了容器创建时的重复注入问题
- 保持了设备分配的准确性
vfio_mode参数的影响
在实际应用中,vfio_mode参数的设置会影响CDI设备的处理方式:
vfio_mode="vfio":VFIO设备未经修改直接传递给容器,适用于DPDK等用例vfio_mode="guest-kernel":设备以不同方式呈现给客户机内核
实践验证
开发者通过以下命令验证了解决方案的有效性:
sudo nerdctl run --runtime io.containerd.kata.v2 \
--label cdi.k8s.io/vfio="nvidia.com/pgpu=0" \
-it --rm $image nvidia-smi
验证结果显示GPU设备被正确识别和使用,同时避免了重复注入的问题。
总结
Kata Containers社区通过优化CDI注解处理机制,有效解决了VFIO设备在Kubernetes环境中的直通问题。这一改进使得高性能设备能够更可靠地在容器化环境中使用,为AI训练、高性能计算等场景提供了更好的支持。
对于使用者来说,只需更新到包含此修复的版本,即可享受更稳定的VFIO设备直通体验,无需担心注解冲突导致的设备注入问题。
登录后查看全文
热门项目推荐
相关项目推荐
GLM-5智谱 AI 正式发布 GLM-5,旨在应对复杂系统工程和长时域智能体任务。Jinja00
GLM-5-w4a8GLM-5-w4a8基于混合专家架构,专为复杂系统工程与长周期智能体任务设计。支持单/多节点部署,适配Atlas 800T A3,采用w4a8量化技术,结合vLLM推理优化,高效平衡性能与精度,助力智能应用开发Jinja00
jiuwenclawJiuwenClaw 是一款基于openJiuwen开发的智能AI Agent,它能够将大语言模型的强大能力,通过你日常使用的各类通讯应用,直接延伸至你的指尖。Python0193- QQwen3.5-397B-A17BQwen3.5 实现了重大飞跃,整合了多模态学习、架构效率、强化学习规模以及全球可访问性等方面的突破性进展,旨在为开发者和企业赋予前所未有的能力与效率。Jinja00
AtomGit城市坐标计划AtomGit 城市坐标计划开启!让开源有坐标,让城市有星火。致力于与城市合伙人共同构建并长期运营一个健康、活跃的本地开发者生态。01
awesome-zig一个关于 Zig 优秀库及资源的协作列表。Makefile00
项目优选
收起
deepin linux kernel
C
27
12
OpenHarmony documentation | OpenHarmony开发者文档
Dockerfile
602
4.04 K
🔥LeetCode solutions in any programming language | 多种编程语言实现 LeetCode、《剑指 Offer(第 2 版)》、《程序员面试金典(第 6 版)》题解
Java
69
21
Ascend Extension for PyTorch
Python
442
531
AscendNPU-IR是基于MLIR(Multi-Level Intermediate Representation)构建的,面向昇腾亲和算子编译时使用的中间表示,提供昇腾完备表达能力,通过编译优化提升昇腾AI处理器计算效率,支持通过生态框架使能昇腾AI处理器与深度调优
C++
112
170
🎉 (RuoYi)官方仓库 基于SpringBoot,Spring Security,JWT,Vue3 & Vite、Element Plus 的前后端分离权限管理系统
Vue
1.46 K
825
本项目是CANN提供的数学类基础计算算子库,实现网络在NPU上加速计算。
C++
922
770
暂无简介
Dart
847
204
React Native鸿蒙化仓库
JavaScript
321
375
openGauss kernel ~ openGauss is an open source relational database management system
C++
174
249