runc项目在cgroup v1 rootless模式下共享PID命名空间的容器删除问题分析
问题背景
在容器技术中,runc作为低级别的容器运行时工具,负责实际创建和运行容器。近期在runc v1.2.0-rc.3版本中发现了一个特定场景下的功能退化问题:当在cgroup v1环境下以非root用户(rootless)运行容器,并且容器间共享PID命名空间时,使用nerdctl rm -f命令删除容器会出现挂起现象。
问题现象
具体表现为:
- 首先创建一个名为foo的基础容器
- 然后创建一个名为bar的容器,与foo共享PID命名空间
- 当尝试使用
nerdctl rm -f bar强制删除bar容器时,命令会挂起
值得注意的是,这个问题仅在特定环境下出现:
- Ubuntu 20.04系统(使用cgroup v1)
- 以非root用户(rootless)运行
- 使用runc v1.2.0-rc.3版本
而在其他环境中则表现正常,包括:
- 相同系统但使用cgroup v2
- 以root用户运行
- 使用runc v1.1.14版本
技术分析
根本原因
经过排查,这个问题是由于runc在v1.2.0-rc.3版本中对信号处理逻辑的修改引起的。具体来说,commit 9583b3d1c297021109081872c52302316ede15b1中"libct: move killing logic to container.Signal"的改动导致了此问题。
在cgroup v1 rootless模式下,当容器共享PID命名空间时,runc kill命令无法简单地杀死容器初始化进程(因为共享PID命名空间后,该进程不再是PID 1)。理论上,它应该杀死容器cgroup中的所有进程。然而,在rootless模式下,cgroup v1可能无法正确设置或访问,导致无法完成这一操作。
运行机制差异
有趣的是,虽然nerdctl rm -f bar会挂起,但分步执行nerdctl stop bar && nerdctl rm bar却能正常工作。这是因为两种操作虽然最终都会调用runc kill命令,但执行路径和时序有所不同:
- 直接
rm -f尝试立即强制终止容器,在cgroup v1 rootless环境下遇到进程终止问题 - 分步操作可能给了容器更优雅的终止机会,或者时序差异避免了竞争条件
解决方案
针对这个问题,社区提出了几种可能的解决方案:
-
代码修复:通过PR #4395修复了信号处理逻辑,使runc能够正确处理这种特殊情况
-
配置限制:从设计角度考虑,可以在runc run/start时就检测并阻止这种不支持的配置组合(cgroup v1 + rootless + 共享PID命名空间)
-
警告机制:在不完全禁止的情况下,至少应该向用户发出警告,提示这种配置可能存在问题
技术建议
对于用户和开发者,建议:
- 如果必须使用cgroup v1 rootless模式,避免容器间共享PID命名空间
- 考虑升级到cgroup v2环境,它提供了更好的rootless支持
- 在关键生产环境中,充分测试特定版本的runc与容器管理工具(如nerdctl)的兼容性
- 关注runc项目的更新,及时应用相关修复
总结
这个问题展示了容器技术中权限模型、cgroup版本和命名空间交互的复杂性。特别是在rootless场景下,由于权限限制,某些操作可能无法按预期工作。作为开发者,需要理解这些底层机制;作为用户,则需要选择适合自己环境的配置和工具版本。
atomcodeClaude Code 的开源替代方案。连接任意大模型,编辑代码,运行命令,自动验证 — 全自动执行。用 Rust 构建,极致性能。 | An open-source alternative to Claude Code. Connect any LLM, edit code, run commands, and verify changes — autonomously. Built in Rust for speed. Get StartedRust0153- DDeepSeek-V4-ProDeepSeek-V4-Pro(总参数 1.6 万亿,激活 49B)面向复杂推理和高级编程任务,在代码竞赛、数学推理、Agent 工作流等场景表现优异,性能接近国际前沿闭源模型。Python00
LongCat-Video-Avatar-1.5最新开源LongCat-Video-Avatar 1.5 版本,这是一款经过升级的开源框架,专注于音频驱动人物视频生成的极致实证优化与生产级就绪能力。该版本在 LongCat-Video 基础模型之上构建,可生成高度稳定的商用级虚拟人视频,支持音频-文本转视频(AT2V)、音频-文本-图像转视频(ATI2V)以及视频续播等原生任务,并能无缝兼容单流与多流音频输入。00
auto-devAutoDev 是一个 AI 驱动的辅助编程插件。AutoDev 支持一键生成测试、代码、提交信息等,还能够与您的需求管理系统(例如Jira、Trello、Github Issue 等)直接对接。 在IDE 中,您只需简单点击,AutoDev 会根据您的需求自动为您生成代码。Kotlin03
Intern-S2-PreviewIntern-S2-Preview,这是一款高效的350亿参数科学多模态基础模型。除了常规的参数与数据规模扩展外,Intern-S2-Preview探索了任务扩展:通过提升科学任务的难度、多样性与覆盖范围,进一步释放模型能力。Python00
skillhubopenJiuwen 生态的 Skill 托管与分发开源方案,支持自建与可选 ClawHub 兼容。Python0112