首页
/ Volcano调度器中容量插件对层级队列资源检查的缺陷分析

Volcano调度器中容量插件对层级队列资源检查的缺陷分析

2025-06-12 23:26:00作者:田桥桑Industrious

问题背景

在Volcano调度器的容量插件(capacity plugin)中,存在一个关于层级队列(hierarchical queues)资源分配检查的重要缺陷。该插件当前仅检查叶子队列(leaf queue)的实际容量(real-capability),而忽略了其父队列的资源限制,这可能导致资源分配超出父队列的容量限制。

当前实现的问题

容量插件通过allocatableFn函数在调度会话开始时添加可分配性检查。该函数目前仅验证叶子队列是否有足够资源承载候选任务的资源需求。这种实现存在以下问题:

  1. 层级队列资源溢出风险:当叶子队列通过检查但其父队列资源不足时,系统仍会允许分配,导致父队列资源被超额占用。

  2. 回收(reclaim)动作受阻:当前的检查机制同时用于分配(allocate)和回收(reclaim)动作,在回收场景下可能导致合理的资源回收被错误阻止。

问题示例分析

考虑一个典型的层级队列结构:

  • 根队列(root)有6Gi内存容量
  • 子队列queue1无保障(guarantee)设置
  • queue1有两个子队列queue11和queue12
  • queue12又有子队列queue121

假设queue11已分配4Gi,queue121需要2Gi。当前实现中:

  1. queue121作为叶子队列可以通过容量检查
  2. 但实际分配会导致queue1总分配达到6Gi,超过其实际容量
  3. 同时回收动作会被queue1的容量限制阻止

解决方案探讨

经过深入讨论,我们确定了几个改进方向:

  1. 层级检查机制:需要检查从叶子队列到根队列的完整路径上所有队列的容量限制,而不仅是叶子队列。

  2. 区分分配与回收:为两种操作设计不同的检查逻辑:

    • 分配时需要检查完整路径
    • 回收时只需检查被回收队列的直接父队列
  3. 插件架构调整:考虑将容量检查逻辑从AllocatableFn迁移到Preemptive阶段,使架构更清晰。

技术实现建议

建议采用以下改进方案:

queueAllocatable := func(queue *api.QueueInfo, candidate *api.TaskInfo) bool {
    attr := cp.queueOpts[queue.UID]
    futureUsed := attr.allocated.Clone().Add(candidate.Resreq)
    return futureUsed.LessEqualWithDimension(attr.realCapability, candidate.Resreq)
}

ssn.AddAllocatableFn(cp.Name(), func(queue *api.QueueInfo, candidate *api.TaskInfo) bool {
    if !readyToSchedule {
        return false
    }
    if hierarchyEnabled {
        if !cp.isLeafQueue(queue.UID) {
            return false
        }
        allocatable := queueAllocatable(queue, candidate)
        for _, parentID := range cp.queueOpts[queue.UID].parents {
            if !queueAllocatable(ssn.Queues[parentID], candidate) {
                allocatable = false
                break
            }
        }
        return allocatable
    }
    return queueAllocatable(queue, candidate)
})

总结

Volcano调度器的容量插件需要增强对层级队列的资源检查能力。通过实现完整的队列层级检查机制,并区分分配与回收场景的不同处理逻辑,可以确保系统资源分配的合理性和公平性。这一改进将显著提升调度器在复杂队列结构下的资源管理能力。

登录后查看全文
热门项目推荐
相关项目推荐

热门内容推荐

最新内容推荐

项目优选

收起
openHiTLS-examplesopenHiTLS-examples
本仓将为广大高校开发者提供开源实践和创新开发平台,收集和展示openHiTLS示例代码及创新应用,欢迎大家投稿,让全世界看到您的精巧密码实现设计,也让更多人通过您的优秀成果,理解、喜爱上密码技术。
C
53
468
kernelkernel
deepin linux kernel
C
22
5
nop-entropynop-entropy
Nop Platform 2.0是基于可逆计算理论实现的采用面向语言编程范式的新一代低代码开发平台,包含基于全新原理从零开始研发的GraphQL引擎、ORM引擎、工作流引擎、报表引擎、规则引擎、批处理引引擎等完整设计。nop-entropy是它的后端部分,采用java语言实现,可选择集成Spring框架或者Quarkus框架。中小企业可以免费商用
Java
7
0
RuoYi-Vue3RuoYi-Vue3
🎉 (RuoYi)官方仓库 基于SpringBoot,Spring Security,JWT,Vue3 & Vite、Element Plus 的前后端分离权限管理系统
Vue
878
517
Cangjie-ExamplesCangjie-Examples
本仓将收集和展示高质量的仓颉示例代码,欢迎大家投稿,让全世界看到您的妙趣设计,也让更多人通过您的编码理解和喜爱仓颉语言。
Cangjie
336
1.1 K
ohos_react_nativeohos_react_native
React Native鸿蒙化仓库
C++
180
264
cjoycjoy
一个高性能、可扩展、轻量、省心的仓颉Web框架。Rest, 宏路由,Json, 中间件,参数绑定与校验,文件上传下载,MCP......
Cangjie
87
14
CangjieCommunityCangjieCommunity
为仓颉编程语言开发者打造活跃、开放、高质量的社区环境
Markdown
1.08 K
0
openHiTLSopenHiTLS
旨在打造算法先进、性能卓越、高效敏捷、安全可靠的密码套件,通过轻量级、可剪裁的软件技术架构满足各行业不同场景的多样化要求,让密码技术应用更简单,同时探索后量子等先进算法创新实践,构建密码前沿技术底座!
C
349
381
cherry-studiocherry-studio
🍒 Cherry Studio 是一款支持多个 LLM 提供商的桌面客户端
TypeScript
612
60