首页
/ Harvester集群升级过程中优化升级仓库VM迁移机制

Harvester集群升级过程中优化升级仓库VM迁移机制

2025-06-14 22:07:35作者:范垣楠Rhoda

在Harvester v1.4.2版本中,开发团队针对多节点集群升级场景做出了重要优化,改进了升级仓库虚拟机(virt-launcher-upgrade-repo-hvst-upgrade)的处理方式。这项改进显著提升了集群升级过程的稳定性和可靠性。

问题背景

在之前的Harvester版本中,当执行多节点集群升级时,系统会关闭升级仓库VM。这种做法可能导致以下问题:

  1. 升级过程中出现服务中断
  2. 升级仓库不可用影响其他节点升级
  3. 增加了升级失败的风险

技术改进

新版本实现了更智能的VM迁移机制,主要特点包括:

  1. 动态迁移:升级仓库VM会被自动迁移到其他可用节点,而不是直接关闭
  2. 无缝衔接:确保升级仓库在整个升级过程中持续可用
  3. 资源优化:合理利用集群资源,避免单点故障

实际效果

在3节点KVM集群的测试中,可以观察到:

  • 升级过程中升级仓库VM被成功迁移到其他节点
  • 迁移过程平滑,不影响正在进行的升级操作
  • 所有节点顺利完成升级,没有因仓库不可用导致的问题

技术价值

这项改进为Harvester用户带来了多重好处:

  1. 更高的升级成功率:减少了因仓库不可用导致的升级失败
  2. 更好的用户体验:升级过程更加平滑,减少管理员干预
  3. 更强的系统韧性:提升了集群在升级过程中的容错能力

总结

Harvester团队通过这项优化,展示了其对生产环境稳定性的高度重视。这种对升级过程的持续改进,使得Harvester作为企业级Kubernetes管理平台更加成熟可靠。对于计划升级到v1.4.2版本的用户,这项改进将显著提升升级体验和成功率。

登录后查看全文
热门项目推荐

项目优选

收起
docsdocs
暂无描述
Markdown
827
5.48 K
kernelkernel
openEuler内核是openEuler操作系统的核心,既是系统性能与稳定性的基石,也是连接处理器、设备与服务的桥梁。
C
494
515
ops-nnops-nn
本项目是CANN提供的神经网络类计算算子库,实现网络在NPU上加速计算。
C++
783
1.57 K
pytorchpytorch
作为 Ascend for PyTorch 社区的核心组件,TorchNPU 是昇腾专为 PyTorch 打造的深度学习适配插件,使 PyTorch 框架能够直接调用昇腾 NPU,为开发者提供昇腾 AI 处理器的超强算力。
Python
800
1.14 K
ops-transformerops-transformer
本项目是CANN提供的transformer类大模型算子库,实现网络在NPU上加速计算。
C++
970
2.28 K
kernelkernel
deepin linux kernel
C
32
16
AscendNPU-IRAscendNPU-IR
AscendNPU-IR是基于MLIR(Multi-Level Intermediate Representation)构建的,面向昇腾亲和算子编译时使用的中间表示,提供昇腾完备表达能力,通过编译优化提升昇腾AI处理器计算效率,支持通过生态框架使能昇腾AI处理器与深度调优
C++
480
312
jiuwenswarmjiuwenswarm
JiuwenSwarm 是一款基于openJiuwen开发的智能AI Agent,它能够将大语言模型的强大能力,通过你日常使用的各类通讯应用,直接延伸至你的指尖。
Python
3.01 K
766
cannbot-skillscannbot-skills
CANNBot 是面向 CANN 开发的用于提升开发效率的系列智能体,本仓库为其提供可复用的 Skills 模块。
Markdown
1.26 K
808
cann-learning-hubcann-learning-hub
CANN 学习中心仓,支持在线互动运行、边学边练,提供教程、示例与优化方案,一站式助力昇腾开发者快速上手。
Jupyter Notebook
647
284