首页
/ Harvester集群节点加入失败问题排查与SSL证书配置指南

Harvester集群节点加入失败问题排查与SSL证书配置指南

2025-06-14 08:10:13作者:冯爽妲Honey

问题现象

在Harvester 1.4.0版本环境中,当尝试向现有集群添加第二个节点时,新节点无法正常加入集群。系统日志显示新节点与Kubernetes API Server建立TLS连接时出现证书验证失败的错误:

tls: failed to verify certificate: x509: certificate signed by unknown authority

根本原因分析

该问题通常发生在以下场景:

  1. 集群使用了自定义CA签发的SSL证书
  2. 新节点未正确配置对私有CA证书的信任
  3. 通过域名方式加入节点时,证书的SAN(Subject Alternative Name)未包含对应域名

解决方案

方法一:配置节点信任私有CA

  1. 将私有CA证书文件复制到新节点的指定目录:

    /etc/pki/trust/anchors/harvester-ca.pem
    
  2. 更新系统证书信任库:

    update-ca-certificates
    
  3. 重启相关服务:

    systemctl restart rancher-system-agent
    

方法二:使用IP地址加入节点

如果证书未配置对应域名,可以通过管理节点IP地址方式加入:

  1. 在节点安装界面指定管理节点的IP地址而非域名
  2. 确保证书中包含该IP地址作为SAN

方法三:重新配置集群证书

  1. 在Harvester管理界面更新证书,确保包含:

    • 所有节点IP地址
    • 使用的域名
    • 集群内部使用的服务名称
  2. 使用包含完整SAN信息的证书重新配置集群

最佳实践建议

  1. 部署前规划好证书方案,建议使用以下SAN配置:

    • 管理节点IP
    • 所有可能使用的域名
    • 服务名称(如kubernetes.default.svc)
  2. 对于生产环境,建议:

    • 使用专业CA机构签发的证书
    • 确保证书有效期足够长
    • 维护完整的证书更新流程
  3. 测试环境可考虑:

    • 使用自签名证书时提前部署CA到所有节点
    • 使用IP地址简化证书配置

验证步骤

  1. 检查节点连接状态:

    kubectl get nodes
    
  2. 验证证书信任链:

    openssl s_client -connect <管理节点>:443 -showcerts
    
  3. 检查系统服务状态:

    systemctl status rancher-system-agent
    

通过以上方法,可以解决因SSL证书配置不当导致的节点加入失败问题,确保Harvester集群的稳定运行。

登录后查看全文
热门项目推荐

项目优选

收起
kernelkernel
deepin linux kernel
C
32
16
pytorchpytorch
Ascend Extension for PyTorch
Python
746
927
flutter_flutterflutter_flutter
本仓库是 Flutter SDK 与 Flutter Engine 的 OpenHarmony 适配版本,由 CPF-Flutter 团队维护。开发者可使用熟悉的 Flutter 技术栈开发 OpenHarmony 应用,3.35.7 及以后的适配版本可基于本仓库源码构建支持 OpenHarmony 的 Flutter Engine。
Dart
1.02 K
267
docsdocs
暂无描述
Dockerfile
771
5.03 K
ops-transformerops-transformer
本项目是CANN提供的transformer类大模型算子库,实现网络在NPU上加速计算。
C++
867
1.97 K
leetcodeleetcode
🔥LeetCode solutions in any programming language | 多种编程语言实现 LeetCode、《剑指 Offer(第 2 版)》、《程序员面试金典(第 6 版)》题解
Java
70
22
atomcodeatomcode
Claude Code 的开源替代方案。连接任意大模型,编辑代码,运行命令,自动验证 — 全自动执行。用 Rust 构建,极致性能。 | An open-source alternative to Claude Code. Connect any LLM, edit code, run commands, and verify changes — autonomously. Built in Rust for speed. Get Started
Rust
1.94 K
202
ops-nnops-nn
本项目是CANN提供的神经网络类计算算子库,实现网络在NPU上加速计算。
C++
694
1.36 K
kernelkernel
openEuler内核是openEuler操作系统的核心,既是系统性能与稳定性的基石,也是连接处理器、设备与服务的桥梁。
C
465
456
Cangjie-ExamplesCangjie-Examples
本仓将收集和展示高质量的仓颉示例代码,欢迎大家投稿,让全世界看到您的妙趣设计,也让更多人通过您的编码理解和喜爱仓颉语言。
C
458
5.25 K