解决由于辅助节点在 RPMDB 重建阶段停止响应而导致的集群升级停止问题。该过程涉及将集群缩减为单个已升级节点,以及对其进行克隆以还原集群。
问题
在 Omnissa Access 集群升级期间,辅助节点停滞不前,并在 successfully rebuilt RPMDB 阶段保持无响应。无法建立与受影响节点的新 SSH 连接。集群中的其他节点可能已成功完成升级。
原因
RPM 数据库重建过程中出现的特定于节点的环境问题阻止在受影响的节点上完成升级。
解决方案
-
在进行更改之前,生成每个集群节点的快照。
**注意:**如果您的部署使用外部数据库,请先备份该数据库,然后再继续操作。
-
关闭一个或多个无响应节点的电源。
-
在工作节点上,确认升级已成功完成,然后生成已升级节点的快照。
-
在 vCenter 中,为每个已关闭电源的节点克隆一次已升级的节点。
-
对于每个克隆的节点,在 vCenter 中打开虚拟机设置,然后更新网络适配器 MAC 地址,使其与要替换的原始节点的 MAC 地址相匹配。
-
打开克隆节点的电源,然后以
root身份登录。 -
使用此节点的正确 IP 地址和主机名更新
/etc/hosts文件。 -
运行
sudo ln -sf /run/systemd/resolve/resolv.conf /etc/resolv.conf以还原 DNS 解析器配置。 -
编辑
/etc/systemd/network/10-eth0.network文件,并将 IP 地址设置为此节点的正确地址。 -
编辑
/etc/hostname文件,并将现有条目替换为此节点的正确主机名。 -
重新引导节点。
-
确认重新配置的节点已成功加入集群,并且所有 Omnissa Access 服务都在运行。
**注意:**对其他克隆的每个节点重复执行步骤 5 至 12。
此页面对您有帮助吗?