【k8s集群Docker + cri-dockerd】服务器重启或关机后 apiserver/controller/scheduler 无法自动恢复

说明:

一、我在使用 Kubernetes 集群时遇到一个启动依赖问题,具体表现如下:

1)服务器重启后,控制平面组件(kube-apiserver、kube-controller-manager、kube-scheduler)无法自动恢复,导致整个集群不可用。

2)底层容器运行时使用的是 Docker,并通过 cri-dockerd 作为 CRI 接口桥接 kubelet 与 Docker,三者存在明确的依赖关系:

kubelet ------> cri-dockerd ------> docker。

3)目前我通过配置 systemd 依赖(如 After=cri-dockerd.service)和环境变量,已实现"服务器重启"后集群自动恢复。

4)但 在"关机后再开机"的场景下,这些控制平面 Pod 依然无法自动拉起,必须手动执行以下命令才能恢复集群:

二、请问大家是如何彻底解决这个问题的?

1)是否有一种方案,能让 Kubernetes 控制平面在 无论是重启还是关机再开机 的情况下,都能自动、可靠地恢复,且上层业务应用可正常访问?

如果您的环境中已经稳定解决了该问题,欢迎在评论区分享您的配置或思路,非常感谢各位大牛

2)问题如下图所示:


解决办法:

powershell 复制代码
1、master、worker都要更改kubelet服务
vi /usr/lib/systemd/system/kubelet.service
# 将以下选项注释,
#Wants=network-online.target
#After=network-online.target

# 添加上以下选项
Wants=cri-dockerd.service
After=cri-dockerd.service

最终结果如下图所示
root@master01:~# cat /usr/lib/systemd/system/kubelet.service
[Unit]
Description=kubelet: The Kubernetes Node Agent
Documentation=https://kubernetes.io/docs/
#Wants=network-online.target
#After=network-online.target
Wants=cri-dockerd.service
After=cri-dockerd.service

[Service]
ExecStart=/usr/bin/kubelet
Restart=always
StartLimitInterval=0
RestartSec=10

[Install]
WantedBy=multi-user.target

# 重启服务
systemctl daemon-reload
systemctl restart kubelet

说明:
1)这个方法只能解决服务器重启后,k8s集群自动恢复正常
2)如果是关闭服务器,再开机启动服务器,k8s集群服务只能手动执行命令恢复

2、执行命令恢复k8s集群(master、worker都要执行)
# 重启服务
systemctl restart docker cri-docker kubelet

# 查看状态
systemctl status docker cri-docker kubelet --no-pager -l

# 验证k8s集群
netstat -tnlpu
kubectl get po -A


相关推荐
2401_8346369918 小时前
Linux 负载均衡全实战:Nginx+HAProxy+LVS 从原理到落地
linux·nginx·负载均衡
鹏大师运维1 天前
为什么信创电脑装软件总提示“软件包架构不匹配”?
linux·运维·架构·国产化·麒麟·deb·统信uos
007张三丰1 天前
软件测试专栏(11/20):测试框架开发:pytest深度解析与插件体系
运维·服务器·自动化测试·pytest·测试框架
weixin_604236671 天前
华三 路由器 极简核心配置
运维·服务器·网络·h3c·h3c路由器
鹤落晴春1 天前
【Linux复习】管理SELinux安全性
linux·运维·服务器
yz_aiks1 天前
Linux Jar包配置Systemd自启动实战:从排查到配置全流程
linux·python·jar·自启动·systemd
AI智图坊1 天前
多件装组合SKU图的批量生产效率分析:从PS手工到AI自动化的工作流改造
大数据·运维·人工智能·gpt·ai作画·自动化·aigc
bjzhang751 天前
CentOS下安装MySQL详解
linux·mysql·centos
鹤落晴春1 天前
【K8s】Pod调度、configMaps
云原生·容器·kubernetes
Jason_chen1 天前
Linux 6.2 音频机制深度解析:AI驱动的低延迟音频与零信任音频安全架构
linux