k8s部署問題解決方案(節(jié)點(diǎn)狀態(tài)為 NotReady)
問題
使用kubectl get nodes查看已加入的節(jié)點(diǎn)時,出現(xiàn)了Status為NotReady的情況。
root@master1:~# kubectl get nodes NAME STATUS ROLES AGE VERSION master1 NotReady master 152m v1.18.1 worker1 NotReady <none> 94m v1.18.1
這種情況是因?yàn)橛心承╆P(guān)鍵的 pod 沒有運(yùn)行起來,首先使用如下命令來看一下kube-system的 pod 狀態(tài):
kubectl get pod -n kube-system
NAME READY STATUS RESTARTS AGE coredns-bccdc95cf-792px 1/1 Pending 0 3h11m coredns-bccdc95cf-bc76j 1/1 Pending 0 3h11m etcd-master1 1/1 Running 2 3h10m kube-apiserver-master1 1/1 Running 2 3h11m kube-controller-manager-master1 1/1 Running 2 3h10m kube-flannel-ds-amd64-9trbq 0/1 ImagePullBackoff 0 133m kube-flannel-ds-amd64-btt74 0/1 ImagePullBackoff 0 174m kube-proxy-27zfk 1/1 Pending 2 3h11m kube-proxy-lx4gk 1/1 Pending 0 133m kube-scheduler-master1 1/1 Running 2 3h11m
如上,可以看到 pod kube-flannel 的狀態(tài)是ImagePullBackoff,意思是鏡像拉取失敗了,所以我們需要手動去拉取這個鏡像。這里可以看到某些 pod 運(yùn)行了兩個副本是因?yàn)槲矣袃蓚€節(jié)點(diǎn)存在了。
你也可以通過kubectl describe pod -n kube-system <服務(wù)名>來查看某個服務(wù)的詳細(xì)情況,如果 pod 存在問題的話,你在使用該命令后在輸出內(nèi)容的最下面看到一個[Event]條目,如下:
root@master1:~# kubectl describe pod kube-flannel-ds-amd64-9trbq -n kube-system ... Events: Type Reason Age From Message ---- ------ ---- ---- ------- Normal Killing 29m kubelet, worker1 Stopping container kube-flannel Warning FailedCreatePodSandBox 27m (x12 over 29m) kubelet, worker1 Failed create pod sandbox: rpc error: code = Unknown desc = failed to create a sandbox for pod "kube-flannel-ds-amd64-9trbq": Error response from daemon: cgroup-parent for systemd cgroup should be a valid slice named as "xxx.slice" Normal SandboxChanged 19m (x48 over 29m) kubelet, worker1 Pod sandbox changed, it will be killed and re-created. Normal Pulling 42s kubelet, worker1 Pulling image "quay.io/coreos/flannel:v0.11.0-amd64"
手動拉取鏡像
flannel的鏡像可以使用如下命令拉到,如果你是其他鏡像沒拉到的話,百度一下就可以找到國內(nèi)的鏡像源地址了,這里記得把最后面的版本號修改成你自己的版本,具體的版本號可以用上面說的kubectl describe命令看到:
拉去鏡像:
docker pull quay-mirror.qiniu.com/coreos/flannel:v0.11.0-amd64
等鏡像拉取完了之后需要把鏡像名改一下,改成 k8s 沒有拉到的那個鏡像名稱,我這里貼的鏡像名和版本和你的不一定一樣,注意修改:
docker tag quay-mirror.qiniu.com/coreos/flannel:v0.11.0-amd64 quay.io/coreos/flannel:v0.11.0-amd64
修改完了之后過幾分鐘 k8s 會自動重試,等一下就可以發(fā)現(xiàn)不僅flannel正常了,其他的 pod 狀態(tài)也都變成了Running,這時再看 node 狀態(tài)就可以發(fā)現(xiàn)問題解決了:
[kubeadm@server1 ~]$ kubectl get nodes NAME STATUS ROLES AGE VERSION server1 Ready master 150m v1.18.1 server2 Ready <none> 150m v1.18.1 server3 Ready <none> 150m v1.18.1 [kubeadm@server1 ~]$

總結(jié)
以上為個人經(jīng)驗(yàn),希望能給大家一個參考,也希望大家多多支持腳本之家。
相關(guān)文章
k8s中如何實(shí)現(xiàn)pod自動擴(kuò)縮容詳解
在實(shí)際生產(chǎn)系統(tǒng)中,經(jīng)常會遇到某個服務(wù)需要擴(kuò)容的場景,可能會遇到由于資源緊張或者工作負(fù)載降低而需要減少服務(wù)實(shí)例數(shù)量的場景,下面這篇文章主要給大家介紹了關(guān)于k8s中如何實(shí)現(xiàn)pod自動擴(kuò)縮容的相關(guān)資料,需要的朋友可以參考下2022-08-08
Kubernetes從私有鏡像倉庫拉取容器鏡像時的身份驗(yàn)證方式
Kubernetes從私有鏡像倉庫拉取容器鏡像時,需要使用私有倉庫的憑證進(jìn)行身份驗(yàn)證,這些憑證可以存儲在`private-registry-auth`這個Secret中,然后在Pod或ServiceAccount中指定使用該Secret,這樣可以確保Pod在拉取鏡像時能夠正確進(jìn)行身份驗(yàn)證2026-01-01
K8s解決主機(jī)重啟后kubelet無法自動啟動問題(推薦)
在安裝配置好Kubernetes后,正常情況下服務(wù)器關(guān)機(jī)重啟,kubelet也會自動啟動的,如何解決這個問題呢,下面小編給大家?guī)砹薑8s解決主機(jī)重啟后kubelet無法自動啟動問題,感興趣的朋友一起看看吧2022-08-08
使用k8tz解決pod內(nèi)的時區(qū)問題(坑的解決)
時區(qū)的不一致,會帶來很多困擾。即使代碼與時區(qū)無關(guān),但容器日志與系統(tǒng)日志時間相關(guān)聯(lián)排查問題也會讓人頭疼,這篇文章主要介紹了使用k8tz優(yōu)雅的解決pod內(nèi)的時區(qū)問題,需要的朋友可以參考下2022-10-10
關(guān)于CentOS7日志文件及journalctl日志查看方法
這篇文章主要介紹了關(guān)于CentOS7日志文件及journalctl日志查看方法,具有很好的參考價值,希望對大家有所幫助。如有錯誤或未考慮完全的地方,望不吝賜教2023-03-03
玩客云安裝青龍面板實(shí)現(xiàn)京東簽到薅羊毛功能
這篇文章主要介紹了玩客云安裝青龍面板實(shí)現(xiàn)京東簽到薅羊毛,本人準(zhǔn)備的服務(wù)器就是玩客云,只需運(yùn)行一些常用的?docker?容器就行,需要的朋友可以參考下2022-05-05
kubernetes?volume數(shù)據(jù)存儲的使用解讀
文章介紹了Kubernetes中容器的生命周期、持久化存儲的實(shí)現(xiàn)方式,以及常見的存儲卷類型,包括EmptyDir、HostPath、NFS、PV、PVC、ConfigMap和Secret等,通過這些存儲卷和配置,可以實(shí)現(xiàn)Pod中容器之間的數(shù)據(jù)共享、持久化存儲以及敏感信息的管理2025-12-12

