托管 EKS/ACK 不要在 Worker 上对 etcd 做 snapshot restore。自建 kubeadm 才走 etcdctl;先验证快照再停 apiserver。
etcd 存的是集群全部对象:工作负载、RBAC、绑定关系。控制面磁盘坏、误删 CRD、升级失败,最后防线是 可验证的快照,不是「Master 还 ping 得通」。网上恢复命令多按 kubeadm 单控面抄,套到托管集群会在根本没有 etcd 证书的节点上空转。本文先决策托管还是自建,再给只读盘点、CronJob、restore 顺序、反序失败表和演练验收。
目录
转载自 CSDN-专业IT技术社区
原文链接:https://blog.csdn.net/u012172506/article/details/165631334



