实验预计 35 分钟
etcd 运维:备份、恢复与碎片整理
集群其它东西都能重建,etcd 不能。这一节练的是「真的能恢复」,不是「有备份」。
学完这节你能做到
- 做一次快照备份,并在测试环境完整恢复出集群
- 处理 etcd 空间告警:defrag、compact 与告警解除
- 判断 etcd 集群是否健康,读懂成员列表与 endpoint status
正文待编写以下是本节已定稿的小节大纲
- 1etcdctl 连接参数与常用子命令
- 2snapshot save / restore 全流程
- 3存储配额、自动压缩与碎片整理
- 4mvcc: database space exceeded 的处置
- 5成员健康检查与故障成员替换
- 6备份策略:频率、异地与恢复演练
延伸资料
- ·k8s-in-action
k8s/faq.md - ·k8s-in-action
k8s/etcd-disk-performance.md