L0
底座与前置容器、节点与集群规划
K8s 装在机器上,机器不合格集群就立不住。这一阶段解决三件事:容器到底是什么、节点要调成什么样、集群规模与命名怎么定。
0/6
- 1容器到底是什么:namespace、cgroup 与镜像容器不是轻量虚拟机,是被内核圈起来的一组进程。这个认知决定了你后面所有排障的方向。30 分
- 2运行时与 CRI:kubelet 底下发生了什么kubelet 自己不会跑容器,它通过 CRI 指挥 containerd。这条链路断在哪,节点就 NotReady 在哪。30 分
- 3节点 OS 基线:装 K8s 之前要改的那些参数内核参数、cgroup 驱动、时间同步、swap —— 这些没对齐,集群会以各种诡异的方式间歇性出问题。实验35 分
- 4etcd 磁盘验收:p99 fsync 10ms 这条硬线集群卡顿、频繁选主、apiserver 超时,追到底常常是一块不合格的盘。这条线部署前就能用 fio 测出来。实验35 分
- 5集群规划与命名:把方案写成一张表几个控制面、几段网络、节点怎么命名 —— 这些在装机之前定下来,后面两年都不用返工。30 分
- 6硬件与拓扑:控制面、计算节点与 GPU 机型同样是「三台管理节点 + 若干计算节点」,配错 CPU、网卡或盘位,跑起来的差距是数量级的。30 分