原理预计 35 分钟
规模化:apiserver 过载与大集群的限额
几十台的时候一切正常,几百台之后 list 一次 Pod 就能把控制面拖垮。
学完这节你能做到
- 定位 apiserver 压力来源:谁在 list、谁在 watch
- 用 APF(API Priority and Fairness)保住关键请求
- 说出官方规模上限的几条硬约束,以及逼近时的表现
正文待编写以下是本节已定稿的小节大纲
- 1apiserver 请求链路与缓存
- 2昂贵的 list:全量拉取与 resourceVersion
- 3API Priority and Fairness 配置
- 4etcd 对象数与大小限制
- 5大集群的调度延迟与 informer 压力
- 6拆集群的时机判断