选一条路线
36 节课不必都学。挑一个和你当前岗位最近的身份, 下面会给出裁剪过的清单 —— 只留这个岗位真正会用到的课,并切成几段推进。 想看全貌就切到「集群运维工程师」,那条是不做裁剪的完整主线。
客户买的是一套能交付、也养得起的平台16 节 · 约 9 小时 · 已完成 0/16
你不必亲手装过集群,但方案里每个数字都得站得住:几台控制面、多少节点、GPU 怎么调度、两年后谁来维护。这条线把部署细节和深度排障压到最少,重点放在对象语义、规模推算与技术选型。
- ✓把「上一套 100 卡的 K8s」追问成一份能落地的节点与网段规格表
- ✓从节点配置算出可分配资源、Pod 密度与控制面规格,并说出第一个瓶颈
- ✓在 CNI、存储接入、GPU 调度几个选型点上讲清各自的代价,而不是只报组件名
沿这条路线开始 · 第 1 节 控制面解剖:一次 kubectl apply 的全过程
对象与语义
4 节 · 135 分钟方案里每写一个词,都得知道它落到集群上是什么东西
把需求写成集群规格
4 节 · 135 分钟这条线的主课,计算器在这一段
平台能力版图与选型
5 节 · 195 分钟知道每一层有什么可选、各自强在哪,才谈得上「为什么选它」
交付前要想清楚的事
3 节 · 95 分钟签字之前先知道交付以后会踩什么坑
岗位路线是挑着学的,没排进这条线的课不会消失 —— 切到「集群运维工程师」就是按 L0–L4 通读的 全部 36 节。三条路线共用同一份进度。