调度排障需要同时核对资源和约束
来源整理卡:基于原图提炼,尚未补充独立官方资料和环境实测。
核心认识
工作负载无法调度时,资源数量与调度约束需要一起核对。
解释
原图的检查链为 Pod request、node allocatable、约束与配额;涉及 taint、affinity、拓扑、优先级等。只看节点总体资源不能完成这条诊断路径。
什么时候使用
出现 Pending 或 Unschedulable 时。
边界
这是思考与取证原则,不证明某次故障根因,也不授权执行修改。具体参数和组件行为仍要依据版本与环境核验。
用一个问题检查是否真正理解
调度器事件指出的限制,能否在资源、标签、污点、拓扑或配额中复现?
原图依据
- 用 requests/limits、优先级、拓扑和 autoscaling 管理资源。
原图知识项:
- scheduler filter/score
- requests/limits/QoS
- taint/toleration
- affinity/topology spread
- priority/preemption
- HPA/VPA/cluster autoscaler
有意义的关联
先从 虚拟化与云原生 找到使用场景;需要进一步查命令、风险或练习时,进入 调度、资源与自动扩缩。
来源:原图节点。