调度排障需要同时核对资源和约束

来源整理卡:基于原图提炼,尚未补充独立官方资料和环境实测。

核心认识

工作负载无法调度时,资源数量与调度约束需要一起核对。

解释

原图的检查链为 Pod request、node allocatable、约束与配额;涉及 taint、affinity、拓扑、优先级等。只看节点总体资源不能完成这条诊断路径。

什么时候使用

出现 Pending 或 Unschedulable 时。

边界

这是思考与取证原则,不证明某次故障根因,也不授权执行修改。具体参数和组件行为仍要依据版本与环境核验。

用一个问题检查是否真正理解

调度器事件指出的限制,能否在资源、标签、污点、拓扑或配额中复现?

原图依据

  • 用 requests/limits、优先级、拓扑和 autoscaling 管理资源。

原图知识项:

  • scheduler filter/score
  • requests/limits/QoS
  • taint/toleration
  • affinity/topology spread
  • priority/preemption
  • HPA/VPA/cluster autoscaler

有意义的关联

先从 虚拟化与云原生 找到使用场景;需要进一步查命令、风险或练习时,进入 调度、资源与自动扩缩

来源:原图节点