模块资料|根因定位与证据推理

原图深度模块的结构化资料摘录,保留目标、知识、命令线索、风险、排障、练习与验收。它不是一张原子知识卡,也不是可直接执行的操作手册。

所属方向:AI Infra

目标

  • 结合拓扑、变化、跨信号证据给出可验证根因候选。

知识拆解

  • symptom/root cause
  • dependency graph
  • temporal precedence
  • change correlation
  • causal hypothesis
  • counterfactual
  • confidence

命令 / 配置 / 关键对象

以下是原图中的命令名、缩写或配置对象,并非经校验的完整命令行;其中可能含写操作。执行前必须补齐版本、权限、目标和风险。

  • service graph
  • trace critical path
  • metric/log change
  • deployment diff
  • evidence ranking

高频故障与风险

  • 把相关当因果
  • LLM 编造证据
  • 只给单一结论
  • 忽略共同基础设施

排障路径

  • 生成多个假设
  • 每个假设列支持/反对证据
  • 选择低风险验证动作
  • 保留不确定性

实战练习

  • 同一症状构造 3 个根因
  • 人工 vs Agent RCA 对比

验收标准

  • 结论可追到原始证据
  • top-k 根因准确率
  • 时间到定位可量化

对应优秀开源项目

继续拆卡的规则

本页是资料入口。只在形成一个能独立解释、带依据与边界的认识后,提炼为 Concept;故障观察进入 Troubleshooting,满足诊断条件的处置进入 Runbook,真实事件进入 Incident。

来源

查看完整原图节点与备注