模块资料|根因定位与证据推理
原图深度模块的结构化资料摘录,保留目标、知识、命令线索、风险、排障、练习与验收。它不是一张原子知识卡,也不是可直接执行的操作手册。
所属方向:AI Infra。
目标
- 结合拓扑、变化、跨信号证据给出可验证根因候选。
知识拆解
- symptom/root cause
- dependency graph
- temporal precedence
- change correlation
- causal hypothesis
- counterfactual
- confidence
命令 / 配置 / 关键对象
以下是原图中的命令名、缩写或配置对象,并非经校验的完整命令行;其中可能含写操作。执行前必须补齐版本、权限、目标和风险。
- service graph
- trace critical path
- metric/log change
- deployment diff
- evidence ranking
高频故障与风险
- 把相关当因果
- LLM 编造证据
- 只给单一结论
- 忽略共同基础设施
排障路径
- 生成多个假设
- 每个假设列支持/反对证据
- 选择低风险验证动作
- 保留不确定性
实战练习
- 同一症状构造 3 个根因
- 人工 vs Agent RCA 对比
验收标准
- 结论可追到原始证据
- top-k 根因准确率
- 时间到定位可量化
对应优秀开源项目
继续拆卡的规则
本页是资料入口。只在形成一个能独立解释、带依据与边界的认识后,提炼为 Concept;故障观察进入 Troubleshooting,满足诊断条件的处置进入 Runbook,真实事件进入 Incident。