RCA Benchmark 并非单一文件数据集,而是一套架构完整、逻辑闭环的基准套件评估体系,由三大模块构成:
- 运行环境:搭建可生成真实故障信号的微服务仿真系统,支持 AI Agent 交互式诊断查询,彻底摒弃仅提供离线日志片段的传统模式。
- 结构化样本集:构建搭载四层结构化真实基准(Ground Truth)的故障样本库,每条案例完整涵盖故障类型、归一化根因实体、因果传播链、关键证据检查点四大核心要素。
- 评估协议:制定标准化评分规则,将 AI Agent 输出转化为可横向对比的量化分数,以确定性规则为核心,最大限度减少大模型评审依赖,保障评分公平客观。
项目覆盖范围涵盖微服务架构故障、数据库与中间件故障、容器编排与云原生平台故障、云资源层故障,以及 LLM 与智能体运行时故障等全主流场景。




