RCA Benchmark 是阿里云正式发布的业界首个面向 Agentic Ops(智能运维)的根因分析开源基准体系。它从体系层面解决 AI Agent 在分布式系统故障诊断能力评估上的难题。
它要解决的核心问题是:当前行业尚未形成统一、体系化的根因分析(RCA)评估基准,既无法对各类 AI Agent 的故障诊断能力做客观横向对比,也难以量化技术演进成效。根因分析不同于文本问答、代码生成等有固定输入和标准答案的任务——RCA Agent 需主动从指标、日志、链路追踪、系统事件等多源观测数据中筛选信息,依托服务依赖与实体拓扑关系回溯异常传播链路,最终定位根本诱因。
阿里云联合信通院、中科院软件所/计算机网络信息中心、清华大学、复旦大学、南开大学等共建产业生态,为运维智能体评估提供规范可信的标准底座。




