POC 验证通常只选择几类已知故障(如 Pod CrashLoop、慢 SQL、Redis 不可用),看系统能否给出预期答案。这证明的是系统做通了特定场景,但不能说明遇到新故障时系统仍然有效。如果每类告警都绑定一个 Skill 或工作流,POC 结果通常很好——告警类型、调查入口和预期答案都已提前给定,Agent 只在设计好的路径中完成任务。但换一种告警,或让同一故障从另一个业务位置暴露出来,原有路径就可能失效。真正的生产级能力需要面对未覆盖场景仍能自主推进调查。