错请求可以分为请求报错与业务报错两类:
- 请求报错:属于程序运行不符合预期,比如 HTTP 5XX 错误抛出 RuntimeException。
- 业务报错:是业务逻辑不符合预期,比如用户下单使用优惠券失败(原因可能是优惠券已失效),但服务调用本身是正常的。
针对不同类型的错误,排查流程略有差异,但关键操作包括以下几类:
- 链路与日志双向关联跳转:排查系统报错时,可以从微服务调用视角找到错误调用链,再查看关联的应用日志;排查业务报错时,可以先检索应用日志里的业务关键词,再通过日志关联的 TraceId 反向查询上下游信息。
- 链路关联异常堆栈:以 Java 应用为例,系统报错通常会抛出特定异常(包含详细错误原因与调用堆栈),通过 TraceId 准确关联当次请求的异常堆栈,可以加速研发排障效率。
- 链路关联请求出入参数:不同的请求入参可能影响程序执行分支(比如不同渠道优惠策略有差异),排查疑难问题时还需结合方法入参判断;而出参因数据量不可控通常只记录 ResponseSize 而非完整结果。




