新版日志聚类采用了超越简单模式匹配的变量识别算法,能处理多种复杂场景:
- 数值型变量:自动识别数字、IP 地址、端口号等数值模式,并支持范围统计。
- 枚举型变量:对于取值有限的变量(如状态码、服务名),自动统计 Top N 取值分布。
- 复合型变量:对于 UUID、Trace ID 等复杂模式,智能识别其边界。
变量摘要(var_summary)通过 summary_log_variables 算子生成,不仅记录取值样例,还包含类型推断(range/enum/gauge)和分布统计,为深入分析奠定基础。
在前端交互上,日志模板中的变量部分高亮显示并可点击。点击后展示该变量的分布统计——枚举型显示 Top N 取值,数值型显示范围分布,帮助用户快速理解异常变量集中在哪些取值上。




