通过ACK的SysOM容器系统监控可以从Pod和节点两个维度识别内存延时问题。在容器维度,查看Pod Memory Monitor中的Memory Direct Reclaim Latency大盘可以观察容器内进程因直接内存回收被阻塞的时长和次数分布,如memDrcm_lat_1to10ms表示延时1-10ms的增量次数。Memory Compact Latency大盘则展示因内存碎片导致的直接内存规整次数增量。在节点维度,查看System Memory中的Memory Others大盘,其中pgscan_direct折线表示直接回收阶段扫描的页数,数值不为0说明节点发生了直接内存回收。此外还有Memory Global Direct Reclaim Latency大盘用于观察全局级别的回收延时。通过这些指标可以精确判断是容器级别还是节点级别的内存紧张导致了业务抖动。




