解决容器内存延时需要从看清内存和用好内存两个方面入手。看清内存方面,可以使用阿里云操作系统控制台的节点/Pod内存全景分析功能,该功能对内存进行了细粒度拆解,包括Pod Cache(缓存内存)、InactiveFile(非活跃文件内存)、InactiveAnon(非活跃匿名内存)、Dirty Memory(脏内存)等组成部分,帮助发现常见的Pod内存黑洞问题。用好内存方面,可以使用ACK容器服务团队推出的Koordinator QoS精细化调度功能,通过精细化调整容器的内存水线,提早进行异步回收,避免触发直接内存回收。对于memory cgroup泄漏问题,临时方案是通过drop cache回收page cache使僵尸cgroup被清除,长期方案是开启Alinux的僵尸cgroup回收功能。




