踩了个大坑!K8s 挂载目录的日志,居然也在吃容器内存?

最近一直收到某个服务pod容器内存超过80%的告警,堆内存加上堆外内存目前看也只有1G左右,但pod内存却达到4G多,查来查去查到active_file对应的logs占用大量内存,目前现状是k8s中springboot服务日志挂载到宿主机/logs目录,/logs目录的所有日志大小有3G,容器内存显示也包含日志的3G,即使挂载出来了也没生效?
挂载设置如下:
volumeMounts:
- mountPath: /logs
name: logs-volume
volumes:
- hostPath:
path: /logs
type: ''
name: logs-volume
那为什么logs挂载到外部还是会占用大量内存?
这里查询资料,K8s/Docker 对容器的内存统计基于 Linux Cgroup 的 memory.usage_in_bytes,该值包含两部分:
-
RSS(常驻内存):Java 进程本身的堆、栈、堆外内存,是程序实际运行占用的内存
-
Page Cache(页面缓存):进程读写磁盘文件时,内核为提升IO性能而缓存的文件数据,logs占用的内存是 Linux 内核的文件页面缓存(Page Cache)被统计到了容器的 cgroup 内存使用中
# 查看cgroup内存统计,关注 rss 字段(进程实际占用),cache 字段是可回收的文件缓存
cat /sys/fs/cgroup/memory/memory.stat
手动清理 Page Cache(临时方案)
进入容器或宿主机执行(需要权限):
# 清理文件缓存,不会影响运行
echo 1 > /proc/sys/vm/drop_caches
当SpringBoot应用向/logs 目录写入 3G 日志时:
-
即使
/logs通过hostPath挂载到宿主机磁盘,容器内进程写入的所有日志数据都会先进入 Page Cache这部分 3G 的缓存数据会被完整统计到容器的内存使用量中 -
K8s 计算工作集内存(
container_memory_working_set_bytes)时使用公式:总内存使用 - 非活跃文件缓存,而频繁写入的日志文件属于"活跃文件(active_file)",不会被扣除,因此最终显示的内存占用就包含了这3G日志大小
关键点是:即使挂载到了宿主机,但在大量请求服务时,服务在读写日志文件,这时就会一直在操作日志文件没有释放,在 cgroup 的内存统计中,哪个进程触发了 I/O,产生的 Page Cache 就归到哪个进程的 cgroup 里。但之前已经轮换的日志压缩文件不会占用。
还有一点,就是多个一个服务的多个实例在同一个节点,那操作的日志文件就会两个实例同时进行读写 这就可能会导致其中一个实例不会释放这个日志文件或操作轮转失败 一直存在 那内存就会越来越高。
按以下步骤解决
-
重启服务释放占用内存达到止血的目的。
-
清除一部分日志。
-
将同一服务的多实例分配到不同节点。
-
将日志轮转时长调短,降低日志量和文件大小,间接减少 Page Cache 上限。
-
建议避免在容器内读取日志文件;(但这个日志在写应该很少能满足)
-
将logs挂载到NFS中进行收集。
公众号【一个码农的日常】 技术群:319931204 1号群: 437802986 2号群: 340250479
出处:http://zhangs1986.cnblogs.com/
码云:https://gitee.com/huanzui
本文版权归作者和博客园共有,欢迎转载,但未经作者同意必须保留此段声明,且在文章页面明显位置给出原文连接,否则保留追究法律责任的权利。

浙公网安备 33010602011771号