发一次版就冒一串 502,别急着怪 K8s 探针,先看你的关闭顺序
发一次版,监控上就冒出一串 502。
不多,十几个,几秒钟就没了。下一次发版又来一串。你先怀疑的大概是 K8s:是不是 readiness 探针没配好?是不是 terminationGracePeriod 太短?是不是 LB 摘流慢了半拍? …
发一次版,监控上就冒出一串 502。
不多,十几个,几秒钟就没了。下一次发版又来一串。你先怀疑的大概是 K8s:是不是 readiness 探针没配好?是不是 terminationGracePeriod 太短?是不是 LB 摘流慢了半拍? …
你可能已经用了几年 K8s。
Deployment 会写,Service 会配,Pod 挂了也知道先看 events。可真要问 kubelet、scheduler、controller、CNI 在里面怎么配合,很多人心里还是一团黑箱。
你也 …
服务又 OOM 了。
Pod 刚重启,群里已经开始出方案:GOMEMLIMIT 设低一点,GOGC 调一下,limit 先加 1Gi,GC 日志再翻一遍。
这些动作有时候能救火,但经常救不到根上。
因为很多 Go 服务所谓的“内存泄漏”,根 …
服务又被 OOMKilled 了。
Pod 刚重启,群里已经开始报菜名:把 GOGC 调低一点,给 GOMEMLIMIT 设个值,容器 limit 再加 1Gi,顺手翻一下 GC 日志。
这些动作不一定错,但顺序错了。
你现在看到的是“尸体 …
服务又被 OOMKilled 了。
Pod 刚重启,群里已经有人开始翻 GC 日志。有人说 GC CPU 到了 20%,有人说把 GOGC 调低一点,还有人建议直接上 GOMEMLIMIT。
这些动作不一定错,但顺序错了。 …