k8s调用服务异常cannot allocate memory

运行节点环境

8C 64G的节点是个虚拟机,CentOS7.9的系统里面装了k8s的节点。

k8s中启动服务时异常

bash 复制代码
unable to ensure pod container exists: failed to create container for [kubepods burstable pod482364c3-d6e0-40ab-b594-15d6a806ac74] :
mkdir /sys/fs/cgroup/memory/kubepods/burstable/pod482364c3-d6e0-40ab-b594-15d6a806ac74:
cannot allocate memory

从该节点上看可分配内存只用到了一半,这种异常在资源比较紧时经常出现,其实与节点或宿主机硬件资源有关,比如CPU和内存条比较老,因为同等核数和内存的新服务器即使用90%大概率不会出现这种情况。

但还是查了下资料提示是节点内存限制这块的Limit 耗尽 (97%),服务启动需要2G空间,所以不够。

bash 复制代码
内存限制: 61600 / 63544 MiB (97%)
内存请求: 47070 / 63544 MiB (74%)
实际内存: 30.53 / 62.06 GiB (49%)

原因链:

  1. 节点上 Pod 的 memory limits 总和已接近节点 Allocatable 内存上限 (97%)
  2. Kubelet 在创建 sandbox 容器时,需要为容器创建 cgroup 目录并设置内存限制
  3. cgroup 限制无法分配更多内存 → mkdir ... cannot allocate memory
  4. 容器创建失败 → Pod 无法启动

为什么实际内存只用 49%,但 limit 97%?

K8s 的 Limit 是预留配额,不是实时使用量;大量 Pod 设置了高 memory limit 但实际未完全使用,一旦这些 Pod 突然增长使用内存,节点可能 OOM。

解决方案

释放 Limit 配额:调低部分 Pod 的 memory limit,或驱逐不需要的 Pod。

或者重启节点,如果是测试环境。

相关推荐
Lsetea17 小时前
Kubernetes 1.37 Pod证书怎么签发:Signer与mTLS信任链排查
云原生·kubernetes·ssl证书·tls·mtls
鹤落晴春2 天前
【K8s】从 ConfigMap 到 Argo CD:Kubernetes 配置管理链路
运维·云原生·容器·kubernetes
ezreal_pan2 天前
Pod 重启多场景复盘:OOM、日志阻塞、并发 map 读写导致程序崩溃
docker·k8s
名字还没想好☜2 天前
Docker 镜像瘦身进阶:用 distroless/scratch 把 Go 服务打到 10MB,以及没 shell 怎么调试
运维·docker·容器·golang·kubernetes
陈聪.2 天前
Kubernetes 集群网络插件迁移:从 Flannel 到 Calico 实战总结
云原生·kubernetes
陈聪.2 天前
Kubernetes Service 与 Ingress 知识总结
云原生·容器·kubernetes
cg.family2 天前
containerd 1.6.33 + nerdctl 1.7.6 + Jenkins
k8s
A-刘晨阳4 天前
K8s集群中的数据库新范式:KES-Operator解锁部署、扩缩容、备份全链路自动化
运维·数据库·云原生·kubernetes·自动化
江畔柳前堤4 天前
云原生 × AI 全景图谱:从 Kubernetes 到 Agent 基础设施的一次认知跃迁
人工智能·分布式·gpt·云原生·kubernetes·原型模式·agi
Ningcode_cloud4 天前
Kubernetes 弹性伸缩实验手册:从集群搭建到 HPA / VPA 自动扩缩容
云原生·k8s·prometheus