K8s基于节点软亲和的高 CPU Pod 扩容与优先调度方案

场景与目标

  • 集群节点:master(4 核)、node1(16 核)、node2(16 核)。
  • 目标 :将一个高 CPU 消耗的工作负载横向扩展到 4 个实例 ,并通过**节点亲和性(软亲和)**确保 Pod 优先调度到 node1、node2(CPU 更充足)。
  • 已完成:node1/node2 已打标签 cpu-tier=high。

参考:Kubernetes 官方节点亲和文档(支持首选型 preferred、权重 1--100)、Kuboard 亲和性教程(节点亲和的概念与写法)、以及中文教程对软/硬亲和的区分说明。


配置思路(为什么选"软亲和")

  • 软亲和(preferredDuringSchedulingIgnoredDuringExecution) :调度器会为满足规则的节点打分(可设定权重 1--100),尽量将 Pod 放到匹配节点(cpu-tier=high);若资源不足,仍可回退到其他节点,避免扩容/滚更卡在 Pending。
  • 硬亲和(required...) 相比,软亲和更利于弹性与可用性,减少因"条件太硬"而导致的调度失败。

节点标签(确认)

当前节点标签示例(你已完成):

复制代码
# 已有:为 16 核节点打上高 CPU 标签
kubectl label node node1 cpu-tier=high --overwrite=true
kubectl label node node2 cpu-tier=high --overwrite=true

节点亲和是基于节点标签实现的,preferred规则通过标签匹配给节点"加分"。


部署清单中的关键修改(仅节点软亲和)

Deployment 的 spec.template.spec 下添加 nodeAffinity(preferred),示例片段如下(可直接粘贴):

复制代码
affinity:
  nodeAffinity:
    preferredDuringSchedulingIgnoredDuringExecution:
      - weight: 100
        preference:
          matchExpressions:
            - key: cpu-tier
              operator: In
              values:
                - high

weight: 100 表示强烈偏好匹配该表达式的节点;调度器按规则累积分值进行优先选择。


一条命令合并补丁(不改其他字段)

将现有工作负载(以 prod/device 为例)打上节点软亲和 ,并把副本数扩到 4

复制代码
kubectl -n prod patch deploy device --type='merge' -p '
{
  "spec": {
    "replicas": 4,
    "template": {
      "spec": {
        "affinity": {
          "nodeAffinity": {
            "preferredDuringSchedulingIgnoredDuringExecution": [
              {
                "weight": 100,
                "preference": {
                  "matchExpressions": [
                    { "key": "cpu-tier", "operator": "In", "values": ["high"] }
                  ]
                }
              }
            ]
          }
        }
      }
    }
  }
}'

"首选型(preferred)"亲和规则在满足条件的节点上加分,确保优先调度到 node1/node2;当没有可用资源时,调度器仍会将 Pod 放到其它节点,以保障发布成功。


验证与观测

  1. 查看分布与所在节点

    kubectl -n prod get pod -l k8s.kuboard.cn/name=device -o wide

  2. 查看调度事件与亲和匹配

    kubectl -n prod describe pod | sed -n '1,120p'

观察 Node:、Events 中的调度决策与亲和性评估信息。

官方文档:节点亲和任务指南、概念详解。


推荐的配套优化(可选)

  • 声明资源请求/限制:为高 CPU 负载容器设置 resources.requests.cpu、resources.limits.cpu,帮助调度器更准确评估可用余量,从而更倾向于选择 16 核节点。
  • 控制平面隔离:通常 master/control-plane 节点带 NoSchedule 污点,业务 Pod 不会被调度到该节点;如曾清除,可按需恢复污点以保持隔离(此项与"软亲和"互补)。
  • (若想进一步均衡)拓扑分布约束:在软亲和基础上,你也可以为副本增加 topologySpreadConstraints,让 4 个副本在 node1/node2 之间尽量均匀(如目标 2+2),但本次你要求"仅节点软亲和",可暂不启用。

参考资料

Kubernetes 官方文档:Assign Pods to Nodes using Node Affinity(含 preferred/required 与权重说明)。
Kuboard 教程:亲和性与反亲和性(节点亲和的概念与示例)。
中文教程:亲和力软/硬的对比与说明。
CSDN:Kubernetes 进阶之容器组(Pod)(包含资源 requests/limits 的清单说明,可用于配合调度)。

相关推荐
ShirleyWang0122 天前
让headlamp控制台能访问
linux·服务器·python·k8s·k3s
spider_xcxc2 天前
K8s 部署学习笔记
docker·容器·kubernetes·云计算·k8s
ShirleyWang0122 天前
Day02 K3s NGF(Nginx Gateway Fabric)单 Worker 环境网关更新与故障处置 SOP
linux·服务器·python·k8s·k3s
ShirleyWang0122 天前
DAY01 K3s 私有化部署排障复盘与 SOP
linux·服务器·k8s·k3s·企业部署
XUHUOJUN6 天前
AKS 不是安装在 Windows Server 上,而是运行在 Windows Server 之上的 Azure 平台能力
windows·架构·k8s·azure local·azure stack
Geek-Chow6 天前
Connecting kubectl to a Private EKS Cluster Over an Internal Domain
kubernetes·k8s·aws
spider_xcxc8 天前
Docker Compose 容器通信详解:同一个 Compose 文件才能互通吗?
docker·容器·k8s·容器化·容器网络
欢醉13 天前
k8s调用服务异常cannot allocate memory
kubernetes·k8s
万里侯15 天前
GitOps 漂移检测:集群里改了配置,Git 还以为一切正常
微服务·容器·k8s
spider_xcxc17 天前
云上网络基石(阿里云):深入解读阿里云VPC及其应用生态
网络·阿里云·云计算·k8s·运维开发·虚拟化