kubernetes

野熊佩骑2 小时前
linux·运维·docker·微服务·云原生·容器·kubernetes
Kubernetes实战系列文章(三) 之 K8S运维常用命令目录1、K8S集群控制命令(1)、集群&节点(2)、命名空间(3)、Pod操作(4)、Ddeployment操作
一个向上的运维者4 小时前
网络·容器·kubernetes
Kubernetes 网络三部曲:CNI、kube-proxy 与 CoreDNS 是如何协作的?“Service 配好了,为什么调用还是失败?”“Pod 明明在 Running,却收不到任何流量!”“DNS 解析不了服务名,但 kubectl get svc 显示一切正常!”
鹤落晴春5 小时前
云原生·容器·kubernetes
【K8s】Kustomize管理Kustomize 是 Kubernetes 原生的配置管理工具,采用 “Base + Overlay(基础 + 覆盖)” 的非侵入式设计。
码--到成功7 小时前
docker·容器·kubernetes
Docker、Kubernetes安装系列 一环境:openEuler 22.03、Linux 5.10、docker 25.0.0、VMware 17
bruce1288 小时前
云原生·容器·kubernetes
K8s Pod 异常重启排查生产环境一台 MGT 服务 Pod 在无任何预警的情况下被重启, 多个接口响应十分慢。本文记录从发现到定位根因的完整排查过程,涵盖应用日志、kubectl describe、kubelet 探针日志、dmesg 节点日志和 error.log 五个维度的交叉分析。
FoldWinCard9 小时前
前端·容器·kubernetes
基于k8s高可用web集群上传镜像更改kube-proxy更改metallb的配置文件下载deploy文件准备ingress所需镜像
无敌糖果11 小时前
docker·容器·kubernetes
K8S network namespace错误分析K8S集群Calico异常问题,排查下来想查看net namespace相关情况,执行ip netns ls报错: Error: Peer netns reference is invalid:
运维老郭11 小时前
云原生·容器·kubernetes
Prometheus 监控 K8s 从入门到入坑:工作原理 + 部署实操 + 避坑指南新接手一个 K8s 集群,老板甩过来一句“把监控搭起来,明天我要看数据”,你打开终端开始敲命令,结果发现配了一上午,Grafana 面板上还是空的——这种场景我太熟悉了。更扎心的是,好不容易装好了,过两天数据又没了,查半天发现是 retention 配置在 3.x 里改了位置。今天我把 Prometheus 监控 K8s 的完整流程和踩过的坑一次性说清楚,照着做就行。
xhaxy13 小时前
docker·容器·kubernetes
docker,k8s安装,k8s集群搭建(OS7)ip: 192.168.171.4 ,192.168.171.5 ,192.168.171.61.设置主机名
名字还没想好☜1 天前
运维·安全·docker·容器·kubernetes
Docker 容器安全加固实战:非 root、只读根文件系统、drop capabilities 与最小攻击面大部分 Dockerfile 默认以 root 跑进程——一旦应用被 RCE(远程代码执行),攻击者拿到的是容器里的 root,再叠加一个容器逃逸漏洞,就能威胁到宿主机。容器安全的核心思路很朴素:假设进程一定会被攻破,那就让它被攻破后什么也干不了。 这篇把几个立刻能落地、性价比最高的加固手段串起来:换非 root 用户、只读根文件系统、砍掉多余的 Linux capabilities、禁止提权。全是几行配置的事,却能把攻击面砍掉一大半。
码--到成功1 天前
docker·容器·kubernetes
Docker、Kubernetes安装系列 二环境:openEuler 22.03、Linux 5.10、docker 25.0.0、VMware 17、kubeadm 1.30.14
mohesashou1 天前
云原生·容器·kubernetes
k8s的service这类资源决定了如何访问运行中的应用。Service(服务):为一组 Pod 提供固定的访问入口和负载均衡。它主要有四种类型:ClusterIP(集群内部访问)、NodePort(节点端口映射,通过节点 IP+端口访问)、LoadBalancer(对接云厂商负载均衡器)和 Headless(用于 StatefulSet 的稳定 DNS)。
梦Arrebol1 天前
微服务·容器·kubernetes
Kubernetes 微服务上一节我们学了控制器(Deployment / ReplicaSet …),它能保证有 N 个 Pod 在跑。但是 Pod 有一个天生的问题:IP 不固定。一个 Pod 被删除重建,IP 就会变;Deployment 扩缩容,新 Pod 又是新 IP。客户端如果直接连 Pod IP,服务端每次重建就要改客户端配置,根本没法用。
想要成为老金高手1 天前
java·容器·kubernetes
Kubernetes 调度器详解:从 nodeName 到污点容忍实验环境:Kubernetes v1.35.3,1 Master + 2 Node,Flannel 网络
名字还没想好☜1 天前
运维·docker·eureka·架构·kubernetes
Docker buildx 多架构镜像实战:一次构建 amd64+arm64,告别 exec format error你在 M 系列 Mac(arm64)上 docker build 打了个镜像,推到仓库,部署到云上的 x86 服务器(amd64),容器起不来,日志一行:
DevOps老兵1 天前
人工智能·kubernetes·helm·vllm·大模型推理·ai infra
AI Infra实战05:用Helm在K8s中部署vLLM,从安装到压测全流程本篇配套的全部脚本、YAML、Helm Chart、预检工具和 Terraform 配置已开源在 GitHub:https://github.com/Jich1123/gpu-k8s-lab 。clone 下来按 00-lab/execution-checklist.md 的顺序执行即可复现全部实验(仓库不含任何真实 IP、密钥或账号信息)。
Asum1ta1 天前
架构·kubernetes·etcd
生产环境 Kubernetes 高可用集群部署实战:外部 etcd + Keepalived + HAProxy + 多 Master 架构摘要:单 Master 集群一旦控制面故障,整个集群就不可用。生产环境必须消除单点故障。本文先讲清 etcd、kube-apiserver、controller-manager/scheduler、kube-dns 四类组件的高可用思路,再以 Ubuntu 24.04 为基座,从虚拟机模板、containerd、外部 etcd 集群、Keepalived 虚拟 IP、HAProxy 负载均衡,到 kubeadm 初始化三 Master 集群、Calico 网络与多 Worker 加入,一步步搭建一套"外部
IT大白鼠1 天前
云原生·容器·kubernetes
Kubernetes 核心资源ReplicaSet 控制器详解一、回顾与导读二、ReplicaSet 的作用2.1 核心职责:维持指定数量的 Pod 副本2.2 故障自愈
μθημα1 天前
网络·微服务·kubernetes
Kubernetes 微服务网络实践:Service 与 Ingress 从入门到灰度发布摘要:本文基于真实虚拟机环境,演示 Kubernetes 微服务网络通信的完整实验流程。内容涵盖 Service 的标签选择器与 Endpoint 关联机制、ClusterIP、Headless、NodePort 三种 Service 类型,以及 IPVS 负载均衡模式的切换与验证;随后深入讲解 Ingress 的路径转发、域名访问、动静分离、TLS 加密、Basic Auth 认证和网页重写等高级路由策略,最后通过 Nginx Ingress 注解实现基于请求头和基于权重的金丝雀灰度发布。全文以具体命令
众人皆醒我独醉1 天前
面试·kubernetes·gpu
Kubernetes GPU 调度与管理的完整机制——从节点上架到 Pod 拿到 GPUGPU 云平台系列 · 第 2 篇第 1 篇讲了 GPU 云平台的六大挑战。这一篇聚焦其中的调度层——一个 Pod 从 kubectl apply 到拿到 GPU 并开始计算,中间经过多少层机制?每层在做什么、配置在哪里、出了问题怎么排查。