kubernetes

acd120092 小时前
容器·重构·kubernetes
一次线上OOM排查实录:从jmap到代码重构,我踩过的坑全在这了凌晨两点,告警群里一条消息把我炸醒:生产环境某服务频繁Full GC,内存占用飙到92%,已经触发熔断。这种场景,做过几年后端的兄弟应该都不陌生。今天把这次排查的完整过程复盘一下,希望能帮到遇到类似问题的朋友。
天蓝不会忘记026 小时前
云原生·容器·kubernetes
k8s集群部署的方法原理Master 节点:负责集群的管理和调度,运行 API Server、Scheduler、Controller Manager、etcd 等核心组件。
红球yyds7 小时前
云原生·容器·kubernetes
用anisble搭建k8s集群及原理Kubernetes 是 Google 基于 Borg 技术开源的容器集群管理系统,它在 Docker 等容器技术的基础上,为容器化应用提供了部署运行、资源调度、服务发现、动态伸缩、故障自愈等全生命周期管理能力,大幅提升了大规模容器集群管理的便捷性。 Kubernetes 的核心设计思想,是从宏观视角以统一方式定义任务间的各种关系,并为未来扩展更多任务类型预留空间。它最核心的能力,就是按照用户意愿与集群规则,自动化处理容器之间的各种关系,这一能力就是我们常说的「容器编排」。可以说,Kubernetes 的
Thneonl10 小时前
rust·kubernetes
让恢复动作敢按下去:dry-run、审批门、自动回滚与 mutable twinSRE 最怕的往往不是发现故障,是把手悬在「重启 / 回滚 / 扩容」按钮上的那几秒 —— 影响面说不清,按下去了回不来怎么办。这篇讲我的恢复动作引擎怎么把「敢按」这件事工程化。
ltl1 天前
kubernetes
mTLS 工程实践:服务间双向认证怎么落地原文发布于 quant67.com,转载请保留出处。在传统的 TLS 握手中,只有客户端验证服务器的身份——服务器发送证书,客户端验证证书的有效性。但在微服务架构中,服务 A 调用服务 B 时,服务 B 也需要知道"调用方是谁"。这就是 mTLS(Mutual TLS,双向 TLS)的核心价值:双方互相验证身份。
栩栩云生1 天前
kubernetes·agent·mcp
别再硬记 AWS 和 k8s 命令了!一行命令把十几个云平台的 CLI 全接进 AIAWS、GCP、Kubernetes、Cloudflare、Tencent Cloud,每个平台一套 CLI、一套认证、一套参数风格。想查 Lambda 日志要翻 AWS 文档;想查 GKE Pod 状态要翻 kubectl 文档。
对象存储与RustFS1 天前
后端·云原生·kubernetes
给 Kubernetes 找一个对象存储后端:RustFS Helm 部署 + 应用接入实录集群里跑着训练任务和日志管道,PVC 块存储越堆越多:扩容量要等重建、多个 Pod 抢同一份数据时还要自己处理锁和拷贝。你查了一圈,发现这类工作负载真正需要的是一个 S3 兼容的对象存储后端——对象不上锁、随便共享、还能挂生命周期策略自动归档。于是你在集群里起了个 MinIO,但 AGPL 的许可条款让法务皱了眉,镜像里那些遥测也让数据主权强迫症难受。
分布式存储与RustFS1 天前
云原生·kubernetes·开源·对象存储·分布式存储·s3·rustfs
给 Kubernetes 找一个对象存储后端:RustFS Helm 部署 + 应用接入实录集群里跑着训练任务和日志管道,PVC 块存储越堆越多:扩容量要等重建、多个 Pod 抢同一份数据时还要自己处理锁和拷贝。你查了一圈,发现这类工作负载真正需要的是一个 S3 兼容的对象存储后端——对象不上锁、随便共享、还能挂生命周期策略自动归档。于是你在集群里起了个 MinIO,但 AGPL 的许可条款让法务皱了眉,镜像里那些遥测也让数据主权强迫症难受。
IT大白鼠2 天前
安全·容器·kubernetes
容器安全入门:K8s常见基础安全风险通俗解读Kubernetes(K8s)作为容器编排的主流平台,其安全风险可以通过一个生动的"公寓管理"类比来理解。想象一下,K8s就像一个大型公寓社区,每个容器是其中的一个房间,而K8s则是物业管理公司。在这个社区中,邻居可能闯入你家(容器逃逸)、你的钥匙能开别人的门(权限过大)、有人偷用你的水电(资源滥用)、你的房间没有监控(审计缺失)。容器安全就是给Docker和Kubernetes穿上"防护服",防止这些安全问题。
a未来永远是个未知数3 天前
云原生·容器·kubernetes
k8s创建基于nfs的pv、pvc编辑yaml文件写入以下内容执行yaml文件NFS Subdir Provisioner本质上是一个实现了Kubernetes CSI规范的控制器。其架构设计遵循了Kubernetes的声明式API原则,主要包含三个关键组件: Provisioner Controller :持续监听API Server的PVC变更事件 NFS Client :与指定NFS服务器建立稳定连接 Subdir Manager :负责目录创建/删除和权限管理
ltl2 天前
kubernetes
CoreDNS 深度拆解:ndots、search domain 与那些坑人的 DNS原文发布于 quant67.com,转载请保留出处。你的微服务调用外部 API,平均延迟 200ms。你优化了连接池、调了超时参数、换了更快的序列化库,延迟纹丝不动。最后你抓了个包,发现每次 HTTP 请求之前,都有四条 DNS 查询在排队——其中三条注定失败,只有最后一条能拿到结果。
有脚就行3 天前
人工智能·分布式·kubernetes
第30篇-Kubeflow-Training-Operator-K8s上的分布式训练系列定位:AIaaS 全栈架构师教程,技术栈以 Go 为主。本篇聚焦 K8s 如何用 Operator 模式管理分布式训练任务,以及 Gang Scheduling 如何解决 all-or-nothing 难题。
三言老师2 天前
linux·服务器·平面·容器·kubernetes
kubeadm + haproxy + keepalived 三节点高可用控制平面操作环境:master01(.11)/master02(.12)/master03(.13),VIP 192.168.1.100;三台 master 均装 haproxy + keepalived。
有脚就行2 天前
人工智能·云原生·容器·kubernetes
第33篇-KServe推理平台-标准化的K8s推理服务管理系列定位:AIaaS 全栈架构师教程,技术栈以 Go 为主。本篇聚焦 KServe——K8s 上的推理服务标准,拆解 InferenceService CRD、推理服务生命周期、自动扩缩容(HPA/KEDA)、Canary/蓝绿/影子部署,以及 InferenceGraph 多模型编排。
名字还没想好☜2 天前
数据库·云原生·容器·kubernetes·statefulset
Kubernetes StatefulSet 实战:为什么数据库不能用 Deployment 部署很多人第一次在 K8s 上跑 MySQL、Redis、ZooKeeper,直接抄了个 Deployment 的 YAML,结果 Pod 一重启数据就没了,或者主从复制配了半天 IP 一变就全乱套。问题不在你,而在于有状态应用根本不该用 Deployment。这篇讲清楚 StatefulSet 解决了什么、和 Deployment 差在哪,以及一个能跑起来的完整例子。
瞬间&永恒~2 天前
云原生·容器·kubernetes
【Kubernetes】(七)Kubernetes控制器1、说明K8s控制器的作用?Controller manager,控制器用来监控集群的状态,并可将当前状态变为预期状态
李少兄2 天前
云原生·容器·kubernetes
Kubernetes Pod 状态全解析:从 Phase 到 CrashLoopBackOffKubernetes 中并不存在一个单一的"Pod 状态字段"能解释一切。API 对象 Pod 的 status 中同时维护着三套互相独立、互相补充的状态信息:
suijishengchengde2 天前
运维·kubernetes
k8s deployment或statefulset分组关停#!/bin/bashNAMESPACE="as_you_wish"# 使用普通数组(索引从0开始)GROUP_NAMES=("NACOSService" "MIDService" "APPService")
张洛闻Eren2 天前
云原生·架构·kubernetes
云原生k8s【第二课】:K8s 部署与架构K8s 用来批量管理容器,目标是实际状态往期望状态靠拢。关闭 swap,内核参数调优;所有节点装 kubeadm/kubelet/kubectl;master 用 kubeadm init 初始化集群;worker 拿命令加入集群;装上网络插件 Calico 集群网络才通。
SLD_Allen3 天前
人工智能·架构·kubernetes
NVIDIA KAI Scheduler深度解析——Kubernetes原生AI调度器的架构、原理与实践Kubernetes默认调度器(kube-scheduler)是为无状态微服务设计的——它把GPU当成CPU核一样调度,每个Pod独占整张GPU,没有Gang Scheduling(成组调度),没有团队公平性,没有拓扑感知。