云原生k8s【第七课】:集群监控与可观测性

第 18 章 集群监控与可观测性

1、可观测性三个核心维度

  1. Metrics指标:CPU、内存这类数字数据,用来做告警、自动扩缩容。
  2. Logging日志:程序输出的文字报错,排查故障使用。
  3. Tracing链路追踪:追踪一次请求完整经过哪些服务,用来找性能慢的问题。

2、metrics‑server

轻量级组件,不保存历史数据,只保留近期资源快照。给kubectl top查看资源占用、HPA 水平自动扩缩容提供数据来源。

3、Prometheus 监控体系

Prometheus 采用拉取模式,主动去找各个组件拿监控数据。

  • Node Exporter:部署在每台节点机器,采集服务器硬件指标(CPU、内存、磁盘)。
  • Kube‑State‑Metrics:把 K8s 内部 Pod、Deployment 等资源状态转换成监控指标。
  • Prometheus Operator:用 CRD 自定义资源管理 Prometheus,配置写 yaml 文件。

4、Prometheus 与 Grafana 分工

  • Prometheus:负责收集、存储监控数据。
  • Grafana:本身不存监控数据,负责把数据渲染成图表展示。
  • 工作流程:Grafana 发送 PromQL 查询 → Prometheus 返回数据 → Grafana 画出图表。

Grafana 主要概念:

  1. 数据源:对接 Prometheus、Loki 等存储,统一获取数据。
  2. 仪表盘面板:放监控图表,可以手写查询语句,也能导入网上现成模板。
  3. 告警:设置指标阈值,异常把消息推送到钉钉、企业微信。

5、日志方案 Loki + Promtail

  • Loki:日志存储服务,保存收集上来的日志。
  • Promtail:部署在每个节点,采集本机 Pod 日志,上报给 Loki。

整体链路:Promtail采集日志 → Loki存储 → Grafana查看

相关推荐
1 小时前
Python 图片处理:裁剪缩放至300×200,格式JPG/PNG/GIF,控制大小≤100KB
linux·前端·python
青禾8379 小时前
Linux 操作系统入门指南:从目录结构到常用命令
linux·运维·服务器
zhengqweasd9 小时前
流量没跑满、带宽空闲,业务依然卡顿
运维·服务器·网络
闖6410 小时前
入门Linux操作系统|零基础吃透原理、目录、权限、常用命令
linux
Eminem8910 小时前
9、k8s亲和性与污点容忍度
k8s
bruk_spp10 小时前
linux pinctrl
linux
Y38153266211 小时前
Docker Compose 服务依赖与健康检查:healthcheck 让容器按正确顺序启动
运维·docker·容器
稳联技术老娜11 小时前
伺服内嵌EtherNet IP方案:嵌入式小板SPI通讯固件Demo程序适配改造
运维·服务器·网络
en.en..12 小时前
Linux系统编程:fcntl 与 ioctl
linux·运维·服务器