ingress-nginx 开启 Prometheus 监控 + Grafana 查看指标

环境已经部署了 ingress-nginx(DaemonSet 方式),并且 Prometheus + Grafana 也已经运行。但之前 /metrics 端点没有暴露 Nginx 核心指标(如 nginx_ingress_controller_requests_total),经过调整后现在可以正常采集数据。以下是完整操作总结:


1. 确保 ingress-nginx 暴露 Prometheus 指标

(1)检查并修改 DaemonSet 配置

复制代码
kubectl edit daemonset ingress-nginx-controller -n ingress-nginx

在 containers.args 中添加:

复制代码
args:
- /nginx-ingress-controller
- --enable-metrics=true          # 启用 Prometheus 指标
- --metrics-per-host=true       # 按 Host 统计指标(可选)
- --configmap=$(POD_NAMESPACE)/ingress-nginx
- ...(其他原有参数保持不变)

保存后会自动重启 Pod,或者手动滚动更新:

复制代码
kubectl rollout restart daemonset ingress-nginx-controller -n ingress-nginx

(2)验证指标是否暴露

复制代码
kubectl exec -it $(kubectl get pods -n ingress-nginx -l app.kubernetes.io/name=ingress-nginx -o jsonpath='{.items[0].metadata.name}') \
  -n ingress-nginx -- curl -s http://localhost:10254/metrics | grep 'nginx_ingress_controller_requests_total'

预期输出:

复制代码
nginx_ingress_controller_requests_total{ingress="your-ingress", namespace="default", status="200"} 15

2. 配置 Prometheus 采集指标

(1)创建 ServiceMonitor(如果尚未配置)

复制代码
cat <<EOF | kubectl apply -f -
apiVersion: monitoring.coreos.com/v1
kind: ServiceMonitor
metadata:
  name: ingress-nginx
  namespace: ingress-nginx
  labels:
    release: prometheus  # 必须匹配 Prometheus 的 serviceMonitorSelector
spec:
  selector:
    matchLabels:
      app.kubernetes.io/name: ingress-nginx  # 匹配 Service 的标签
  endpoints:
  - port: metrics        # 必须与 Service 的端口名称一致
    interval: 15s
    path: /metrics
EOF

(2)检查 Prometheus Targets

访问 Prometheus 的 Targets 页面(如 http://prometheus-server:9090/targets),确认 ingress-nginx 的 target 状态为 UP。

(3)手动查询 Prometheus 验证

复制代码
# 进入 Prometheus Pod 查询
kubectl exec -it $PROM_POD -n prometheus -c prometheus -- \
  curl -s "http://localhost:9090/api/v1/query?query=nginx_ingress_controller_requests_total" | jq

预期 :返回带 ingress 和 status 标签的指标数据。


3. 在 Grafana 中查看指标

(1)导入官方 Dashboard

  1. 登录 Grafana(如 http://grafana.example.com)

  2. 点击 + → Import

  3. 输入 Dashboard ID:

    • 最新版(推荐) :14314(官方链接)

    • 旧版兼容:9614

  4. 选择正确的 Prometheus 数据源

(2)检查数据源和查询

  • 确认数据源:Dashboard 右上角选择正确的 Prometheus 数据源。

  • 检查查询语句 :点击任意 Panel → Edit → 查看 Query 是否使用正确的指标(如 nginx_ingress_controller_requests_total)。

  • 调整时间范围 :确保选择最近的时间范围(如 Last 1 hour)。

(3)常见问题排查

  • 无数据:

    • 检查 Prometheus 是否真的采集到数据(直接查询 nginx_ingress_controller_requests_total)。

    • 确保有流量经过 ingress-nginx(空流量无指标)。

  • 指标名称不匹配:

    • 新版本可能用 controller_nginx_requests_total,需调整 Grafana 查询。

4. 最终验证

  1. Prometheus 有数据:

    复制代码
    curl -s "http://prometheus:9090/api/v1/query?query=nginx_ingress_controller_requests_total" | jq
  2. Grafana 图表正常:

    • 打开 Dashboard,查看请求量、错误率、延迟等图表。

总结

步骤 关键操作
1. 启用指标 --enable-metrics=true + 重启 DaemonSet
2. 配置采集 创建 ServiceMonitor 匹配 metrics 端口
3. 检查 Target Prometheus 的 Targets 页面确认 UP
4. 导入 Dashboard Grafana 导入 ID 14314,选择正确数据源
5. 验证数据 直接查询 Prometheus + 检查 Grafana 图表

你的环境已经可以正常监控 ingress-nginx,后续只需关注 Grafana Dashboard 即可实时观察流量、错误率等关键指标!

相关推荐
PC2005-cloud11 小时前
Nginx 学习笔记:Server 块配置详解,域名路由与多站点部署实战
nginx
zach12 小时前
Vue/React SPA 打包部署后,子路由刷新 401 未登录问题彻底解决
前端·nginx·next.js
倔强的小石头_13 小时前
Ubuntu部署Prometheus与Alertmanager:systemd配置、告警对接及cpolar远程访问
数据库·ubuntu·prometheus
打工仔折腾 AI13 小时前
Prometheus接入Pushgateway实战:二进制与Docker部署、指标推送与远程写入
后端·python·docker·容器·性能优化·prometheus·ai agent 实战
yume_sibai14 小时前
02-Nginx进阶配置完全指南(性能优化 + 安全配置 + 缓存配置 + WebSocket代理)
nginx·安全·性能优化
阿狗童鞋14 小时前
Nginx反向代理与负载均衡实战指南
运维·nginx·负载均衡
哈__14 小时前
日志散在多台服务器怎么查?用 Promtail + Loki + Grafana 搭一套集中检索平台
运维·服务器·grafana
Lsetea1 天前
OpenSSL verify报error 20:CAfile、fullchain与本地信任链分层排查
nginx·https·ssl证书·openssl·证书链
qq_394562001 天前
【在Linux上升级nginx】
linux·服务器·nginx
冬、不眠的夜1 天前
分享一下 nginx 配置一个简单的 web 网站
nginx