IT运维:使用数据分析平台监控 Linux 节点

监控目标

监控 Linux 服务器的基本信息以及各项性能指标,包括:

  • CPU

  • 内存、Swap

  • 网络

  • 文件系统、磁盘 IO

解决方案

使用 Node exporter 收集硬件以及操作系统内核的指标数据,并通过 HTTP API 提供数据

使用 Vector agent 通过 Node exporter HTTP API 采集数据,并将数据通过 HEI 导入指定的数据集

使用仪表板展示 Linux 节点的状态信息

操作步骤

1、部署 Node exporter [操作步骤]

https://prometheus.io/docs/guides/node-exporter/#installing-and-running-the-node-exporter)

(详细代码请至官网加入鸿鹄技术社区获取)

2、创建数据集 [操作步骤]

https://www.yanhuangdata.com/honghu_manual/docs/data_management/eventset/#创建数据集)

如使用已经存在的数据集,可跳过此步骤

3、创建 HEI endpoint [操作步骤]

https://www.yanhuangdata.com/honghu_manual/docs/gdi/push_based/#新建hei端口接收数据)

如使用已经存在的 HEI endpoint,可跳过此步骤

4、部署 Vector agent 导入数据 [操作步骤]

https://vector.dev/docs/setup/quickstart/)

(详细代码请至官网加入鸿鹄技术社区获取)

5、导入 Linux 主机监控仪表板 [操作步骤]

https://www.yanhuangdata.com/honghu_manual/docs/dashboard/#创建仪表板)

📎linux_node_monitoring.json

(具体内容请至官网加入鸿鹄技术社区获取)

仪表板 Screenshot

Linux 主机监控

后续工作

上述监控方案实现了 Linux 主机指标数据的仪表板展示,后续还将针对关键主机指标数据配置告警功能,提高异常状况出现后的响应速度。

相关推荐
chlk12314 小时前
Linux文件权限完全图解:读懂 ls -l 和 chmod 755 背后的秘密
linux·操作系统
舒一笑15 小时前
Ubuntu系统安装CodeX出现问题
linux·后端
改一下配置文件15 小时前
Ubuntu24.04安装NVIDIA驱动完整指南(含Secure Boot解决方案)
linux
碳基沙盒16 小时前
OpenClaw 多 Agent 配置实战指南
运维
深紫色的三北六号1 天前
Linux 服务器磁盘扩容与目录迁移:rsync + bind mount 实现服务无感迁移(无需修改配置)
linux·扩容·服务迁移
SudosuBash1 天前
[CS:APP 3e] 关于对 第 12 章 读/写者的一点思考和题解 (作业 12.19,12.20,12.21)
linux·并发·操作系统(os)
哈基咪怎么可能是AI2 天前
为什么我就想要「线性历史 + Signed Commits」GitHub 却把我当猴耍 🤬🎙️
linux·github
十日十行2 天前
Linux和window共享文件夹
linux
Sinclair2 天前
简单几步,安卓手机秒变服务器,安装 CMS 程序
android·服务器
木心月转码ing3 天前
WSL+Cpp开发环境配置
linux