Prometheus怎么监控另一台Linux服务器?Node Exporter配置教程

前言

在实际运维环境中,Prometheus通常不会和所有业务服务安装在同一台服务器上。更常见的做法,是准备一台独立的监控主机,集中采集多台Linux服务器的CPU、内存、磁盘和网络运行数据。

这种架构可以避免监控程序与业务应用相互争抢资源,也便于统一保存数据、配置告警和后续接入Grafana。但Prometheus本身不会直接读取远程Linux系统状态,需要目标主机先把指标以标准接口暴露出来。

Node Exporter就是负责这一工作的组件。它运行在被监控主机上,通过9100端口提供系统指标;Prometheus则按照配置文件中的目标地址,定时主动抓取这些数据。

本文会以两台CentOS 7主机为例,在被监控端安装Node Exporter并注册为systemd服务,再在监控主机中修改prometheus.yml,完成跨主机指标采集和状态验证。

在局域网抓取正常后,还会安装 cpolar,将Node Exporter的9100端口映射到公网,并配置固定二级子域名。这样即使两台服务器不在同一网络,Prometheus也能通过公网地址持续拉取指标。

1.Centos7安装node_exporter实现监控部署

安装前提:两台虚拟机(一台监控另一台数据)

  • 监控主机ip:192.168.42.140
  • 被监控主机ip:192.168.42.145

监控主机需要安装:

  • prometheus
  • alertmanager

被监控主机需要安装:

  • node_exporter

安装prometheus和alertmanager可以去cpolar官网参考这个两篇教程:《监控不再局域网!Cpolar 让 Prometheus 走出内网限制!》

《告别宕机!零基础搭建服务器监控告警系统!小白也能学会!》

被监控主机使用命令安装node_exporter:

shell 复制代码
curl -LO https://github.com/prometheus/node_exporter/releases/download/v1.2.0/node_exporter-1.2.0.linux-amd64.tar.gz

下载完后,解压:

shell 复制代码
tar xvfz node_exporter-1.2.0.linux-amd64.tar.gz

将名为 node_exporter-1.2.0.linux-amd64 的目录,移动到 /opt 目录下,并重命名为 node_exporter:

shell 复制代码
 mv node_exporter-1.2.0.linux-amd64 /opt/node_exporter

使用 vi 编辑器,创建或修改一个 systemd 服务配置文件,以便将 node_exporter 注册为一个系统服务,实现开机自启、状态管理(如 start/stop/status)等功能:

shell 复制代码
sudo vi /etc/systemd/system/node_exporter.service

将 node_exporter 注册为一个 Linux 系统服务,以专用用户身份运行,确保在网络就绪后自动启动,并支持通过 systemctl 命令进行管理:

shell 复制代码
[Unit]
Description=Node Exporter
Documentation=https://github.com/prometheus/node_exporter
After=network.target

[Service]
User=node_exporter
Group=node_exporter
Type=simple
ExecStart=/opt/node_exporter/node_exporter

[Install]
WantedBy=default.target

创建一个名为 node_exporter 的系统用户,不创建家目录、不允许登录,专用于运行 node_exporter 服务:

shell 复制代码
useradd --no-create-home --shell /bin/false node_exporter

通知 systemd 重新加载所有服务配置文件:

shell 复制代码
 systemctl daemon-reload
 systemctl enable node_exporter

启动后,ip+9100即可启动node_exporter:

2.Prometheus配置node_exporter

进入prometheus的安装目录,编辑prometheus.yml:

shell 复制代码
vi prometheus.yml

加入被监控主机ip+端口,如下,注意格式(不然无法启动成功):

shell 复制代码
      - targets: ["192.168.42.145:9100"]
        labels:
          app: "node_exporter"

重启Prometheus:

shell 复制代码
systemctl restart prometheus

prometheus 成功抓取了node_exporter指标数据:

测试了一下,若是未启动端口,是无法成功抓取的!

接下来,我们利用内网穿透工具cpolar将 node_exporter 的 9100 端口安全暴露至公网,实现远程可视化监控。

3.配置alertmanager监控主机的数据

配置alertmanager告警:

进入prometheus的安装目录,编辑prometheus.yml:

shell 复制代码
vi prometheus.yml

如图填写:

编辑3.yml添加下面信息监控192.168.42.145的内存和CPU使用率,超过10%就告警:

shell 复制代码
groups:
  - name: node-alerts
    rules:
      # CPU 使用率 > 10% 持续10s
      - alert: 高CPU使用率
        expr: 100 - (avg by (instance, job) (rate(node_cpu_seconds_total{mode="idle"}[5m])) * 100) > 10
        for: 10s
        labels:
          severity: warning
        annotations:
          summary: "高CPU使用 {{ $labels.instance }}"
          description: "CPU大于10% (current value: {{ $value }}%) 超过10s"

      # 内存使用率 > 10%
      - alert: 内存使用率
        expr: (1 - (node_memory_MemAvailable_bytes / node_memory_MemTotal_bytes)) * 100 > 10
        for: 10s
        labels:
          severity: warning
        annotations:
          summary: "内存使用率过高 {{ $labels.instance }}"
          description: "内存使用率大于10% (current value: {{ $value }}%) 超过10s"

重启Prometheus:

shell 复制代码
systemctl restart prometheus

登到prometheus网页后,可以看到我们的告警添加成功啦:

告警数据也成功显示啦:

这样我们成功利用node_exporter监控到了另一台主机的数据:

4.安装cpolar随时随地开发(被监控主机安装)

cpolar 可以将你本地电脑中的服务(如 SSH、Web、数据库)映射到公网。即使你在家里或外出时,也可以通过公网地址连接回本地运行的开发环境。

❤️以下是安装cpolar步骤:

使用一键脚本安装命令:

shell 复制代码
sudo curl https://get.cpolar.sh | sh

安装完成后,执行下方命令查看cpolar服务状态:(如图所示即为正常启动)

shell 复制代码
sudo systemctl status cpolar

Cpolar安装和成功启动服务后,在浏览器上输入虚拟机主机IP加9200端口即:【http://192.168.42.145:9200】访问Cpolar管理界面,使用Cpolar官网注册的账号登录,登录后即可看到cpolar web 配置界面,接下来在web 界面配置即可:

打开浏览器访问本地9200端口,使用cpolar账户密码登录即可,登录后即可对隧道进行管理。

5.配置公网地址

登录cpolar web UI管理界面后,点击左侧仪表盘的隧道管理------创建隧道:

  • 隧道名称:可自定义,本例使用了:node_exporter,注意不要与已有的隧道名称重复

  • 协议:http

  • 本地地址:9100

  • 域名类型:随机域名

  • 地区:选择China TOP

创建成功后,打开左侧在线隧道列表,可以看到刚刚通过创建隧道生成了公网地址,接下来就可以在其他电脑或者移动端设备(异地)上,使用地址访问。

访问成功。

6.将node_exporter暴露给Prometheus进行远程抓取

返回到监控主机,编辑prometheus配置文件:

shell 复制代码
vi prometheus.yml

Prometheus可以通过1a0f75b.r2.cpolar.top这个公网地址访问到运行在192.168.42.145:9100的node_exporter服务,从而抓取系统指标。

shell 复制代码
      - targets: ["1a0f75b.r2.cpolar.top"]
        labels:
          app: "node_exporter"

重启Prometheus:

shell 复制代码
systemctl restart prometheus

登到prometheus网页后,可以看到我们的抓取成功:

7.保留固定公网地址

使用cpolar为其配置二级子域名,该地址为固定地址,不会随机变化。

点击左侧的预留,选择保留二级子域名,地区选择china Vip,然后设置一个二级子域名名称,我这里演示使用的是nodee,大家可以自定义。填写备注信息,点击保留。

登录cpolar web UI管理界面,点击左侧仪表盘的隧道管理------隧道列表,找到所要配置的隧道node_exporter,点击右侧的编辑

修改隧道信息,将保留成功的二级子域名配置到隧道中

  • 域名类型:选择二级子域名
  • Sub Domain:填写保留成功的二级子域名
  • 地区: China TOP

点击更新

更新完成后,打开在线隧道列表,此时可以看到随机的公网地址已经发生变化,地址名称也变成了保留和固定的二级子域名名称。

最后,我们使用固定的公网地址在任意设备的浏览器中访问,可以看到成功访问本地部署的node_exporter页面,这样一个永久不会变化的二级子域名公网网址即设置好了。

至此,我们完成了远程服务器监控搭建。

结尾

完成配置以后,被监控主机上的Node Exporter负责采集系统指标,Prometheus负责定时抓取、保存和查询数据,Alertmanager则根据规则处理CPU、内存等异常告警。

这种"监控中心与采集端分离"的架构,后续扩展多台服务器时比较清晰。新增节点通常只需要部署Node Exporter,再把目标地址加入Prometheus的采集配置中,不必改变原有监控中心结构。

告警阈值需要结合实际负载设置。文章中CPU和内存超过10%就触发告警,更适合用来验证规则是否生效,正式环境如果继续使用这一数值,可能产生大量没有实际意义的告警。

通过 cpolar 映射9100端口后,Prometheus可以跨网络读取Node Exporter指标。随机地址适合验证,固定二级子域名更适合长期采集,否则地址变化后Prometheus目标会失效。

Node Exporter的指标接口默认缺少登录认证,其中可能包含主机名、磁盘、网络接口、系统版本和运行状态等信息,因此不应把公网地址公开传播。条件允许时,应结合访问控制、专用网络或其他安全措施限制抓取来源。

Node Exporter负责边缘采集,Prometheus负责集中存储与查询,Alertmanager负责异常通知,cpolar负责补上跨网络连接通道。整套方案为后续接入Grafana、增加更多主机和完善告警策略提供了基础。

相关推荐
三言老师1 小时前
CentOS7 / 8 yum 查询软件安装路径实操
运维·服务器·网络·centos
公众号:fuwuqiBMC1 小时前
(转自“服务器BMC”)服务器BMC芯片功能——LTPI简介
运维·服务器
xywww1681 小时前
Claude Opus 5 API 接入实战:国内项目上线前的网络、Key、限流和排错清单
大数据·linux·网络·数据库·云计算·aws
ShineWinsu1 小时前
对于Linux:http的解析
linux·网络·c++·网络协议·http·请求·响应
强里秋千墙外道2 小时前
Ubuntu 开机 Kernel Panic:HWE 内核升级失败 + NVIDIA DKMS 踩坑实录
linux·运维·ubuntu
宸津-代码粉碎机2 小时前
Jar热部署进阶实战|修复原生方案OOM与类冲突问题,生产级无BUG优化方案
java·大数据·服务器·开发语言·前端·人工智能·python
coder!mq2 小时前
什么是泛型?有什么好处?
linux·运维·服务器·面试题·八股文
2023自学中11 小时前
Linux 图形系统
linux
kirs_ur11 小时前
ECC & LDPC — SSD 的数据卫士
服务器·数据库·性能优化