cdp集群Hbase组件HRegionServer服务停止原因以及排查

前言:重启集群后某一节点HRegionServer服务停止,重启前所有服务均正常

去查看日志:

日志报错

ERROR HRegionServer

Master rejected startup because clock is out of sync

org.apache.hadoop.hbase.ClockOutOfSyncException: org.apache.hadoop.hbase.ClockOutOfSyncException: Server cloudcdp05.hadoop.com,16020,1713404049250 has been rejected; Reported time is too far out of sync with master. Time difference of 31113ms > max allowed of 30000ms

09:34:20.321 ERROR HRegionServerCommandLine

Region server exiting

java.lang.RuntimeException: HRegionServer Aborted

HBase 主节点拒绝了某个区域服务器的启动,因为区域服务器的系统时钟与主节点的系统时钟相差太大。

去查看对应节点后台,发现ntp服务正常启动,但是没有与主节点进行时间同步

怀疑是主节点ntp服务没启起来,去主节点查看ntp是active状态,

可能是没识别问题节点,把主节点和问题节点的ntp服务重启一下就好了

powershell 复制代码
#重启ntp服务
systemcl restart ntpd

后续查看同步状态

powershell 复制代码
ntp -q

可以看到时间同步过去了,问题解决。

相关推荐
AI_56782 小时前
AWS EC2新手入门:6步带你从零启动实例
大数据·数据库·人工智能·机器学习·aws
CRzkHbaXTmHw3 小时前
探索Flyback反激式开关电源的Matlab Simulink仿真之旅
大数据
七夜zippoe3 小时前
CANN Runtime任务描述序列化与持久化源码深度解码
大数据·运维·服务器·cann
盟接之桥3 小时前
盟接之桥说制造:引流品 × 利润品,全球电商平台高效产品组合策略(供讨论)
大数据·linux·服务器·网络·人工智能·制造
忆~遂愿4 小时前
ops-cv 算子库深度解析:面向视觉任务的硬件优化与数据布局(NCHW/NHWC)策略
java·大数据·linux·人工智能
忆~遂愿4 小时前
GE 引擎与算子版本控制:确保前向兼容性与图重写策略的稳定性
大数据·开发语言·docker
米羊1215 小时前
已有安全措施确认(上)
大数据·网络
Fcy6485 小时前
Linux下 进程(一)(冯诺依曼体系、操作系统、进程基本概念与基本操作)
linux·运维·服务器·进程
袁袁袁袁满5 小时前
Linux怎么查看最新下载的文件
linux·运维·服务器
代码游侠5 小时前
学习笔记——设备树基础
linux·运维·开发语言·单片机·算法