大数据-之LibrA数据库系统告警处理(ALM-37003 GTM主备不同步或者GTM主备断连)

告警解释

当GTM主实例与GTM备实例连接异常或者GTM主实例未处于同步状态时,产生该告警。

告警属性
告警ID 告警级别 可自动清除
37003 严重
告警参数
参数名称 参数含义
ServiceName 产生告警的服务名称
RoleName 产生告警的角色名称
HostName 产生告警的主机名
Instance 产生告警的实例
对系统的影响

当GTM主实例与GTM备实例连接异常时,如果GTM主实例处于同步模式,系统将在120s内不可用,待检测到该故障时,会将GTM主实例设成最高可用模式,系统恢复使用。如果是最高可用模式,系统仍然可以正常使用。

说明:

集群正常运行时,GTM主实例处于同步模式,主实例收到执行任务后会同步任务到备实例,主备实例间实时同步。当备实例故障且无法自动修复后,主实例将停止同步任务到备实例,此时称主实例为最高可用模式。

可能原因

GTM主实例与GTM备实例连接异常。

处理步骤

查看告警原因。

  1. 执行如下命令查看集群GTM主备实例是否故障。

    复制代码
    gs_om -t status --detail
    • 是,修复故障实例,具体方法请参考"修复MPPDBServer实例"章节。
    • 否,执行2
  2. 查看集群GTM主备实例所在机器网络是否正常,比如GTM主实例所在机器或者备实例所在机器机使用的网卡为eth0,使用下面命令查看网络是否正常。

    复制代码
    /sbin/ifconfig eth0
    • 如果网卡正常,执行3
    • 如果显示网卡不正常,请及时联系硬件工程师修复网卡,再执行3
  3. 查看告警是否仍然存在。

    • 是,执行4
    • 否,处理完毕。

收集故障信息。

  1. 在FusionInsight Manager界面,单击"系统设置 > 日志下载"。
  2. 在"服务"下拉框中勾选"MPPDB",单击"确定"。
  3. 设置日志收集的"开始时间"和"结束时间"分别为告警产生时间的前后1小时,单击"下载"。
相关推荐
liulilittle2 小时前
C++ TAP(基于任务的异步编程模式)
服务器·开发语言·网络·c++·分布式·任务·tap
caolib4 小时前
无需云服务器的内网穿透方案 -- cloudflare tunnel
运维·服务器·内网穿透·tunnel·cloudflared
誰能久伴不乏5 小时前
Linux系统调用概述与实现:深入浅出的解析
linux·运维·服务器
程序员学习随笔5 小时前
Linux进程深度解析(2):fork/exec写时拷贝性能优化与exit资源回收机制(进程创建和销毁)
linux·运维·服务器
-SGlow-6 小时前
MySQL相关概念和易错知识点(2)(表结构的操作、数据类型、约束)
linux·运维·服务器·数据库·mysql
代码改变世界ctw6 小时前
Linux内核设计与实现 - 第14章 块I/O层
linux·运维·服务器
Dreams_l7 小时前
网络编程2(应用层协议,传输层协议)
运维·服务器·网络
明月5667 小时前
Oracle 误删数据恢复
数据库·oracle
数据与人工智能律师7 小时前
数字迷雾中的安全锚点:解码匿名化与假名化的法律边界与商业价值
大数据·网络·人工智能·云计算·区块链
♡喜欢做梦8 小时前
【MySQL】深入浅出事务:保证数据一致性的核心武器
数据库·mysql