大数据-之LibrA数据库系统告警处理(ALM-37015 Gaussdb进程可用文件句柄资源不足)

告警解释

操作系统环境文件句柄不足时,产生该告警。

告警属性
告警ID 告警级别 可自动清除
37015 严重
告警参数
参数名称 参数含义
ServiceName 产生告警的服务名称
RoleName 产生告警的角色名称
HostName 产生告警的主机名
Instance 产生告警的实例
对系统的影响

发生文件句柄不足时,部分实例可能无法启动,集群将无法正常启动。

可能原因

操作系统文件句柄不足。

处理步骤
  1. 使用omm用户登录告警上报的节点。

  2. 初始化环境变量。

    复制代码
    source ${BIGDATA_HOME}/mppdb/.mppdbgs_profile
  3. 执行以下命令连接数据库。

    复制代码
    gsql -d postgres  -p  25308
  4. 执行以下命令,查询max_files_per_process参数的取值是否小于默认值3000。

    复制代码
    SHOW max_files_per_process;

    回显如下类似信息。

    复制代码
     max_files_per_process 
    -----------------------
     2000
    (1 row)
    • 是,执行5
    • 否,执行7
  5. 先退出数据库,再执行以下命令修改max_files_per_process参数取值为3000。

    复制代码
    \q  
    gs_guc set -Z coordinator -Z datanode -N all -I all -c 'max_files_per_process=3000'
  6. 执行以下命令重启集群生效。

    复制代码
    gs_om -t stop
    gs_om -t start
  7. 检查操作系统文件句柄,关闭占用文件句柄资源较多的与数据库无关的进程。 说明: 可通过如下命令检查操作系统文件句柄配置数目以及各个进程占用的句柄数目。其中第二个命令中第一列显示的是占用的句柄数,第二列显示的为进程PID。可以关闭一些占用文件句柄较多的不重要的进程。

    复制代码
  8. 等待一段时间,查看告警是否仍然存在。

    • 是,执行9
    • 否,处理完毕。

    收集故障信息。

  9. 在FusionInsight Manager界面,单击"系统设置 > 日志下载"。

  10. 在"服务"下拉框中勾选"MPPDB",单击"确定"。

  11. 设置日志收集的"开始时间"和"结束时间"分别为告警产生时间的前后1小时,单击"下载"。

相关推荐
陆水A12 分钟前
数仓主题域划分
大数据·数据仓库·数据库开发·etl·etl工程师
道一云黑板报13 分钟前
Spark初探:揭秘速度优势与生态融合实践
大数据·分布式·spark·流式处理
小王子102417 分钟前
Django模型关系:从一对多到多对多全解析
数据库·mysql·django·orm
字节跳动数据平台1 小时前
火山引擎多模态数据湖:AI时代的数据湖如何挖掘图片、视频、语音的“富矿”?
大数据
野生技术架构师1 小时前
系统改造:一次系统领域拆分的实战复盘
java·大数据·开发语言
南玖yy2 小时前
C++多态:面向对象编程的灵魂之
运维·开发语言·数据库·c++·后端·c·c语音
极限实验室2 小时前
INFINI Labs 产品更新 - Coco AI v0.7.0 发布 - 全新的文件搜索体验与全屏化的集成功能
数据库·搜索引擎·产品
染落林间色3 小时前
达梦数据库(DM Database)角色管理详解|了解DM预定义的各种角色,掌握角色创建、角色的分配和回收
数据库·sql·mysql
老纪的技术唠嗑局3 小时前
走出三大困境,深耕五大场景 | 好未来AI业务探索OceanBase实现降本86%
运维·数据库·架构