Elasticsearch知识汇总之ElasticSearch监控方案

ElasticSearch 监控方案

8 .1 ElasticSearch 监控指标

监控指标为磐基生产项指标,以下'监控项名称''指标名称 '使用的公式'都已详细说明,图表如下:

|----------------------------|------------------------------------------------------|------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------|
| 监控项名称 | 指标英文名称 | 使用的公式 |
| elasticsearch集群健康状态 | Elastic_Cluster_Health | elasticsearch_cluster_health_status{job="job",instance=\~"instance",cluster="cluster",color="red"}==1 or (elasticsearch_cluster_health_status{job="job",instance=~"instance",cluster="cluster",color="green"}==1)+4 or (elasticsearch_cluster_health_status{job="job",instance=\~"instance",cluster="cluster",color="yellow"}==1)+22 | | elasticsearch集群健康节点数 | elasticsearch_cluster_health_number_of_nodes | elasticsearch_cluster_health_number_of_nodes{job="job",instance=~"instance",cluster="cluster"} |
| elasticsearch集群健康数据节点数 | elasticsearch_cluster_health_number_of_data_nodes | elasticsearch_cluster_health_number_of_data_nodes{job="job",instance=\~"instance",cluster="cluster"} | | elasticsearch的jvm内存使用 | elasticsearch_jvm_memory_used | elasticsearch_jvm_memory_used_bytes{area="heap"} / elasticsearch_jvm_memory_max_bytes{area="heap"} | | elasticsearch的CPU使用率 | elasticsearch_process_cpu_percent | elasticsearch_process_cpu_percent{} | | elasticsearch磁盘空间使用率 | elasticsearch_filesystem_data_used_percent | 100 \* (elasticsearch_filesystem_data_size_bytes - elasticsearch_filesystem_data_free_bytes) / elasticsearch_filesystem_data_size_bytes | | elasticsearch的负载 | elasticsearch_os_load | elasticsearch_os_load1{job="job",instance=~"instance",cluster="cluster",name=~"name"} elasticsearch_os_load5{job="job",instance=~"instance",cluster="cluster",name=~"name"} elasticsearch_os_load15{job="job",instance=~"instance",cluster="cluster",name=~"$name"} |
| elasticsearch集群未分配片分片状态 | elasticsearch_cluster_health_unassigned_shards | elasticsearch_cluster_health_unassigned_shards{} |
| elasticsearch集群阻塞的任务数 | elasticsearch_cluster_health_number_of_pending_tasks | elasticsearch_cluster_health_number_of_pending_tasks{} |
| elasticsearch线程池中被拒绝的线程数 | elasticsearch_thread_pool_rejected_count | rate(elasticsearch_thread_pool_rejected_count{type!="management"}[5m]) |
| elasticsearch打开文件描述符数 | elasticsearch_process_open_files_count | elasticsearch_process_open_files_count/elasticsearch_process_max_files_descriptors * 100 |
| elasticsearch线程池活跃的线程数 | elasticsearch_thread_pool_queue_count | elasticsearch_thread_pool_active_count{} |
| elasticsearch JVM GC 垃圾搜集数 | elasticsearch_jvm_gc_collection_seconds_count | irate(elasticsearch_jvm_gc_collection_seconds_count{}[5]) |
| elasticsearch线程池完成的线程数 | elasticsearch_thread_pool_completed_count | irate(elasticsearch_thread_pool_completed_count{}[5]) |

8.2 Prometheus 监控

我们可以通过prometheus来取得他的监控指标,如图:截取部分图指标展示:

8.3 Grafana 展示

通过grafana来对它的指标进行监控,如图所示:

相关推荐
CyberwayTech27 分钟前
赛博威线上营销费用管理:咨询+系统,双轮驱动ROI增长
大数据·人工智能
NOCSAH30 分钟前
统好AI:助力企业智改数转的务实实践
大数据·人工智能·统好ai
Sinokap34 分钟前
GPT-5.5 上线:OpenAI 把 AI 推向真实办公场景
大数据·人工智能
七颗糖很甜37 分钟前
“十五五”气象发展规划:聚焦五大核心任务
大数据·python·算法
科研前沿44 分钟前
镜像视界浙江科技有限公司的关键技术突破有哪些?
大数据·人工智能·科技·算法·音视频·空间计算
captain_AIouo1 小时前
聚焦实操赋能,Captain AI系统功能实操指南及价值解读
大数据·人工智能·经验分享·aigc
个微管理1 小时前
小红书新规深度拆解:从被封到破局,2026年矩阵号生存手册
大数据·人工智能·矩阵
2601_956414141 小时前
适合 Reddit 多账号运营的指纹浏览器推荐哪款?
大数据
chaofan9801 小时前
GPT-5.5 深度评测:15项基准测试全优,视觉理解精度跃升 42%
大数据·人工智能·gpt·计算机视觉·api
2301_776045231 小时前
估值和市值的区别(股票与加密资产)
大数据·人工智能