Elasticsearch知识汇总之ElasticSearch监控方案

ElasticSearch 监控方案

8 .1 ElasticSearch 监控指标

监控指标为磐基生产项指标,以下'监控项名称''指标名称 '使用的公式'都已详细说明,图表如下:

|----------------------------|------------------------------------------------------|------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------|
| 监控项名称 | 指标英文名称 | 使用的公式 |
| elasticsearch集群健康状态 | Elastic_Cluster_Health | elasticsearch_cluster_health_status{job="job",instance=\~"instance",cluster="cluster",color="red"}==1 or (elasticsearch_cluster_health_status{job="job",instance=~"instance",cluster="cluster",color="green"}==1)+4 or (elasticsearch_cluster_health_status{job="job",instance=\~"instance",cluster="cluster",color="yellow"}==1)+22 | | elasticsearch集群健康节点数 | elasticsearch_cluster_health_number_of_nodes | elasticsearch_cluster_health_number_of_nodes{job="job",instance=~"instance",cluster="cluster"} |
| elasticsearch集群健康数据节点数 | elasticsearch_cluster_health_number_of_data_nodes | elasticsearch_cluster_health_number_of_data_nodes{job="job",instance=\~"instance",cluster="cluster"} | | elasticsearch的jvm内存使用 | elasticsearch_jvm_memory_used | elasticsearch_jvm_memory_used_bytes{area="heap"} / elasticsearch_jvm_memory_max_bytes{area="heap"} | | elasticsearch的CPU使用率 | elasticsearch_process_cpu_percent | elasticsearch_process_cpu_percent{} | | elasticsearch磁盘空间使用率 | elasticsearch_filesystem_data_used_percent | 100 \* (elasticsearch_filesystem_data_size_bytes - elasticsearch_filesystem_data_free_bytes) / elasticsearch_filesystem_data_size_bytes | | elasticsearch的负载 | elasticsearch_os_load | elasticsearch_os_load1{job="job",instance=~"instance",cluster="cluster",name=~"name"} elasticsearch_os_load5{job="job",instance=~"instance",cluster="cluster",name=~"name"} elasticsearch_os_load15{job="job",instance=~"instance",cluster="cluster",name=~"$name"} |
| elasticsearch集群未分配片分片状态 | elasticsearch_cluster_health_unassigned_shards | elasticsearch_cluster_health_unassigned_shards{} |
| elasticsearch集群阻塞的任务数 | elasticsearch_cluster_health_number_of_pending_tasks | elasticsearch_cluster_health_number_of_pending_tasks{} |
| elasticsearch线程池中被拒绝的线程数 | elasticsearch_thread_pool_rejected_count | rate(elasticsearch_thread_pool_rejected_count{type!="management"}5m) |
| elasticsearch打开文件描述符数 | elasticsearch_process_open_files_count | elasticsearch_process_open_files_count/elasticsearch_process_max_files_descriptors * 100 |
| elasticsearch线程池活跃的线程数 | elasticsearch_thread_pool_queue_count | elasticsearch_thread_pool_active_count{} |
| elasticsearch JVM GC 垃圾搜集数 | elasticsearch_jvm_gc_collection_seconds_count | irate(elasticsearch_jvm_gc_collection_seconds_count{}5) |
| elasticsearch线程池完成的线程数 | elasticsearch_thread_pool_completed_count | irate(elasticsearch_thread_pool_completed_count{}5) |

8.2 Prometheus 监控

我们可以通过prometheus来取得他的监控指标,如图:截取部分图指标展示:

8.3 Grafana 展示

通过grafana来对它的指标进行监控,如图所示:

相关推荐
小羊没烦恼!2 天前
微服务化的基石——持续集成
java·大数据·word·powerpoint·.net
一隅论数智2 天前
给AI一张“业务概念地图“:本体如何从哲学走向企业智能
大数据·人工智能·经验分享·笔记·学习·学习方法·政务
尧炎科技2 天前
防潮抗变形,就选纯品梅花全桉多层板
大数据
程序员大阳2 天前
副队长大数据教程(5)--集群情况下虚拟机网络配置
大数据·集群·nat·网路
自由能燃气设备2 天前
商用全预混低氮冷凝锅炉免费方案vs付费方案对比+选型避坑指南
大数据·数据库·人工智能
科创致远2 天前
科创致远 ESOP 系统核心效能与实战价值展示
大数据·数据库·人工智能·精益工程
嘉立创FPC苗工2 天前
FPC与机器人的双向赋能,解锁智能装备进化新势能
大数据·人工智能·制造·fpc·电路板
AI职业加油站2 天前
AI智能体应用工程师证书:政策红利下的职业新风口
大数据·运维·人工智能·学习·职场发展
龙亘川2 天前
一网统管AI平台民生业务实践:基于城市数字底座赋能公积金业务服务升级
大数据·安全·智慧城市·开源软件·数据可视化·政务
码流子2 天前
高速公路安全监测实践:碰撞监测预警+物联网底座,从感知到处置的闭环
大数据·人工智能·物联网·算法·架构