Elasticsearch知识汇总之ElasticSearch监控方案

ElasticSearch 监控方案

8 .1 ElasticSearch 监控指标

监控指标为磐基生产项指标,以下'监控项名称''指标名称 '使用的公式'都已详细说明,图表如下:

|----------------------------|------------------------------------------------------|------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------|
| 监控项名称 | 指标英文名称 | 使用的公式 |
| elasticsearch集群健康状态 | Elastic_Cluster_Health | elasticsearch_cluster_health_status{job="job",instance=\~"instance",cluster="cluster",color="red"}==1 or (elasticsearch_cluster_health_status{job="job",instance=~"instance",cluster="cluster",color="green"}==1)+4 or (elasticsearch_cluster_health_status{job="job",instance=\~"instance",cluster="cluster",color="yellow"}==1)+22 | | elasticsearch集群健康节点数 | elasticsearch_cluster_health_number_of_nodes | elasticsearch_cluster_health_number_of_nodes{job="job",instance=~"instance",cluster="cluster"} |
| elasticsearch集群健康数据节点数 | elasticsearch_cluster_health_number_of_data_nodes | elasticsearch_cluster_health_number_of_data_nodes{job="job",instance=\~"instance",cluster="cluster"} | | elasticsearch的jvm内存使用 | elasticsearch_jvm_memory_used | elasticsearch_jvm_memory_used_bytes{area="heap"} / elasticsearch_jvm_memory_max_bytes{area="heap"} | | elasticsearch的CPU使用率 | elasticsearch_process_cpu_percent | elasticsearch_process_cpu_percent{} | | elasticsearch磁盘空间使用率 | elasticsearch_filesystem_data_used_percent | 100 \* (elasticsearch_filesystem_data_size_bytes - elasticsearch_filesystem_data_free_bytes) / elasticsearch_filesystem_data_size_bytes | | elasticsearch的负载 | elasticsearch_os_load | elasticsearch_os_load1{job="job",instance=~"instance",cluster="cluster",name=~"name"} elasticsearch_os_load5{job="job",instance=~"instance",cluster="cluster",name=~"name"} elasticsearch_os_load15{job="job",instance=~"instance",cluster="cluster",name=~"$name"} |
| elasticsearch集群未分配片分片状态 | elasticsearch_cluster_health_unassigned_shards | elasticsearch_cluster_health_unassigned_shards{} |
| elasticsearch集群阻塞的任务数 | elasticsearch_cluster_health_number_of_pending_tasks | elasticsearch_cluster_health_number_of_pending_tasks{} |
| elasticsearch线程池中被拒绝的线程数 | elasticsearch_thread_pool_rejected_count | rate(elasticsearch_thread_pool_rejected_count{type!="management"}5m) |
| elasticsearch打开文件描述符数 | elasticsearch_process_open_files_count | elasticsearch_process_open_files_count/elasticsearch_process_max_files_descriptors * 100 |
| elasticsearch线程池活跃的线程数 | elasticsearch_thread_pool_queue_count | elasticsearch_thread_pool_active_count{} |
| elasticsearch JVM GC 垃圾搜集数 | elasticsearch_jvm_gc_collection_seconds_count | irate(elasticsearch_jvm_gc_collection_seconds_count{}5) |
| elasticsearch线程池完成的线程数 | elasticsearch_thread_pool_completed_count | irate(elasticsearch_thread_pool_completed_count{}5) |

8.2 Prometheus 监控

我们可以通过prometheus来取得他的监控指标,如图:截取部分图指标展示:

8.3 Grafana 展示

通过grafana来对它的指标进行监控,如图所示:

相关推荐
大树884 小时前
金刚石散热越强,管路越先见顶
大数据·运维·服务器·人工智能·ai
大志哥1235 小时前
ES和Logstash日志链路系统上线后遭遇切片爆炸(解决)
大数据·elasticsearch
果丁智能6 小时前
物联网智能锁赋能集中式住宿:身份核验与远程权限管控的全链路技术实践
大数据·人工智能·物联网·智能家居
ApacheSeaTunnel6 小时前
实战演示 | 基于 Apache SeaTunnel 与 Apache DolphinScheduler 实现 MySQL 到 Doris 离线定时增量同步
大数据·mysql·开源·doris·数据集成·seatunnel·数据同步
weixin_397574097 小时前
PDF复杂表格的1:1还原引擎:跨页表格自动拼接技术实战
大数据·人工智能·pdf
TableRow7 小时前
参数化搜索的实现原理:从多维索引到查询优化
elasticsearch·全文检索
极光代码工作室7 小时前
基于数据仓库的电商数据分析平台
大数据·hadoop·python·spark·数据可视化
秋名山码民8 小时前
Graph RAG 深度解析:从向量检索到知识推理的技术演进
大数据·人工智能·rag
m0_380167148 小时前
面向开发者的Top10加密货币数据API(2026年最新)
大数据·人工智能·区块链
yyxx4121238 小时前
上海企业如何选择专业的钉钉服务商
java·大数据·人工智能·钉钉