Flink性能指标详解MetricsAnalysis

文章目录

1.JobManager

管理任务

  • 作业调度:负责接收和调度作业,分配任务到 TaskManager。
  • 资源管理:管理集群资源,协调 TaskManager 的启动和停止。
  • 故障恢复:负责作业的故障恢复,重新调度失败的任务。

JobManager 相关参数:

  • jobmanager.memory.process.size:JobManager 进程的总内存大小。
  • jobmanager.rpc.address:JobManager 的 RPC 通信地址。
  • jobmanager.rpc.port:JobManager 的 RPC 通信端口。

2.TaskManager

执行任务

  • 任务执行:负责执行分配给它的任务(如数据处理、计算等)。
  • 资源管理:管理分配给它的资源(如 CPU、内存等)。
  • 心跳机制:定期向 JobManager 发送心跳,报告自身状态。

TaskManager 相关参数:

  • taskmanager.numberOfTaskSlots:每个 TaskManager 提供的任务槽数量。
  • taskmanager.memory.process.size:TaskManager 进程的总内存大小。
  • taskmanager.network.memory.fraction:TaskManager 分配给网络缓冲区的内存比例。

3.ResourceManager

资源管理

  • 资源分配:管理集群资源,分配资源给 TaskManager。
  • 资源回收:回收不再使用的资源,优化资源利用。
  • 资源监控:监控集群资源的使用情况,确保资源的合理分配。

4.Dispatcher

分发器

  • 作业分发:接收客户端提交的作业,分发给 JobManager。
  • 作业管理:管理作业的生命周期,包括提交、调度和完成。
  • 作业监控:提供作业的监控信息,如进度、日志等。

Dispatcher 相关参数:

  • dispatcher.address:Dispatcher 的地址。
  • dispatcher.port:Dispatcher 的端口。

5.Client

提交任务

  • 作业提交:负责将作业提交到 Flink 集群。
  • 作业配置:配置作业的参数和资源需求。
  • 作业监控:监控作业的执行状态,提供日志和性能指标。

6. Env

环境

  • 执行环境配置:配置作业的执行环境,包括并行度、资源需求等。
  • 作业执行:执行作业的逻辑,包括数据源、转换和数据汇出。

环境参数

  • parallelism.default:默认的并行度。
  • execution.batch.speculative.enabled:是否启用推测执行。

JobManager Metrics

TaskManager Metrics

堆内存计算:

相关推荐
Gain_chance1 小时前
36-学习笔记尚硅谷数仓搭建-DWS层数据装载脚本
大数据·数据仓库·笔记·学习
每日新鲜事2 小时前
热销复盘:招商林屿缦岛203套售罄背后的客户逻辑分析
大数据·人工智能
AI架构全栈开发实战笔记3 小时前
Eureka 在大数据环境中的性能优化技巧
大数据·ai·eureka·性能优化
AI架构全栈开发实战笔记3 小时前
Eureka 对大数据领域服务依赖关系的梳理
大数据·ai·云原生·eureka
自挂东南枝�3 小时前
政企舆情大数据服务平台的“全域洞察中枢”
大数据
weisian1514 小时前
Elasticsearch-1--什么是ES?
大数据·elasticsearch·搜索引擎
LaughingZhu4 小时前
Product Hunt 每日热榜 | 2026-02-08
大数据·人工智能·经验分享·搜索引擎·产品运营
玄同7654 小时前
Git常用命令指南
大数据·git·elasticsearch·gitee·github·团队开发·远程工作
瑞华丽PLM6 小时前
电子行业国产PLM系统功能差异化对比表
大数据·plm·国产plm·瑞华丽plm·瑞华丽
深圳市恒星物联科技有限公司7 小时前
水质流量监测仪:复合指标监测的管网智能感知设备
大数据·网络·人工智能