Flink Rebalance触发乱序的问题

前言

Flink中的Rebalance是一种分区算子,主要用于实现数据流的负载均衡。其核心机制是通过Round-Robin轮询策略将输入数据均匀分配到下游算子的所有并行任务中。

遇到的问题

发现上游kafka source中数据相差几毫秒的数据,在通过计算,最终下发到sink出现于实际业务不能对齐的问题。

排查问题

发现近期加了一个filter算子,用于过滤不必要的数据,但他的算子链接方式为rebalance

解决问题

将算的连接方式改为hash,根据唯一键keyby,解决问题。

相关推荐
火星上的鱼2 分钟前
2025年中国餐饮行业发展分析报告
大数据·人工智能
维核科技11 分钟前
三个业务共用一台服务器,显存不够用了
大数据·服务器·人工智能
lailai041017 分钟前
AI远程控制的技术原理与实现路径
大数据·人工智能
科创致远18 分钟前
芜湖新能源汽车配套企业的多工厂命题:复制一家工厂,复制的是标准esop
大数据·人工智能·汽车·精益工程
StarRocks_labs20 分钟前
StarRocks 存算分离架构下的大规模实时导入优化实践
starrocks·flink·sstable·compaction·tablet·主键索引·存算分离架构
FPC_小西36 分钟前
PCB化学沉金的作用有哪些?
大数据·人工智能·ai·pcb工艺·排线
Gain_chance40 分钟前
大数据毕业设计实战|Data Insight Platform:用 FastAPI + ClickHouse 打造低门槛全链路数据洞察平台
大数据·数据库·clickhouse·毕业设计·fastapi
满怀冰雪3 小时前
24-PaddleClas 模型评估、导出与推理部署入门
大数据·人工智能·python·深度学习·paddle
薛定谔的悦6 小时前
储能 EMS 的功率策略:从一块电表到一次逆流的 200 毫秒
大数据·linux·能源·储能·bms
2601_962218479 小时前
万象生鲜系统区块链溯源技术帮助生鲜企业搭建食品安全数字化体系
大数据·运维·微服务·云原生·架构