Kafka分区数扩容 Flink未发现新分区

背景

Kafka分区数进行了扩容,但负责消费的Flink没有发现新的分区。

原因

Flink默认是不会动态发现新的分区的。

导致的问题

新kafka分区的数据没有被消费,导致堆积,严重的会导致数据丢失。

解决方案1

适用于低频扩容、缩容kafka分区的场景
重启Flink,让Flink重新从Kafka获取分区数

解决方案2

适用于经常扩容、缩容kafka分区的场景

通过设置参数flink.partition-discovery.interval-millis 大于0 ,来开启自动获取分区。

flink.partition-discovery.interval-millis表示每过多少毫秒,会自动发现分区。

注意

Flink会从新分区的EARLIEST位置开始消费 ,也就是最新位置开始消费,旧的数据不会再消费了。

如果需要动态发现topic,也是该参数控制的,不过仅限通过正则表达式指定topic的方式。

参考文章:

https://blog.csdn.net/zl18310999566/article/details/103736398

相关推荐
董可伦7 小时前
Spark 数据倾斜:原因、定位与处理方法
大数据·分布式·spark
夕除10 小时前
redis--007
数据库·分布式
阿里云云原生11 小时前
深入解析存算分离 Kafka:如何实现从 Topic 到 Iceberg Table 的原生入湖?
kafka
清风与日月16 小时前
Yitter.IdGenerator:高性能分布式唯一ID生成器详解
分布式·c#·.net·.netcore
FfHUCisI17 小时前
Golang Redis 分布式锁
redis·分布式·golang
陈皮波比茶18 小时前
RabbitMQ 消息队列
分布式·rabbitmq
敖行客 Allthinker19 小时前
分布式远程研发团队,借助云 IDE 统一开发环境
ide·分布式
磐链科技1 天前
交场景下的钱包开发痛点:并发交易与消息推送的分布式一致性技术方案
分布式
程序员与背包客_CoderZ1 天前
高性能分布式KV存储引擎RocksDB入门与C/C++编码实战
c语言·开发语言·数据库·c++·分布式·分布式数据库·rocksdb
汽车仪器仪表相关领域2 天前
ZDT‑I伺服电机测试系统:四象限动态加载
大数据·数据库·分布式·功能测试·汽车·压力测试·可用性测试