Kafka Broker总体工作流程

上面是Zookeeper集群,下面是Kafka集群,两个集群通信:

1)每台Kafka Broker节点启动之后,都会向Zookeeper进行注册,告诉他,我开启了。Zookeeper注册0,1,2;三台Broker启动之后,在Zookeeper里的/brokers/ids/就会增加三个节点;

  1. 注册完毕之后,Zookeeper就会选择Controller节点,每台Kafka Broke里面都有一个Controller,谁会成为未来Leader选举的老大呢?controller谁先注册,谁说了算,他们争先抢占名额,谁抢到了,谁负责日后Leader选举,假设broker0中的Controller抢到了;

3)上任第一天,由选举出来的Controller 监听brokers节点变化,随后Controller决定Leader选举。先来解释一下AR,AR:Kafka分区中 的所有副本统称。选举规则:在isr中存活为前提,按 照AR中排在前面的优先。例如 ar1,0,2, isr 1,0,2,那么leader 就会按照1,0,2的顺序轮询;

  1. 假设现在选举出来Broker1为Leader,Controller将节点信息上传到ZK进行备份,告诉它我选了Broker1为Leader, isr 为1,0,2,(图中的5);

  2. 其他contorller从zk同步相关信息,这样如果Controller Leader挂了,他们随时准备上位;

6)生产者往集群里发送数据,Follower主动跟Leader同步信息,底层存储的是Segment,大小1G;

7)集群应答,假设Leader挂了,Controller就能够监控到节点变化,从Zookeeper获取ISR,重新选举,选举规则一致,选举新的Leader之后,更新Zookeeper中的信息(Leader及ISR)。

相关推荐
weixin_424183613 小时前
开放—封闭原则实战(下):基于策略的流程编排与编译期多态
c++·分布式·系统架构
frjc8 小时前
分布式事务:场景与选型决策表
分布式
GISMagic8 小时前
5.《Designing Data-Intensive Applications》:系统设计与分布式能力提炼
分布式·ai coding
需要82611 小时前
分布式 ID 生成:雪花算法、号段模式与时钟回拨
分布式·算法
灯澜忆梦15 小时前
【RabbitMQ #11】 | 消费者可靠性
分布式·rabbitmq·ruby
仍然.15 小时前
RabbitMQ---事务和消息分发
分布式·rabbitmq
灯澜忆梦16 小时前
【RabbitMQ #9】 | 生产者可靠性
分布式·rabbitmq
此时不提桶,更待何时17 小时前
06-09-A-Kafka架构与存储原理详解
架构·kafka·linq
银河技术18 小时前
TB级文本去重实战:从单机 OOM 到 Spark / Ray 分布式架构的工程演进
分布式·微服务·重构·架构·spark·llm·rag
deepdata_cn19 小时前
从集中式到分布式:Data Mesh颠覆传统数据架构的底层逻辑
分布式·data mesh