【kafka_02】kafka中的基本概念

本文主要有以下内容:

  • kafka 基本架构
  • kafka 基本概念

kafka安装方式:

  • windows参考此文
  • mac或者linux参考这里。需要配合docker 和 docker compose共同使用。

kafka基本架构

kafka的三种术语:

  • 生产者:负责将消息发送给kafka服务器。只要能够将消息发到kafka服务器即可。
  • 消费者:负责从kafka服务器拉取消息进行消费。只要能够从服务器端拉取消息即可。
  • broker:一个kafka实例,即kafka broker,也可称之为kafka服务器。负责存储生产者发送的消息,负责给消费者提供消息消费。kafka通过zookeeper进行消息的管理。broker之间可以形成broker集群,具体关系如下图所示:

消息管理

kafka通过JavaProducerRecord完成了对消息的封装,在发送消息时,需要使用到此类。将消息发送到服务端之后,kafka服务器(kafka进程)需要对发送的消息进行管理,就引出了主题和主题分区这两个术语。

主题:一类消息的集合,如上学时老师布置作业时,不管是语文作业还是数学作业都在作业这一大类里面。是一个逻辑概念

主题分区:主题分区【简称:分区】是消息具体存储的地方。是对主题消息的进一步划分,同一个主题的不同分区存储消息的是不一样。一条消息发送到broker之前,会根据分区规则进行分区选择,从而确定发送到某一个分区上。同一主题的分区可以横跨多个broker

副本机制:kafka为分区引入了副本机制,通过增加副本数量可以提升容灾能力。同一分区的不同副本保存的是相同的信息(同一时刻不一定相同),副本之间一主多从主副本 负责和生产者消费者进行读写 ,从副本负责和主副本之间进行数据同步,即负责从主副本之间拉取数据进行同步。一个分区的副本在集群模式下也不会只存在于一个broker上。否则这个broker挂掉之后,将导致此分区不可用!

假定一个kafka集群由四个broker实例组成,一个主题有三个分区,每一个分区有三个副本,则可能的主题存储方式如下:

分区中所有的副本称之为AR (Assigned Replicas),副本可以分为两部分,一部分是能够与主副本之间保持同步的、另一部分是没有和主副本保持同步的。保持同步的称之为ISR(In Sync Replicas) 这一部分包含leader副本,没有保持同步的称之为(OSR:Out Sync Replicas)此部分不包含leader副本。一个kafka分区副本对应一个log对象,为了避免一个log文件过大,将一个log对象分为多个Log Segment

高水位:标识一个信息的偏移量,消费者只能消费这个位置之前的消息。

LEO:Log End Offset,是下一条日志要写入的位置。图示如下

在kafka集群中,高水位通常由ISR中的最小的LEO确定。如下图所示:

参考资料:

相关推荐
盛派网络小助手2 小时前
微信 SDK 更新 Sample,NCF 文档和模板更新,更多更新日志,欢迎解锁
开发语言·人工智能·后端·架构·c#
∝请叫*我简单先生2 小时前
java如何使用poi-tl在word模板里渲染多张图片
java·后端·poi-tl
zquwei3 小时前
SpringCloudGateway+Nacos注册与转发Netty+WebSocket
java·网络·分布式·后端·websocket·网络协议·spring
dessler3 小时前
Docker-run命令详细讲解
linux·运维·后端·docker
Q_19284999064 小时前
基于Spring Boot的九州美食城商户一体化系统
java·spring boot·后端
ZSYP-S4 小时前
Day 15:Spring 框架基础
java·开发语言·数据结构·后端·spring
Yuan_o_5 小时前
Linux 基本使用和程序部署
java·linux·运维·服务器·数据库·后端
程序员一诺6 小时前
【Python使用】嘿马python高级进阶全体系教程第10篇:静态Web服务器-返回固定页面数据,1. 开发自己的静态Web服务器【附代码文档】
后端·python
DT辰白6 小时前
如何解决基于 Redis 的网关鉴权导致的 RESTful API 拦截问题?
后端·微服务·架构