Kafka基础

一、Kafka是什么?

Kafka已经定位成一个分布式流式处理平台,它以高吞吐、可持久化、可水平扩展、支持流数据处理等多种特性而广泛使用。

Kafka主要是三大角色:

消息系统:提供了大多数消息系统难以实现的消息顺序性保障以及回溯消费的功能。

存储系统:Kafka把消息持久化到磁盘相比于其他基于内存存储的系统而言,有效降低了数据丢失的风险。消息持久化的功能和多副本机制。

流式处理平台:完整的流式处理类库。

二、Kafka核心概念

  1. Producer(生产者) : 生产消息的一方。
  2. Consumer(消费者) : 消费消息的一方。
  3. Broker(代理) : 服务代理节点,对于kafka而言,broker可以看作是一个独立的kafka服务节点或kafka服务实例。大多数情况下可以将broker看作一台kafka服务器。

同时,你一定也注意到每个 Broker 中又包含了 Topic 以及 Partition 这两个重要的概念:

  • Topic(主题) : Producer 将消息发送到特定的主题,Consumer 通过订阅特定的 Topic(主题) 来消费消息。主题是逻辑上的概念,它还可以细分为多个Partition。
  • Partition(分区) : Partition 属于 Topic 的一部分。一个 Topic 可以有多个 Partition ,并且同一个 Topic 下的 Partition 可以分布在不同的 Broker 上,这也就表明一个 Topic 可以横跨多个 Broker 。一个Partition只属于单个Topic,同一Topic下的不同Partition包含的消息是不同的,Partition在存储层面可以看作是一个可追加的日志文件,消息在被追加到分区日志文件的时候都会分配一个特定的偏移量(offset) 。offset是消息在Partition中的唯一标识,kafka通过它来保证消息在Partition内的顺序性,不过offset并不跨越分区,也就是说,kafka保证的是分区有序而不是主题有序。
相关推荐
lee_curry8 小时前
AI Agent 工程师完整学习路线(面向生产级项目与面试)
人工智能·学习·ai·面试·agent
江湖十年9 小时前
在 Go 中使用 dyno 包处理动态对象
后端·面试·go
数智启示录10 小时前
PostgreSQL 内存调优实战(第 12 篇):work_mem 只调大 64 倍,峰值为什么远不止 64 倍
运维·数据库·经验分享·postgresql·面试
刀法如飞12 小时前
《理解道德经》简版第5章:天地不仁,以万物为刍狗
面试·机器人
wuyk55513 小时前
107.FreeRTOS 链表深度解析:从原理到面试满分答案
c语言·开发语言·数据结构·stm32·单片机·链表·面试
数智启示录15 小时前
PostgreSQL 执行计划实战(第 9 篇):SQL 和索引没变,计划为什么突然慢一百倍
数据库·经验分享·sql·postgresql·面试
数智启示录16 小时前
Apache Kafka Consumer 扩到 40 个仍不提速:Partition 上限锁死有效并行度 【Kafka合集】
数据库·经验分享·分布式·缓存·面试·kafka·apache
数智启示录16 小时前
Apache Kafka 幂等 Producer 的边界:Exactly-Once 到了 MySQL 为什么失效 【Kafka合集】
数据库·经验分享·分布式·mysql·面试·kafka·apache
CoderYanger16 小时前
A.每日一题:3622. 判断整除性
java·程序人生·算法·leetcode·面试·职场和发展·蓝桥杯
数智启示录16 小时前
Apache Kafka 不只是消息队列:日志与 Offset 分离如何让事件可重放 【Kafka合集】
经验分享·分布式·面试·kafka·apache