# Kafka组件化及拓展

1.Kafka

Kafka是一个开源的分布式事件流处理平台。主要用于构建实时数据管道和流处理应用程序,广泛用于日志采集。Kafka具有高吞吐量、高可用性、持久化存储、可拓展性等特点。因为公司项目中消息中间件都是用的Kafka,而且也发现在使用时有一些亮点和设计,所以想展开整理记录下,希望给有想使用Kafka作为中间件的朋友一些帮助。

2.Kafka怎么保证消息的可靠性

这里讲的可靠性主要是针对发布时的可靠性,这也是消息可靠性(发布、持久化、消费)最重要的一环,实现思路的话也很简单,简单描述就是支持发布可重试,实现如下:

  • 数据库中增加一张kafka_message表,在发布消息时先插入消息到kafka_message表
  • 增加一个定时任务,不断查询kafka_message表,遍历发布消息到kafka,然后再从kafka_message表删除发布成功的记录

另外消费时可靠性主要靠消费机制保证MessageDeliverySemantics=AT_LEAST_ONCE

3.Kafka组件化及多集群消息消费实现

a.组件化

组件指的是软件系统中的独立单元。因为Kafka本身已经算是一个消息组件,我在此处指的是通过将kafka、redis等中间件抽象成:组件类型、组件名称,通过这两个概念可以拿到该组件的一个集群地址去使用,在后面的内容中也会使用这种概念。

b. 多集群消息消费实现

  • 一些抽象类及枚举:

    • AbstractEventProcessor,消费者

      复制代码
      protected abstract void process(String msg); //消费消息实现
      
      public abstract int runners();  //消费者数量
      
      public abstract KafkaTopic topic();  //消费的主题
    • IConsumerGroupContext ,消费者组上下文接口,抽象了同一类消费者

      复制代码
      Properties getConsumerProperties();//单次拉取消息条数、序列化工具类、反序列化工具类
      
      Class<? extends AbstractEventProcessor> getProcessorClass(); //获取消息处理类
      
      MessageDeliverySemantics getDeliverySemantics(); //消费重试机制
      
      KafkaTopic getTopic(); //消息主题
       
      String getBootstrapServers();  //连接地址
    • KafkaClusterType : Kafka集群枚举,会配置成跟一个组件名对应的形式如

      复制代码
      {"TEST":"Kafka1","TESTNEW":"Kafka2"}
    • KafkaTopic,主题枚举,例如

      复制代码
      TEST_TOPIC("test", "测试topic", KafkaClusterType.TEST)
    • ConsumerRunnerPoolConfig,消费者线程池配置,包含Topic、processor、runner(消费者数量)

    • ConsumerRunnerPool, 消费者线程池类

  • 消费者启动的大概流程

    • 读取需要消费的Topic

    • 根据Topic 获取过滤获得对应的IConsumerGroupContext类,contextList

    • 遍历contextList,context

      • 根据context填充ConsumerRunnerPoolConfig

      • 再根据ConsumerRunnerPoolConfig去启动ConsumerRunnerPool

        核心线程池和最大线程池都是消费者数量,可以通过硬编码/配置

整体思路比较简单,但是抽象支持集群和组件配置后,可以支持集群切换或多集群,这对于灵活应对Kafka集群的切换和灾备是很有意义的。

相关推荐
Matrix702 小时前
Kafka 单节点测试环境部署实战
大数据·kafka
电磁脑机3 小时前
人脑电磁路由拓扑与外耦合脑机接口基础理论
分布式·神经网络·安全·交互
马剑威(威哥爱编程)3 小时前
HarmonyOS 6.0 分布式任务调度 API 详解:把多设备玩成单设备
分布式·华为·harmonyos
嵌入式老牛3 小时前
SST专题3-1 基于光分路器的MMC分布式控制系统架构
分布式·架构·驱动·光纤·sst
F_D_Z4 小时前
Word Embedding :从分布式假设到神经网络语言模型
分布式·word·embedding
feifeigo1235 小时前
航天器交会的分布式模型预测控制(DMPC)MATLAB实现
开发语言·分布式·matlab
CET中电技术6 小时前
CET中电技术如何助光伏企业在“四可“时代抢占先机?
分布式
Elastic 中国社区官方博客6 小时前
将 Logstash 管道从 Azure Event Hubs 迁移到 Kafka 输入插件
大数据·数据库·elasticsearch·microsoft·搜索引擎·kafka·azure
人间打气筒(Ada)6 小时前
「码动四季·开源同行」go语言:如何使用 ELK 进行日志采集以及统一处理?
开发语言·分布式·elk·go·日志收集·分布式日志系统
indexsunny7 小时前
互联网大厂Java面试实录:Spring Boot到微服务的深入探讨
java·spring boot·微服务·面试·eureka·kafka·jwt