一文读懂Kafka中的“消费”(对标MySQL数据库)

一、通俗理解Kafka的消费

消费 = 读取数据 + 执行业务处理 + 记录读取位置

Kafka存了一堆实时数据,Flink/程序把这些数据拿出来、读一遍、做计算处理,这个全过程就叫消费。

二、对标关系型数据库(MySQL为例)

Kafka消费 ≈ MySQL 执行 SELECT 查询 + 逐行处理数据

1、场景对标

MySQL:写 SELECT * FROM order_table; → 查出表里的数据 → 做统计、过滤、分析

Kafka:Flink任务持续读取Topic数据 → 过滤、开窗、聚合统计 → 这就是消费数据

2、核心组件对标

  • Kafka Topic = MySQL 一张数据表

  • Kafka 消息(每条数据) = MySQL 表里的每一行数据

  • 消费数据 = SELECT 读取表数据 + 业务计算

  • Offset(书签) = MySQL 的「读取游标」,记录读到第几行了

三、Kafka消费和MySQL查询的核心区别

既然都是读数据,为什么Kafka叫消费?因为和普通SQL查询有本质区别,这是实时和离线的核心差异。

1. 执行模式不同

MySQL查询:一次性执行,查完结束,静态读离线数据

Kafka消费:永久运行、持续监听,新数据一来,立刻自动读取处理,永不停止

2. 读取位置不同

MySQL:每次SELECT都是从头查全表数据

Kafka消费:靠Offset书签,只读新数据、从未读的位置继续读,不会重复读历史数据(同消费者组内)

3. 数据属性不同

MySQL:数据是静态的,固定存在表里

Kafka:数据是动态流式的,源源不断新增,属于无界数据

一言以蔽之,Kafka消费就是持续读取流式数据并处理,等价于MySQL的SELECT查询,只是变成了7*24小时不间断、增量读取的实时查询。(博主个人见解,非官方)

相关推荐
Nontee7 小时前
MySQL 插入冲突了怎么办?两种处理方式入门笔记
数据库·笔记·mysql
ltl7 小时前
Parquet 文件格式:row group、编码与谓词下推索引
数据库
ltl7 小时前
PostgreSQL Join 路径:优化器如何选中 Nested Loop
数据库
ltl8 小时前
RocksDB 生产嵌入:Flink、TiKV 与 Kafka Streams 怎么用
数据库
devilnumber9 小时前
MySQL 性能优化・诗意化记忆
数据库·mysql·性能优化
瀚高PG实验室10 小时前
PostgreSQL pg_basebackup 和 pg_rewind 可覆盖源端超级用户选择的无关文件HGVE-2026-E010
数据库·postgresql·瀚高数据库
宠友信息11 小时前
社区类源码开发实践中的仿小红书系统技术要点分析
java·spring boot·redis·mysql·uni-app·vue·内容运营
OceanBase数据库官方博客12 小时前
亮相“十五五”公积金高质量发展大会“AI 数据库”助力智慧公积金升级
数据库·人工智能
Lyra_Infra12 小时前
MySQL Docker 误删恢复:binlog PITR
mysql·docker·命令行
龙虾PRO12 小时前
高并发场景数据库调优实操:目标定位、监控方法与优化维度全解析
数据库·oracle