kafka

2601_9622959920 小时前
python·spark·kafka·情感分析·大规模处理
Spark 和 Kafka 实现 Python 大规模情感分析用 Spark 和 Kafka 实现 大规模情感分析引言:为什么你的笔记本电脑在处理几百万条数据时会“崩溃”?
spter。20 小时前
分布式·kafka
从一次关注到最终一致:Canal、Outbox 与 Kafka 如何解决关系链双写问题知光是一个知识获取与分享社区。用户可以发布图文“知文”、浏览首页 Feed、进入详情页查看作者,也可以关注作者。在页面上,一次关注看起来只是把按钮从“关注”切换成“已关注”,后台却要同时回答几类问题:A 关注了谁、谁关注了 B、A 一共关注了多少人、B 一共有多少粉丝,以及下一次打开列表时怎样快速返回结果。
creator_Li20 小时前
kafka
Kafka的死信队列Kafka本身没有内置死信队列,死信队列是业务层面的设计方案:消费失败、无法正常处理的消息,转发到专门的死信 Topic,不再重复重试消费,避免阻塞消费。
想要打 Acm 的小周同学呀2 天前
分布式·kafka
Kafka消息队列出现挤压如何解决?如果 Kafka 中出现大量消息积压,消费速度长期低于生产速度,应该怎么处理?1先快速解决线上问题,看一下积压的是什么topic业务的数据,如果是日志、埋点、推荐系统的可以直接丢掉,让订单、支付等核心业务逻辑去跑。 本质是快速止血,减少业务的损失。
富士康质检员张全蛋2 天前
分布式·kafka
Kafka实战 自定义分区器 几种常见的分区器kafka topic是可以分为很多很多分区的,每一条消息在Kafka中存储的时候是要选择其中一个分区进行存储的,并且只能存在于一个分区当中。
starzy19902 天前
大数据·flink·kafka
Flink基础之Flink批流数据读取处理案例剖析:从文件到 Kafka 的完整代码前面三篇分别讲了有界/无界流、有状态计算、应用场景。这一篇把视角从「原理」拉回「写代码」:一个 Flink 作业到底是怎么把数据读进来、处理掉、再写出去的。不管什么业务,落到代码上都是同一套三段式结构——Source 读取 → Transform 转换 → Sink 写出——差异只在于数据源有界还是无界。
数智启示录3 天前
数据库·经验分享·分布式·缓存·面试·kafka·apache
Apache Kafka Consumer 扩到 40 个仍不提速:Partition 上限锁死有效并行度 【Kafka合集】告警显示 Lag 上升,值班同学把 Consumer 从 12 个扩到 40 个,吞吐没变,数据库连接却被打满。问题不是 Kafka 不支持水平扩展,而是实例数已经超过可用分区,并把瓶颈推向了下游。
数智启示录3 天前
数据库·经验分享·分布式·mysql·面试·kafka·apache
Apache Kafka 幂等 Producer 的边界:Exactly-Once 到了 MySQL 为什么失效 【Kafka合集】订单消费者先提交 MySQL,再发布积分事件;进程恰在两步之间崩溃。恢复后重放订单,积分被再次发放。Producer 的幂等开关没有失效——它根本看不见这次业务重放。
数智启示录3 天前
经验分享·分布式·面试·kafka·apache
Apache Kafka 不只是消息队列:日志与 Offset 分离如何让事件可重放 【Kafka合集】风控规则上线后,团队发现过去七天漏判了一类订单。订单服务没有重发接口,直接扫描业务库又会冲击线上。此时系统能否补算,不取决于消费者还能不能启动,而取决于七天前的事件是否仍在、消费位置能否独立回退、重复副作用是否可控。
数智启示录3 天前
大数据·数据库·经验分享·分布式·面试·kafka·apache
Apache Kafka 同 Key 仍会乱序:从分区 Offset 到业务可见的四道边界 【Kafka 合集】同一订单的“已支付”先在页面出现,“已创建”随后才到。团队确认两条消息 Key 都是订单号,于是把问题归因给 Kafka。可同 Key 只约束分区映射,不替应用生成顺序,也不替下游串行提交。
老周聊架构3 天前
mysql·flink·kafka
Flink 连接器与生态:Kafka Offset 提交修复与 MySQL Binlog 延迟指标Flink 之所以能在流计算领域站住,靠的不只是引擎本身,更靠连接器(Connector)生态这块基石。作业的「源头」和「去处」都长在连接器上:Kafka 取数、MySQL CDC 抓变更、Hudi/Iceberg 落湖、ClickHouse 写仓……连接器质量直接决定了一条流能不能「读得准、写得对、看得见」。
小白羊丨4 天前
分布式·kafka
Kafka任务重试、退避与失败恢复怎么做?我会把 Kafka 任务失败处理拆成四层:整体流程可以设计为:核心原则是:Kafka 中需要先区分两种性质完全不同的重试。
爱三盖浇饭5 天前
学习·kafka
挑战从零开始学习Kafka2: Kafka 常见问题解决方案在使用 Kafka 时,消息丢失、重复消费和消息积压是比较常见的问题。下面我们来分别介绍对应的处理方法。
山鬼龙王5 天前
kafka
吃透 Kafka:一篇讲清楚核心原理和高频考点本文按"整体认知 → 存储结构 → 副本机制 → Producer → Consumer → 事务 → 运维监控 → 系统设计"的顺序,系统梳理 Kafka 核心知识点与面试高频考点。
pnoker8 天前
物联网·架构·kafka·消息队列·rabbitmq
IoT DC3 消息总线:六适配器可插拔设计消息队列选型的主要成本不在中间件本身,而在耦合:业务代码中散落的发送方、消费方与序列化逻辑一旦绑定特定客户端 SDK,更换队列就意味着大规模重构。
cxhello8 天前
python·kafka
消费者活着、心跳正常、日志干净,但它七天没拉过一条消息本文首发于我的博客:消费者活着、心跳正常、日志干净,但它七天没拉过一条消息八月初的一个周一,我在 Kafka 控制台巡检一个跑了很久的消费组。这个 topic 有 12 个分区,12 个副本的消费服务一一对应,平时安静得没什么存在感。
2601_962064709 天前
spring boot·kafka·linq
SpringBoot 整合 Avro 与 Kafka优质博文:IT-BLOG-CN【需求】:生产者发送数据至 kafka 序列化使用 Avro,消费者通过 Avro 进行反序列化,并将数据通过 MyBatisPlus 存入数据库。### 一、环境介绍【1】Apache Avro 1.8;【2】Spring Kafka 1.2;【3】Spring Boot 1.5;【4】Maven 3.5; <?xml version="1.0" encoding="UTF-8"?> 4.0.0 com.codenotfound spring-kafka-avro 0.0.
HashFlag9 天前
kafka
本地极简安装kafka**安装方式:**macOS/Windows + Docker Desktop + Apache 官方镜像 + KRaft + SASL/PLAIN 用户密码认证的单节点开发环境
ZCBUS实时计算9 天前
大数据·架构·flink·kafka·dba
信创混合存储架构落地实战|基于 ZCBUS 实时计算构建证券高可用实时风控数仓在证券两融、场外交易等核心业务场景中,风控系统需要基于实时资产、客户动态画像快速识别风险,传统 T+1 离线数仓无法满足业务时效要求。 而在信创改造的过渡阶段,项目架构面临多重难点:
Sayai10 天前
zookeeper·架构·kafka
Kafka 去 ZooKeeper 实战评估:KRaft 模式架构解析与生产落地决策指南Kafka 4.0 已经彻底移除了 ZooKeeper,但生产上还有大量集群跑在 ZK 模式上——要不要迁 KRaft、什么时候迁、迁了会踩什么坑?本文基于一次内部技术评估整理:架构原理对比、九个维度逐项评估、核心配置示例、版本演进时间线,最后给出一棵"上不上 KRaft"的决策树。结论先行:新集群直接上,存量集群从 3.6 开始规划迁移,测试环境今天就该用起来。