kafka

apgk12 小时前
docker·kafka·rabbitmq
基于Canal实现mysql数据同步到消息队列(RabbitMQ/Kafka)详细操作教程由于网络网闸问题,目前采用canal进行解析mysql,然后推送到mq,再次进行消费写入数据库。以下基于 arm64 linux ubuntu24、mysql 8.0、 docker部署、canal-server v1.1.8、kafka v3.9.0、rabbitmq v4.3.2
liudashuang20178 小时前
java·分布式·kafka·linq
Kafka Producer 隐藏深坑:Sender 线程自阻塞(自死锁)导致 BufferExhaustedException 完整复盘线上订单推送链路出现大量 BufferExhaustedException: Available memory: 0,Disruptor 订单工作线程长时间阻塞,最终定位根因并非单纯缓冲区打满,而是一处极易踩坑的Sender 线程自阻塞(Self-Deadlock,自死锁)。
小张同学a.11 小时前
linux·运维·elk·elasticsearch·架构·kafka·filebeat
ELK企业级日志分析平台3——ES数据备份 & 集群监控 & ELFK+Kafka 架构部署nfs 服务端配置ES节点配置server2和server3同上 滚动重启 ES集群重启之后恢复默认值
富士康质检员张全蛋12 小时前
kafka
Kafka 的Log-Log Compaction前段消息其实是已经别压缩过的,而后面的部分是没有被压缩过的,97是下次写消息进来的时候保存的offset。
富士康质检员张全蛋4 天前
kafka
Kafka 事物幂等性是无法保证分区之间是生效的,但是有了事务可以解决跨分区写入消息,通过原子性。生产者给0分区发送消息失败了,失败了1分区就不需要发了。
wear工程师5 天前
java·kafka
Kafka 消费者心跳正常,为什么还会被踢出组?拆清 max.poll.interval.ms有一类消费延迟问题很绕:进程没挂,网络也通,监控里的心跳看着还算正常,但消费者还是反复重平衡,最后在提交 offset 时撞上了 CommitFailedException。
成为你的宁宁6 天前
分布式·kafka
【Kafka KRaft 集群】提示:本文原创作品,良心制作,干货为主,简洁清晰,一看就会Kafka 作为主流的分布式消息中间件,被广泛应用于日志收集、异步解耦、流量削峰等业务场景。自 Kafka 2.8.0 版本正式推出 KRaft 内置 Raft 协议后,彻底移除了 ZooKeeper 依赖,简化架构、提升集群稳定性与性能。为帮助快速掌握新版 Kafka,本文先系统讲解 Kafka 核心基础原理,再手把手完成 KRaft 模式三节点集群搭建与测试,实现原理理解与工程落地一体化
2601_960906727 天前
kafka·hbase·flume·storm
地球或逃逸到相对安全的日心轨道北京时间8月5日14时35分,一枚在太空中漂泊了近19个月SpaceX猎鹰9号火箭第二级残骸,以每秒约2.4公里(约7倍音速)的速度撞击月球西侧的爱因斯坦陨石坑附近区域,完成了它最终的宿命。
creator_Li7 天前
分布式·kafka
Kafka深入刨析-Consumer为什么 Kafka Consumer 的并发模型值得深入研究?大多数 Java 并发库的答案是 synchronized 或 ReentrantLock + Condition。Kafka Consumer 走了完全不同的路线:它刻意不支持多线程并发访问,用 CAS 做归属检查而非做同步,用 Wakeup 做 "唯一后门" 而非给所有 API 加并发安全。
JHC0000008 天前
分布式·kafka
基于 DrissionPage 与 Xvfb 的分布式无头爬虫架构该脚本的设计目标是实现一个在无 GUI 环境(Linux)中运行的高可靠性网页采集器。整体架构采用了“控制流与日志流彻底分离”、“单线程严格物理超时熔断”、“多实例端口级精准隔离”以及“网络数据包拦截与 DOM 节点反向注入”等核心设计模式。
java1234_小锋9 天前
大数据·spark·kafka·实时医疗健康数据监测·实时疾病预测系统
【免费】基于Spark实时医疗健康数据监测与疾病预测系统(Java版本+可视化大屏+Kafka+SpringBoot+Vue3) 锋哥原创出品,必属精品大家好,我是Java1234_小锋老师,分享一套锋哥原创的基于Spark实时医疗健康数据监测与疾病预测系统(Java版本+可视化大屏+Kafka+SpringBoot+Vue3)
放学-别走10 天前
大数据·flink·kafka
flink和kafka常见面试题1. Kafka 为什么吞吐量这么高? Kafka 之所以吞吐量高,主要依赖以下几个设计:首先,Kafka 采用顺序写磁盘,消息以追加方式写入 Log 文件,避免随机 I/O 带来的性能损耗,使磁盘写入效率非常高。
菜地里的小菜鸟10 天前
kafka·kraft·k8s部署单节点kafkakraft模式·k8s部署kafka
k8s部署单节点 Kafka(KRaft 模式)并启用 SASL 认证https://www.cnblogs.com/Leonardo-li/p/18796443https://www.cnblogs.com/Leonardo-li/p/18813140
Volunteer Technology10 天前
分布式·kafka·linq
Kafka的消费全流程我们接着继续去理解最后这条消息是如何被消费者消费掉的。其中最核心的有以下内容。1、多线程安全问题2、群组协调
篮框坏了10 天前
kafka
Kafka 消费者卡死排查:一个 topic 堵了 18 小时,监控全绿没人发现Kafka 消费者卡死的一次真实故障复盘:LAG 一直涨、CURRENT-OFFSET 不动、消费者被反复踢出组,而告警群里一条消息都没有。凶手是三个单独看都"没毛病"的设计叠在一起。文末第六节是可直接照抄的 5 步排查清单(含 kafka-consumer-groups.sh / jstack 命令),遇到"消息不动了但不报错"照着走一遍就能定性。
敲个大西瓜11 天前
kafka
Kafka一百道核心面试题Kafka 面试题 100 道(对标阿里 P6 级别)说明:本题集覆盖Kafka核心原理、源码机制、性能调优、故障排查、架构设计等维度,对标阿里P6(高级工程师)面试深度。题目按难度渐进排列,每道题均需掌握底层原理而非常识性记忆。
java1234_小锋11 天前
java·大数据·spark·kafka·实时交通流量分析与拥堵预测
【免费】基于Spark实时交通流量分析与拥堵预测系统(Java版本+可视化大屏+Kafka+SpringBoot+Vue3) 锋哥原创出品,必属精品大家好,我是Java1234_小锋老师,分享一套锋哥原创的基于Spark实时交通流量分析与拥堵预测系统(Java版本+可视化大屏+Kafka+SpringBoot+Vue3)
后端观测站11 天前
kafka·java-rocketmq
第三篇:消息队列如何保证消息可靠性?消息队列如何保证消息可靠性?上一篇我们聊了《消息为什么能够解耦系统?》消息队列之所以能够解耦,本质上是因为它在生产者和消费者之间增加了一个Broker,让双方不再直接调用,而是通过消息进行通信。
布鲁飞丝12 天前
分布式·kafka
kafka 副本集设置和理解大家好,我是你们的老朋友——资深技术博主。今天我们来聊聊 Kafka 中一个非常核心但又容易被初学者忽略的概念:副本集。如果你用过 Kafka,肯定知道它是个高吞吐、高可用的消息队列,但高可用是怎么实现的?答案就藏在副本集(Replica)里。简单来说,副本集就是数据的一份“备份”,确保当某台机器挂了,数据不丢、服务不停。本文会用通俗的语言、结合实际代码,带你彻底搞懂副本集。## 什么是 Kafka 副本集?先打个比方:假设你写了一篇重要论文,只存在一台电脑里。如果电脑坏了,论文就没了。但如果你把论文复制
香菜TTT13 天前
分布式·架构·kafka·linq
Kafka_深度解析_从架构原理到生产实践摘要:Apache Kafka 作为当今最流行的分布式流处理平台之一,已经成为现代数据架构的核心组件。本文将从 Kafka 的核心概念出发,深入剖析其底层架构、存储机制、高可用设计以及生产环境中的最佳实践,帮助你构建对 Kafka 的系统性认知。