kafka

あ-14 小时前
kafka
kafka broker迁移此脚本可实现旧 Broker 1~5 → 新 Broker 6~9 的健康分区批量迁移,真正支持中断恢复,可以按 10/20 个 Partition 一批执行,直到旧 Broker 的 ReplicaCount 全部降到 0
海兰14 小时前
docker·kafka·apache
【 Kafka进阶5】使用 Docker 部署 Apache Kafka 集群完全指南从单节点快速尝鲜到生产级隔离模式集群,一文打通容器化 Kafka 部署全链路。传统的 Kafka 部署需要手动配置 JVM、ZooKeeper(或 KRaft 控制器)以及复杂的网络调优。使用 Docker 后:
海兰2 天前
zookeeper·kafka·apache
【Kafka进阶4】KRaft 完全指南:Apache Kafka 摆脱 ZooKeeper 的架构KRaft(Kafka Raft Metadata Mode)是 Apache Kafka 自 2.8.0 引入、3.x 正式推荐生产使用的元数据管理新模式。它彻底移除了对 ZooKeeper 的依赖,将集群协调、元数据存储和共识算法全部内置,让 Kafka 成为一个真正自包含的分布式系统。
海兰3 天前
分布式·架构·kafka
【 Kafka进阶3】Apache Kafka 分布式事件流平台:架构原理与微服务解耦机制简要分析从订单履约出发,揭示传统同步调用下服务间链路复杂度呈 O(N²) 指数增长的“耦合之痛”,分析基于事件总线的发布‑订阅模式如何将复杂度优雅地降至 O(N)。
小白一枚133 天前
大数据·运维·elk·kafka·个人开发
[学习笔记]Kafka 篇:从原理到实战的一站式指南目标读者:你会用 Kafka,但说不清它为什么快;你懂点原理,但一动手部署就卡壳;或者你对 Kafka 一知半解,想要一张完整的地图。
阿里云云原生3 天前
云原生·kafka
还在给 AI “喂冷饭”?8.28 上海沙龙:带你跨越 AI 实时上下文鸿沟你的 AI Agent,是不是还在用昨天的数据做今天的决策?AI 应用从 Demo 走向生产,最容易被忽视的瓶颈不是模型本身,而是数据底座。如何在保障高性能、高可用的同时实现弹性扩展与成本可控?当上下文仍依赖 T+1 批处理供给,模型读到的永远是上一批次状态——如何为 AI 持续注入实时数据流,让决策始终基于最新业务事实?
海兰4 天前
学习·kafka·linq
【Kafka学习4】六大核心 APIKafka 的 API 分层清晰,既适合构建简单的消息队列,也能支撑复杂的实时计算。下图展示了它们与 Kafka 集群的交互关系:
NJCloud4 天前
linux·运维·分布式·elk·kafka
ELK企业级日志分析平台(四)——基于 ELFK + Kafka 的日志采集与传输平台部署实践E(Elasticsearch)、L(Logstash)、F(FIlebeat)、K(Kibana)流程示意图:
海兰5 天前
学习·kafka·apache
【Kafka学习3】Apache Kafka 本地部署环境快速入门指南首先,下载最新版本的 Kafka 并解压https://www.apache.org/dyn/closer.cgi?path=/kafka/4.3.1/kafka_2.13-4.3.1.tgz。
渣渣盟5 天前
flink·kafka·linq
Flink + Kafka 数据写入实战:从API调用到端到端一致性精讲在实时数据管道中,Apache Flink + Apache Kafka 的组合已成为事实标准。然而,很多开发者在将Flink处理后的结果数据写入Kafka时,常常面临两个灵魂拷问:
海兰5 天前
学习·kafka·apache
【Kafka学习2】Apache Kafka 典型应用场景过去,很多系统使用 ActiveMQ、RabbitMQ 等传统消息代理来解耦生产者和消费者,缓冲突发流量。但这些系统在大规模、高吞吐场景下往往力不从心,扩展性和容错能力有限。
heimeiyingwang5 天前
架构·kafka·rabbitmq
【架构实战】消息队列选型与异步架构设计:从Kafka到RabbitMQ,一次聊透昨天聊了分布式事务,有一个关键话题一直没展开:异步通信。微服务架构里,服务之间的调用有两种形态:同步和异步。同步调用(A调用B,等B返回)是主流,但很多场景下它是性能杀手:用户下单后要调用库存服务、支付服务、积分服务、物流服务——如果每个都同步等响应,用户点一次下单要等3秒,这还没算任何一个服务慢导致的整体超时。
lakernote5 天前
分布式·kafka·linq
图解 Kafka Consumer 常用 API:poll、seek、pause、wakeup 到底在控制什么?版本基线:Apache Kafka 4.3.x、Java Client 4.3.x。本文讨论 Java KafkaConsumer API,示例默认使用 Consumer Group、手工提交 offset,并以同步业务处理为基线。
hopsky6 天前
数据库·分布式·kafka
kafka 对发送端的容错处理当 Kafka 消息累计发送失败达到上限或重试机制无法解决问题时,系统通常会通过以下几种机制来进行处理和兜底:
lazy H6 天前
后端·中间件·kafka·rabbitmq·rocketmq
不同的消息队列有什么区别?Kafka、RabbitMQ、RocketMQ、Pulsar、ActiveMQ 选型对比在后端开发中,只要系统规模稍微大一些,就很容易遇到消息队列(Message Queue,简称 MQ)。
Devin~Y7 天前
java·spring boot·redis·elasticsearch·spring cloud·kafka·mybatis
从内容社区到AI智能客服:Spring Boot + Spring Cloud + Spring AI 全栈实战面试拆解场景:某互联网大厂,业务是「内容社区 + UGC + AIGC」,正在招聘 Java 后端开发。角色:
DLYSB_9 天前
rust·kafka·grafana·报警灯
Kafka 消费倾斜死锁与 Partition 掉队:我用 Rust 写了个“数据管道物理哨兵”,比 Grafana 报警快了 18 秒在海量数据实时计算(Flink/Spark Streaming)与日志管道(ELK/Vector)架构中,Apache Kafka 是支撑高吞吐数据流转的核心引擎。然而,当遭遇 Key 设计不均引发的消费倾斜(Data Skew)、慢消费节点拖垮整个 Consumer Group,或 Partition 偏移量(Offset)提交超时导致的 Rebalance 死锁 时,消费延迟(Lag)会呈现指数级飙升。
creator_Li9 天前
kafka
Kafka消费者offset提交auto.commit是出事的根源。它的机制是消费者每隔auto.commit.interval.ms自动提交当前poll的最大offset,但提交的是"已拉取"的offset而非"已处理"的offset。消费者poll下来500条,处理到第200条时触发自动提交,提交了第500条的offset。此时如果崩溃,第201到500条直接丢失。反过来,如果处理完了但还没到提交间隔就rebalance,新消费者从上次提交点重新消费,201到500条重复处理。
TDengine (老段)9 天前
大数据·数据库·物联网·flink·kafka·时序数据库·tdengine
TDengine 第三方工具 — Telegraf、Kafka Connect、Flink、Spark分类:14.生态 | 篇章:04 第三方工具 免费详情TDengine 通过 InfluxDB 兼容协议、JDBC、连接器等方式与主流数据生态对接。本文汇总 Telegraf、Kafka Connect、Flink、Spark、Logstash 等工具的集成方式。
apgk19 天前
docker·kafka·rabbitmq
基于Canal实现mysql数据同步到消息队列(RabbitMQ/Kafka)详细操作教程由于网络网闸问题,目前采用canal进行解析mysql,然后推送到mq,再次进行消费写入数据库。以下基于 arm64 linux ubuntu24、mysql 8.0、 docker部署、canal-server v1.1.8、kafka v3.9.0、rabbitmq v4.3.2