Flume和kafka的整合

1、Kafka作为Source 【数据进入到kafka中,抽取出来】

在flume的conf文件夹下,有一个flumeconf 文件夹:这个文件夹是自己创建的
创建一个flume脚本文件: kafka-memory-logger.conf

Flume 1.9用户手册中文版 --- 可能是目前翻译最完整的版本了

java 复制代码
a1.sources = r1
a1.sinks = k1
a1.channels = c1

# Bind the source and sink to the channel
a1.sources.r1.channels = c1
a1.sinks.k1.channel = c1

a1.sources.r1.type = org.apache.flume.source.kafka.KafkaSource
a1.sources.r1.batchSize = 100
a1.sources.r1.batchDurationMillis = 2000
a1.sources.r1.kafka.bootstrap.servers = bigdata01:9092,bigdata02:9092,bigdata03:9092
a1.sources.r1.kafka.topics = five
a1.sources.r1.kafka.consumer.group.id = qiaodaohu

# Use a channel which buffers events in memory
a1.channels.c1.type = memory
a1.channels.c1.capacity = 1000
a1.channels.c1.transactionCapacity = 100

a1.sinks.k1.type = logger
a1.sinks.k1.maxBytesToLog = 128

接着创建一个topic ,名字叫做 kafka-flume,或者直接使用以前的five 主题

创建主题的命令

kafka-topics.sh --create --topic kafka-flume --bootstrap-server bigdata01:9092 --partitions 3 --replication-factor 1

测试:

启动一个消息生产者,向topic中发送消息,启动flume,接收消息

kafka-console-producer.sh --topic kafka-flume --bootstrap-server bigdata01:9092

相关推荐
Boundivore 班德沃13 分钟前
使用阿里云快速搭建 DataLight 平台
大数据·阿里云·开源·云计算
智通财经快讯24 分钟前
FBX福币交易所多只高位股重挫,聚星科技首日高开348%
大数据·人工智能·科技
小王毕业啦1 小时前
省级生活垃圾无害化处理率面板数据(2004-2022年)
大数据·人工智能·数据挖掘·数据分析·生活·社科数据
流浪在地球上的小朋友1 小时前
移门缓冲支架:减少噪音,提升生活质量
大数据·搜索引擎·云计算·全文检索·big data
路由侠内网穿透1 小时前
外网访问 WebDav 服务
大数据·服务器
GDDGHS_1 小时前
kafka夺命连环三十问(16-22)
分布式·kafka
ClouGence1 小时前
Kafka 到 Kafka 数据同步
数据库·数据分析·kafka·数据同步
B站计算机毕业设计超人2 小时前
计算机毕业设计Python+大模型中医养生问答系统 知识图谱 医疗大数据 中医可视化 机器学习 深度学习 人工智能 大数据毕业设计
大数据·人工智能·爬虫·python·深度学习·机器学习·知识图谱
songqq272 小时前
【快速上手】Kafka-Eagle 监控的安装部署
分布式·kafka
Linux运维技术栈2 小时前
企业生产环境-麒麟V10(ARM架构)操作系统部署kafka高可用集群
linux·运维·架构·kafka·arm