flume采集netcat数据到kafka指定主题

在主节点使用Flume采集实时数据生成器25001端口的socket数据(实时数据生成器脚本为主节点/data_log目录下的gen_ds_data_to_socket脚本,该脚本为Master节点本地部署且使用socket传输),将数据存入到Kafka的Topic中(Topic名称为ods_mall_log,分区数为2,ZK关于Kafka的信息在其/kafka节点),使用Kafka自带的消费者消费ods_mall_log(Topic)中的数据,查看Topic中的前1条数据的结果,

Flume配置

bash 复制代码
a1.sources=r1
a1.channels=c1
a1.sinks=k1

a1.sources.r1.type=netcat
a1.sources.r1.bind=0.0.0.0
a1.sources.r1.port=8087

a1.sinks.k1.type=org.apache.flume.sink.kafka.KafkaSink
a1.sinks.k1.kafka.topic=ods_mall_log
a1.sinks.k1.kafka.bootstrap.servers=master:9092


a1.channels.c1.type=memory

a1.sinks.k1.channel=c1
a1.sources.r1.channels=c1

kafka 消费数据

bash 复制代码
 kafka-console-consumer.sh --bootstrap-server master:9092  --topic ods_mall_log  --from-beginning --max-messages 1
相关推荐
Data_Journal5 小时前
用于网页抓取的 Node-unblocker
大数据·开发语言·数据库·python·scrapy
涤生大数据5 小时前
一次“没有运行日志”的DolphinScheduler任务失败排查
大数据·数据库·人工智能·状态模式
专注API从业者5 小时前
告别人工盯品!借助 Open Claw 搭建电商商品自动化监控与数据分析系统(完整可运行源码)
大数据·运维·数据库·数据分析·自动化
多加点辣也没关系8 小时前
Git - 的安装与使用
大数据·git
醉颜凉8 小时前
Elasticsearch 相关性评分核心解密:tie_breaker 参数作用原理与实战调优全解析
大数据·elasticsearch·jenkins
芯小途20269 小时前
影视 AIGC 素材管理:改到第 108 版,为什么「块级去重」能把 TB 级素材压回百 GB(附估算脚本)
大数据·aigc
IanSkunk9 小时前
视光中心建设复盘:从流程断层到组织能力的落地路径
大数据·人工智能
fanged9 小时前
Yocto1--环境搭建和验证
大数据·搜索引擎·嵌入式
微石科技10 小时前
社区卫生中心慢病管理怎么做?宁波微石科技智慧医康系统:一个平台管住趋势、随访、患者
大数据·人工智能·科技
大大大大晴天10 小时前
K8S 在大数据里的真正价值:适用场景、收益边界与不适合的地方
大数据·云原生