2023_Spark_实验二十三:Kafka的安装与基本操作

Kafka的安装与基本操作

一、前提工作

二、Kafka安装

三、Kafka基本操作

一、前提工作

必须安装了zookeeper

单机可参考:zookeeper单机安装与配置

集群可参考:zookeeper的集群安装

二、Kafka安装

上传kafka_2.11-2.4.1.tgz到/tools目录下

解压安装到/opt/soft_installed/目录下

bash 复制代码
tar -zvxf kafka_2.11-2.4.1.tgz -C /opt/soft_installed

配置环境变量并让环境变量生效

执行:vi ~/.bash_profile 命令,添加如下信息并保存退出:

bash 复制代码
# 配置kafka集群
export KAFKA_HOME=/opt/soft_installed/kafka_2.11-2.4.1
export PATH=$PATH:$KAFKA_HOME/bin

环境变量执行生效

bash 复制代码
source ~/.bashrc

创建用于存放kafka的log目录

bash 复制代码
mkdir -p /opt/soft_installed/kafka_2.11-2.4.1/kafka-logs

配置server.properties(文件在kafka安装路径下的config目录中)

配置:vi server.properties

bash 复制代码
listeners=PLAINTEXT://node1:9092
log.dirs=/opt/soft_installed/kafka_2.11-2.4.1/kafka-logs
zookeeper.connect=node1:2181

启动kafka(先需要启动zookeeper)

bash 复制代码
# 启动zookeeper
/opt/soft_installed/zookeeper-3.4.5/bin/zkServer.sh start

# 启动kafka
kafka-server-start.sh /opt/soft_installed/kafka_2.11-2.4.1/config

验证Kafka是否成功启动

查看9092端口是否已经启动:

bash 复制代码
netstat -anop|grep 9092

或者执行:jps,查看是否有kafka进程存在

三、Kafka基本操作

创建主题topic,如test

bash 复制代码
kafka-topics.sh --create --zookeeper node1:2181 --replication-factor 1 --partitions 1 --topic test

启动控制台生产者(需要另外打开一个终端)

bash 复制代码
kafka-console-producer.sh --broker-list node1:9092 --topic test

启动控制台消费者(需要另外打开一个终端)

bash 复制代码
kafka-console-consumer.sh --bootstrap-server node1:9092 --topic test --from-beginning

测试

在生产者所在的终端中输入一些文字,如:我爱北京天安门,天安上太阳升。 i love beijing i love guizhou i love spark,按回车键

在消费者终端可以看到

查看进程,jps可以看到

查看下此时zookeeper中生成了哪些内容,执行:zkCli.sh

bash 复制代码
zkCli.sh
相关推荐
一只鹿鹿鹿39 分钟前
数据资产管理解决方案(Word文件)
大数据·数据库·安全·web安全·系统安全
m0_6380796244 分钟前
2026年AI论文写作辅助工具技术对比与使用观察
大数据·人工智能
商业数据派1 小时前
日赚近1亿的网易,这个季度栽在了拼多多身上
大数据·人工智能
长谷深风1111 小时前
AI Tool 设计:粒度、参数与错误恢复怎么做
java·大数据·人工智能·ai agent·agent工作流·智能体设计·ai产品设计
for_ever_love__3 小时前
PySpark学习: 数据输出
开发语言·python·学习·spark
leoZ2314 小时前
10-Git 仓库蒸馏术:从代码仓库到 OpenClaw 虚拟人-蒸馏工具链
大数据·git·深度学习·神经网络·目标检测·elasticsearch·lstm
あ-4 小时前
kafka broker迁移
kafka
海兰4 小时前
【 Kafka进阶5】使用 Docker 部署 Apache Kafka 集群完全指南
docker·kafka·apache
夏贰四4 小时前
管控数据加载调度如何规避任务冲突?数据加载运维监控体系该如何搭建?
java·大数据·运维
BYSJMG5 小时前
计算机毕业设计选题推荐:基于大数据的心脏病风险数据可视化与分析(Hadoop+Spark+PySpark)
大数据·hadoop·信息可视化·数据分析·spark·课程设计