Spark,集群搭建-Standalone

集群搭建-Standalone

一、解压

在之前的学习中我们有了一个软件包 spark.3.1.2-bin-hadoop3.2.tgz (eg我的在 /opt/software目录下)把这个软件包解压到 /opt/module 下(也可以自己决定解压到哪里)。对应的命令是:

tar -zxvf spark-3.3.1-bin-hadoop3.tgz -C /opt/module

二、重命名

进入 /opt/module/ 把解压的内容右键重命名一下为 spark-standalone ,也可使用命令:

mv spark-3.1.1-bin-hadoop3.2/ spark-standalone

三、配置环境变量,更新spark路径

打开 /etc/profile.d/my_env.sh 加入如下代码

四、同步环境变量,并使用source命令让它生效

root@hadoop100 \~\]# xsync /etc/profile.d ![](https://i-blog.csdnimg.cn/direct/b18c729d7d784b4f8a51d4cd179fc6d9.png) ### 五、修改配置文件 打开 /opt/module/spark-standalone/conf 中可看到修改文件内容前把 ****.template 后缀名****都删掉再打开 ****workers.template文件**** 内容设置为三个主机名 hadoop100 hadoop101 hadoop102 ****spark-env.sh.template文件**** export JAVA_HOME=/opt/module/jdk1.8.0_212 export HADOOP_HOME=/opt/module/hadoop-3.1.3 export SPARK_MASTER_IP=hadoop100 export SPARK_MASTER_PORT=7077 export SPARK_DIST_CLASSPATH=$(/opt/module/hadoop-3.1.3/bin/hadoop classpath) export HADOOP_CONF_DIR=/opt/module/hadoop-3.1.3/etc/hadoop export SPARK_YARN_USER_ENV="CLASSPATH=/opt/module/hadoop-3.1.3/etc/hadoop" export YARN_CONF_DIR=/opt/module/hadoop-3.1.3/etc/hadoop export SPARK_HISTORY_OPTS=" -Dspark.history.ui.port=18080 -Dspark.history.fs.logDirectory=hdfs://hadoop100:8020/directory -Dspark.history.retainedApplications=30 " **spark-defaults.conf.****te**mplate文件**** spark.eventLog.enabled true spark.eventLog.dir hdfs://hadoop100:8020/directory spark.yarn.historyServer.address=hadoop100:18080 spark.history.ui.port=18080 ### 六、启动SPARK集群。 进入到hadoop100机器,切换目录到/opt/module/spark-standalone/sbin下,运行命令 ./start-all.sh。 使用jps命令能看到我划线的就说明运行成功 ![](https://i-blog.csdnimg.cn/direct/d884517d0f6d486c9e9ce58daec2c15e.png) ### 七、查看启动结果 打开浏览器,输入hadoop100:8080。看到效果如下说明成功: ![](https://i-blog.csdnimg.cn/direct/7562d8ceba214627ad174525062cf582.png)

相关推荐
商业模式源码开发5 小时前
实体门店低获客成本增长案例:3 人转介绍模型 + 消费返还机制落地分析
大数据·商业模式·私域流量
元拓数智7 小时前
智能分析落地卡壳?先补好「数据关系+语义治理」这层技术基建
大数据·分布式·ai·spark·数据关系·语义治理
TDengine (老段)7 小时前
TDengine Tag 设计哲学与 Schema 变更机制
大数据·数据库·物联网·时序数据库·iot·tdengine·涛思数据
sxgzzn8 小时前
新能源场站数智化转型:基于数字孪生与AI的智慧运维管理平台解析
大数据·运维·人工智能
清平乐的技术专栏9 小时前
【Flink学习】(二)Flink 本地环境搭建,运行第一个入门程序
大数据·flink
这是程序猿10 小时前
Spring Boot自动配置详解
java·大数据·前端
ws20190710 小时前
AUTO TECH China 2026广州汽车零部件展:从整机集成迈向核心部件的产业跃升
大数据·人工智能·科技·汽车
humors22110 小时前
从数据到决策:汽车使用成本的精细计算指南
大数据·程序人生
大大大大晴天10 小时前
Flink技术实践:RocksDB 状态后端技术解密
大数据·flink
1892280486111 小时前
NY382固态MT29F32T08GSLBHL8-24QM:B
大数据·服务器·人工智能·科技·缓存