Spark,集群搭建-Standalone

集群搭建-Standalone

一、解压

在之前的学习中我们有了一个软件包 spark.3.1.2-bin-hadoop3.2.tgz (eg我的在 /opt/software目录下)把这个软件包解压到 /opt/module 下(也可以自己决定解压到哪里)。对应的命令是:

tar -zxvf spark-3.3.1-bin-hadoop3.tgz -C /opt/module

二、重命名

进入 /opt/module/ 把解压的内容右键重命名一下为 spark-standalone ,也可使用命令:

mv spark-3.1.1-bin-hadoop3.2/ spark-standalone

三、配置环境变量,更新spark路径

打开 /etc/profile.d/my_env.sh 加入如下代码

四、同步环境变量,并使用source命令让它生效

root@hadoop100 \~\]# xsync /etc/profile.d ![](https://i-blog.csdnimg.cn/direct/b18c729d7d784b4f8a51d4cd179fc6d9.png) ### 五、修改配置文件 打开 /opt/module/spark-standalone/conf 中可看到修改文件内容前把 ****.template 后缀名****都删掉再打开 ****workers.template文件**** 内容设置为三个主机名 hadoop100 hadoop101 hadoop102 ****spark-env.sh.template文件**** export JAVA_HOME=/opt/module/jdk1.8.0_212 export HADOOP_HOME=/opt/module/hadoop-3.1.3 export SPARK_MASTER_IP=hadoop100 export SPARK_MASTER_PORT=7077 export SPARK_DIST_CLASSPATH=$(/opt/module/hadoop-3.1.3/bin/hadoop classpath) export HADOOP_CONF_DIR=/opt/module/hadoop-3.1.3/etc/hadoop export SPARK_YARN_USER_ENV="CLASSPATH=/opt/module/hadoop-3.1.3/etc/hadoop" export YARN_CONF_DIR=/opt/module/hadoop-3.1.3/etc/hadoop export SPARK_HISTORY_OPTS=" -Dspark.history.ui.port=18080 -Dspark.history.fs.logDirectory=hdfs://hadoop100:8020/directory -Dspark.history.retainedApplications=30 " **spark-defaults.conf.****te**mplate文件**** spark.eventLog.enabled true spark.eventLog.dir hdfs://hadoop100:8020/directory spark.yarn.historyServer.address=hadoop100:18080 spark.history.ui.port=18080 ### 六、启动SPARK集群。 进入到hadoop100机器,切换目录到/opt/module/spark-standalone/sbin下,运行命令 ./start-all.sh。 使用jps命令能看到我划线的就说明运行成功 ![](https://i-blog.csdnimg.cn/direct/d884517d0f6d486c9e9ce58daec2c15e.png) ### 七、查看启动结果 打开浏览器,输入hadoop100:8080。看到效果如下说明成功: ![](https://i-blog.csdnimg.cn/direct/7562d8ceba214627ad174525062cf582.png)

相关推荐
BYSJMG20 分钟前
计算机大数据毕业设计推荐:基于Hadoop+Spark的食物口味差异分析可视化系统【源码+文档+调试】
大数据·hadoop·分布式·python·spark·django·课程设计
萤丰信息2 小时前
技术赋能安全:智慧工地构建城市建设新防线
java·大数据·开发语言·人工智能·智慧城市·智慧工地
Viking_bird3 小时前
Apache Spark 3.2.0 开发测试环境部署指南
大数据·分布式·ajax·spark·apache
励志成为糕手3 小时前
企业级Spring事务管理:从单体应用到微服务分布式事务完整方案
分布式·spring·微服务·隔离级别·事务管理
用户199701080184 小时前
抖音商品列表API技术文档
大数据·数据挖掘·数据分析
Fireworkitte4 小时前
Kafka的ISR、OSR、AR详解
分布式·kafka·ar
数据皮皮侠6 小时前
最新上市公司业绩说明会文本数据(2017.02-2025.08)
大数据·数据库·人工智能·笔记·物联网·小程序·区块链
计算机毕设-小月哥8 小时前
完整源码+技术文档!基于Hadoop+Spark的鲍鱼生理特征大数据分析系统免费分享
大数据·hadoop·spark·numpy·pandas·计算机毕业设计
Jinkxs8 小时前
AI重塑金融风控:从传统规则到智能模型的信贷审批转型案例
大数据·人工智能
时序数据说15 小时前
时序数据库市场前景分析
大数据·数据库·物联网·开源·时序数据库