Spark,集群搭建-Standalone

集群搭建-Standalone

一、解压

在之前的学习中我们有了一个软件包 spark.3.1.2-bin-hadoop3.2.tgz (eg我的在 /opt/software目录下)把这个软件包解压到 /opt/module 下(也可以自己决定解压到哪里)。对应的命令是:

tar -zxvf spark-3.3.1-bin-hadoop3.tgz -C /opt/module

二、重命名

进入 /opt/module/ 把解压的内容右键重命名一下为 spark-standalone ,也可使用命令:

mv spark-3.1.1-bin-hadoop3.2/ spark-standalone

三、配置环境变量,更新spark路径

打开 /etc/profile.d/my_env.sh 加入如下代码

四、同步环境变量,并使用source命令让它生效

root@hadoop100 \~\]# xsync /etc/profile.d ![](https://i-blog.csdnimg.cn/direct/b18c729d7d784b4f8a51d4cd179fc6d9.png) ### 五、修改配置文件 打开 /opt/module/spark-standalone/conf 中可看到修改文件内容前把 ****.template 后缀名****都删掉再打开 ****workers.template文件**** 内容设置为三个主机名 hadoop100 hadoop101 hadoop102 ****spark-env.sh.template文件**** export JAVA_HOME=/opt/module/jdk1.8.0_212 export HADOOP_HOME=/opt/module/hadoop-3.1.3 export SPARK_MASTER_IP=hadoop100 export SPARK_MASTER_PORT=7077 export SPARK_DIST_CLASSPATH=$(/opt/module/hadoop-3.1.3/bin/hadoop classpath) export HADOOP_CONF_DIR=/opt/module/hadoop-3.1.3/etc/hadoop export SPARK_YARN_USER_ENV="CLASSPATH=/opt/module/hadoop-3.1.3/etc/hadoop" export YARN_CONF_DIR=/opt/module/hadoop-3.1.3/etc/hadoop export SPARK_HISTORY_OPTS=" -Dspark.history.ui.port=18080 -Dspark.history.fs.logDirectory=hdfs://hadoop100:8020/directory -Dspark.history.retainedApplications=30 " **spark-defaults.conf.****te**mplate文件**** spark.eventLog.enabled true spark.eventLog.dir hdfs://hadoop100:8020/directory spark.yarn.historyServer.address=hadoop100:18080 spark.history.ui.port=18080 ### 六、启动SPARK集群。 进入到hadoop100机器,切换目录到/opt/module/spark-standalone/sbin下,运行命令 ./start-all.sh。 使用jps命令能看到我划线的就说明运行成功 ![](https://i-blog.csdnimg.cn/direct/d884517d0f6d486c9e9ce58daec2c15e.png) ### 七、查看启动结果 打开浏览器,输入hadoop100:8080。看到效果如下说明成功: ![](https://i-blog.csdnimg.cn/direct/7562d8ceba214627ad174525062cf582.png)

相关推荐
2601_94837457几秒前
商用电子秤怎么选
大数据·python
jdyzzy8 分钟前
什么是 JIT 精益生产模式?它与传统的生产管控方式有何不同?
java·大数据·人工智能·jit
Elastic 中国社区官方博客16 分钟前
跳过 MLOps:通过 Cloud Connect 使用 EIS 为自管理 Elasticsearch 提供托管云推理
大数据·数据库·人工智能·elasticsearch·搜索引擎·ai·全文检索
数研小生44 分钟前
1688商品列表API:高效触达批发电商海量商品数据的技术方案
大数据·python·算法·信息可视化·json
dingzd951 小时前
AI 代理购物落地后,真正的“增量岗位”叫——商品数据工程
大数据·人工智能·跨境电商·内容营销·跨境
無森~1 小时前
HBase Java API
java·大数据·hbase
sensen_kiss1 小时前
Jupter Notebook 使用教程
大数据·人工智能·python·学习·数据分析
m0_687399841 小时前
telnet localhost 15672 RabbitMQ “Connection refused“ 错误表示目标主机拒绝了连接请求。
分布式·rabbitmq
八月瓜科技1 小时前
2026春晚机器人专利战:从舞台秀到资本竞逐的产业突围
大数据·人工智能·microsoft·机器人·娱乐
伟大的大威1 小时前
NVIDIA DGX Spark (ARM64/Blackwell) Kubernetes 集群 + GPU Operator 完整部署指南
大数据·spark·kubernetes