Spark,从0开始配置Spark的local模式

从0开始配置Spark的local模式

具体步骤:

1.启动虚拟机(开一台即可)

2.通过finalshell连接虚拟机,并将文件上传安装文件到 /opt/software下

3.解压spark安装文件到/opt/module下
tar -zxvf spark-3.3.1-bin-hadoop3.tgz -C /opt/module/

4.重命名,把解压后的文件夹改成spark-local。因为后续我们还会使用其他的配置方式,所以这里先重命名一次。mv是linux的命令,

mv spark-3.3.1-bin-hadoop3 spark-local
5.配置环境变量
① 打开etc/profile.d/my_env.sh文件中,补充设置spark的环境变量。

复制代码
export SPARK_HOME=/opt/module/spark-local
export PATH=$PATH:$SPARK_HOME/bin:$SPARK_HOME/sbin

② 使用 source 命令让环境变量生效

root@hadoop100 module\]# cd /etc/profile.d \[root@hadoop100 profile.d\]# source my_env.sh 运行一下下面两行代码 \[root@hadoop100 profile.d\]# cd /opt/module \[root@hadoop100 module\]# spark-submit --version 出现下列就是对的,成功了 ![](https://i-blog.csdnimg.cn/direct/4e478a93f31045c0a268c3dffe29e127.png) ### **现在我们使用单机模式运行第一个Spark程序** 示例: 进入到spark-local,运行命令spark-submit命令。 spark-submit --class org.apache.spark.examples.SparkPi --master local\[2\] /opt/module/spark-local/examples/jars/spark-examples_2.12-3.1.1.jar 10 结果展示: ![](https://i-blog.csdnimg.cn/direct/85e366c664a64434ae201f5ac3d71832.png) 查看运行任务详情 在任务还处于运行状态时,可以通过hadoop100:4040来查看。 ![](https://i-blog.csdnimg.cn/direct/d2f2d03b8cae40b8a572af33ecd6b0ad.png)注:一旦任务结束,则这个界面就不可访问了。

相关推荐
Edingbrugh.南空1 小时前
Flink Postgres CDC 环境配置与验证
大数据·flink
isNotNullX2 小时前
什么是数据分析?常见方法全解析
大数据·数据库·数据仓库·人工智能·数据分析
小袁拒绝摆烂2 小时前
ElasticSearch快速入门-1
大数据·elasticsearch·搜索引擎
一路向北North3 小时前
使用reactor-rabbitmq库监听Rabbitmq
分布式·rabbitmq·ruby
点控云3 小时前
智能私域运营中枢:从客户视角看 SCRM 的体验革新与价值重构
大数据·人工智能·科技·重构·外呼系统·呼叫中心
zkmall4 小时前
企业电商解决方案哪家好?ZKmall模块商城全渠道支持 + 定制化服务更省心
大数据·运维·重构·架构·开源
随缘而动,随遇而安8 小时前
第八十八篇 大数据中的递归算法:从俄罗斯套娃到分布式计算的奇妙之旅
大数据·数据结构·算法
Amy187021118238 小时前
赋能低压分布式光伏“四可”建设,筑牢电网安全新防线
分布式
GISer_Jing9 小时前
Git协作开发:feature分支、拉取最新并合并
大数据·git·elasticsearch
IT_102410 小时前
Spring Boot项目开发实战销售管理系统——系统设计!
大数据·spring boot·后端