Spark,从0开始配置Spark的local模式

从0开始配置Spark的local模式

具体步骤:

1.启动虚拟机(开一台即可)

2.通过finalshell连接虚拟机,并将文件上传安装文件到 /opt/software下

3.解压spark安装文件到/opt/module下
tar -zxvf spark-3.3.1-bin-hadoop3.tgz -C /opt/module/

4.重命名,把解压后的文件夹改成spark-local。因为后续我们还会使用其他的配置方式,所以这里先重命名一次。mv是linux的命令,

mv spark-3.3.1-bin-hadoop3 spark-local
5.配置环境变量
① 打开etc/profile.d/my_env.sh文件中,补充设置spark的环境变量。

复制代码
export SPARK_HOME=/opt/module/spark-local
export PATH=$PATH:$SPARK_HOME/bin:$SPARK_HOME/sbin

② 使用 source 命令让环境变量生效

root@hadoop100 module\]# cd /etc/profile.d \[root@hadoop100 profile.d\]# source my_env.sh 运行一下下面两行代码 \[root@hadoop100 profile.d\]# cd /opt/module \[root@hadoop100 module\]# spark-submit --version 出现下列就是对的,成功了 ![](https://i-blog.csdnimg.cn/direct/4e478a93f31045c0a268c3dffe29e127.png) ### **现在我们使用单机模式运行第一个Spark程序** 示例: 进入到spark-local,运行命令spark-submit命令。 spark-submit --class org.apache.spark.examples.SparkPi --master local\[2\] /opt/module/spark-local/examples/jars/spark-examples_2.12-3.1.1.jar 10 结果展示: ![](https://i-blog.csdnimg.cn/direct/85e366c664a64434ae201f5ac3d71832.png) 查看运行任务详情 在任务还处于运行状态时,可以通过hadoop100:4040来查看。 ![](https://i-blog.csdnimg.cn/direct/d2f2d03b8cae40b8a572af33ecd6b0ad.png)注:一旦任务结束,则这个界面就不可访问了。

相关推荐
Leo.yuan7 分钟前
3D 数据可视化系统是什么?具体应用在哪方面?
大数据·数据库·3d·信息可视化·数据分析
what_201828 分钟前
分布式1(cap base理论 锁 事务 幂等性 rpc)
分布式
只因只因爆42 分钟前
spark小任务
大数据·分布式·spark
cainiao0806051 小时前
Java 大视界——Java 大数据在智慧交通智能停车诱导系统中的数据融合与实时更新
java·大数据·开发语言
Freedom℡1 小时前
如何将两台虚拟机进行搭桥
spark
椰椰椰耶2 小时前
【RabbitMQ】路由模式和通配符模式的具体实现
分布式·rabbitmq
lcw_lance3 小时前
业务中台-典型技术栈选型(微服务、容器编排、分布式数据库、消息队列、服务监控、低代码等)
数据库·分布式·微服务
End9284 小时前
Spark之搭建Yarn模式
大数据·分布式·spark
我爱写代码?4 小时前
Spark 集群配置、启动与监控指南
大数据·开发语言·jvm·spark·mapreduce
TDengine (老段)4 小时前
什么是物联网 IoT 平台?
大数据·数据库·物联网·时序数据库·tdengine·涛思数据