spark单机版安装

单机版安装,只需要jdk和spark, 不需要hadoop。

1. 安装JDK

2. 安装spark

2.1. 下载

下载地址见 大数据组件下载地址

2.2. 解压

复制代码
tar   -zxvf  spark-2.3.1-bin-hadoop2.7.tgz
mv spark-2.3.1-bin-hadoop2.7 spark-2.3.1

2.3. 配置环境变量

进入/etc/profile目录下:vim /etc/profile

复制代码
#Spark
export SPARK_HOME=/opt/spark-2.3.1
export PATH=$PATH:$SPARK_HOME/bin

2.4. 修改配置文件

进入spark的conf目录下:cd /opt/spark-2.3.1/conf/,

copy一份spark-env.sh

复制代码
cp  spark-env.sh.template spark-env.sh

然后进入vim编辑模式:

复制代码
vim  spark-env.sh

添加如下配置

复制代码
export JAVA_HOME=/usr/local/java-1.8.0------391 #这里是你jdk的安装路径
export SPARK_HOME=/opt/spark-2.3.1
export SPARK_MASTER_IP=XXX.XX.XX.XXX  #将这里的xxx改为自己的Linux的ip地址

2.5. 修改slaves

copy一份slaves:cp slaves.template slaves

vi slaves

在最后面加上

localhost

3. 启动spark

进入spark的sbin目录:cd sbin/

启动spark ./start-all.sh

相关推荐
极客数模1 分钟前
【浅析赛题,一等奖水平】思路模型数据相关资料!2025 年“大湾区杯”粤港澳金融数学建模竞赛B 题 稳定币的综合评价与发展分析~
大数据·算法·数学建模·金融·数据挖掘·图论·1024程序员节
临风赏月20 分钟前
Hudi、Iceberg、Delta Lake、Paimon 建表语法与场景示例
大数据
luoganttcc1 小时前
加快高水平科技自立自强,引领发展新质生产力 <十五五 规划节选>
大数据·人工智能·科技
TDengine (老段)2 小时前
益和热力性能优化实践:从 SQL Server 到 TDengine 时序数据库,写入快 20 秒、查询提速 5 倍
大数据·数据库·物联网·性能优化·时序数据库·tdengine·1024程序员节
秋已杰爱2 小时前
技术准备十五:Elasticsearch
大数据·elasticsearch·搜索引擎
青云交3 小时前
Java 大视界 -- Java 大数据在智能家居能源消耗模式分析与节能策略制定中的应用
java·大数据·智能家居·数据采集·能源消耗模式分析·节能策略制定·节能效果评估
B站计算机毕业设计之家4 小时前
python图像识别系统 AI多功能图像识别检测系统(11种识别功能)银行卡、植物、动物、通用票据、营业执照、身份证、车牌号、驾驶证、行驶证、车型、Logo✅
大数据·开发语言·人工智能·python·图像识别·1024程序员节·识别
数字化脑洞实验室8 小时前
如何理解不同行业AI决策系统的功能差异?
大数据·人工智能·算法
starandsea12 小时前
gitlab解决传过大文件后删除导致pack过大问题
大数据·elasticsearch·gitlab
拉姆哥的小屋13 小时前
时间序列早期分类中的置信度累积问题:从ECE-C到时序依赖建模
大数据·人工智能