9_Spark安装

下载spark压缩包

通过百度网盘分享的文件:spark-2.0.2-bin-hadoop2.6.tgz

链接:https://pan.baidu.com/s/1lXPExVxxdkdx1QjiLlaorw

提取码:yc69

通过百度网盘分享的文件:scala-2.11.8.tgz

链接:https://pan.baidu.com/s/1YR4enZqTgE-Yy3Jb456JIQ

提取码:yc69

1.Scala配置
  • 分别在master、slave1、slave2上执行。

解压Scala压缩包,进入解压后的Scala目录

pwd

复制代码
vim /root/.bashrc

添加环境变量:

text 复制代码
#set scala environment
export SCALA_HOME=/usr/local/src/scala-2.11.8
export PATH=$PATH:${SCALA_HOME}/bin
#set spark environment
export SPARK_HOME=/usr/local/src/spark-2.0.2-bin-hadoop2.6
export PATH=$PATH:${SPARK_HOME}/bin

验证:

复制代码
bash
scala -version
2.Spark集群配置

解压Spark压缩包

进入解压后的Spark目录

cd conf/

添加和修改slaves文件
复制代码
cp slaves.template slaves
vim slaves
# 将 localhost 修改为:
slave1
slave2
添加和修改 spark-env.sh 文件
复制代码
cp spark-env.sh.template spark-env.sh
vim spark-env.sh

添加配置:

text 复制代码
export SCALA_HOME=/usr/local/src/scala-2.11.8
export JAVA_HOME=/usr/local/src/jdk1.8.0_181
export HADOOP_HOME=/usr/local/src/hadoop-2.6.1
export HADOOP_CONF_DIR=$HADOOP_HOME/etc/hadoop
SPARK_MASTER_WEBUI_PORT=8989
SPARK_MASTER_IP=master
SPARK_LOCAL_DIRS=/usr/local/src/spark-2.0.2-bin-hadoop2.6
SPARK_DRIVER_MEMORY=1G
分发Spark到slave节点
复制代码
# 进入 /usr/local/src 目录
scp -rp spark-2.0.2-bin-hadoop2.6/ slave1:`pwd`
scp -rp spark-2.0.2-bin-hadoop2.6/ slave2:`pwd`
3.启动集群
复制代码
cd sbin/
./start-all.sh
jps
4.网页监控面板

master:8989

5.验证

进入Spark目录

复制代码
# 集群 Standalone
./bin/spark-submit --class org.apache.spark.examples.SparkPi --master spark://master:7077 ./examples/jars/spark-examples_2.11-2.0.2.jar 10
# 集群 spark on Yarn
./bin/spark-submit --class org.apache.spark.examples.SparkPi --master yarn-cluster ./examples/jars/spark-examples_2.11-2.0.2.jar 10

相关推荐
samLi062013 小时前
【数据集】A股上市公司beta贝塔系数数据(2010-2024年)
大数据
xianghongtao011613 小时前
麦肯锡2026技术趋势03_科学发现与工程AI_研究解读
大数据·人工智能
成长之路51416 小时前
【数据集】中国分行业进出口数据(2019-2026年)
大数据
计算机毕业编程指导师16 小时前
【大数据毕设选题推荐】基于Spark的WTA职业网球赛事演变与竞技格局分析系统源码 毕业设计 选题推荐 毕设选题 数据分析 机器学习 深度学习
大数据·python·计算机·spark·毕业设计·课程设计·wta网球
躺柒17 小时前
读数据架构知识体系指南14数据编织
大数据·数据仓库·数据分析·数据湖·数据编织
樱花落木兰18 小时前
分布式登录实战:Session 会话共享改造,Redis 存储用户登录状态
java·javascript·数据库·redis·分布式·缓存
计算机毕业编程指导师18 小时前
大数据毕设怎么做?基于Hadoop的多源社交媒体心理健康情感分析与可视化系统从零到一指导 源码 毕业设计 选题推荐 毕设选题 数据分析 机器学习 深度学习
大数据·hadoop·计算机·数据分析·毕业设计·课程设计·媒体
计算机毕业设计杰瑞18 小时前
【最新原创大数据】基于大数据的酒店数据分析与可视化,附源码_高质量项目_可视化_数据分析_毕设选题推荐_SPark_Hadoop_毕设指导
大数据·信息可视化·数据挖掘·课程设计
ShineWinsu18 小时前
对于Redis:Steam、Geospatial、Hyperloglog、Bitmap、Bitfield类型的解析
数据库·c++·redis·分布式·缓存·面试·zset