hadoop部署前置准备

基于linux系统运行 此文档开始前 请先准备好linux系统 (虚拟机,服务器配置均可)以三台为例

此文档基于linux三台虚拟机完成 使用finallshell ssh隧道连接

三台分别为

  • hadoop1:172.16.2.133
  • hadoop2:172.16.2.134
  • hadoop3:172.16.2.135

系统:CentOS Stream9 aarch64(ARM)

步骤一 配置三台主机名

linux指令如下

zsh 复制代码
# hadoop1执行
hostnamectl set-hostname hadoop1
# node02执行
hostnamectl set-hostname hadoop2
# node03执行
hostnamectl set-hostname hadoop3

hosts解析

三台修改 /etc/hosts 文件

追加以下三行

zsh 复制代码
172.16.2.133 hadoop1
172.16.2.134 hadoop2 
172.16.2.135 hadoop3

步骤二 hadoop1 配置ssh登录

仅在hadoop1置行

zsh 复制代码
# 生成密钥,一路回车 
ssh-keygen -t rsa 
# 把公钥分发到3台机器(包含自己) 
ssh-copy-id hadoop1 
ssh-copy-id hadoop2 
ssh-copy-id hadoop3

测试 :ssh hadoop2 ,可正常切换

步骤三 安装jdk

第一 分别在三台机器下 安装 一下文件夹作为约定

创建存放数据的目录

复制代码
mkdir -p /export/data/

创建存放安装程序的目录

复制代码
mkdir -p /export/servers/

创建存放安装包的目录

复制代码
mkdir -p /export/software/

第二 下载jdk安装包 这里以jdk 21 为例

下载链接

https://www.oracle.com/java/technologies/downloads/#java21

将下载的压缩包存放到 /export/servers

通过命令 进行解压 (要注意替换命令中文件位置 压缩包名称 以及压缩位置)

复制代码
tar -zxvf /opt/software/jdk-8uXXX-linux-aarch64.tar.gz -C /opt/module/

第三 进行环境变量配置

创建此文件

/etc/profile.d/my_env.sh

打开写入 配置文件 (注意解压后安装包路径及文件名称 如上图为jdk-21.0.12.1)

复制代码
export JAVA_HOME=/opt/module/jdk1.8.0_xxx 
export PATH=$PATH:$JAVA_HOME/bin

第四 刷新配置文件 让配置生效

复制代码
source /etc/profile.d/my_env.sh 

验证

复制代码
java -version

如图即为生效

第五 使用scp 进行 分发

三台主机名:hadoop1 hadoop2 hadoop3

JDK 目录示例:/export/servers/jdk-21.0.12.1,换成自己真实的文件夹名

把 hadoop1 的 jdk 目录传到 hadoop2

复制代码
scp -r /export/servers/jdk-21.0.12.1 root@hadoop2:/export/servers/

传到 hadoop3

复制代码
scp -r /export/servers/jdk-21.0.12.1 root@hadoop3:/export/servers/
  • -r:递归,用来拷贝文件夹(拷贝文件夹必须加 - r

分发环境变量文件 my_env.sh

复制代码
scp /etc/profile.d/my_env.sh root@hadoop2:/etc/profile.d/
scp /etc/profile.d/my_env.sh root@hadoop3:/etc/profile.d/

scp 简单说明

复制代码
scp 源文件 目标用户@目标主机:目标路径
  • 拷贝文件 :不用 -r
  • 拷贝文件夹 :必须 -r
相关推荐
计算机源码社5 小时前
基于K-Means聚类的新生儿败血症临床分型与可视化分析系统 基于数据挖掘的新生儿败血症生命体征时序走势与关联性可视化研究
大数据·hadoop·python·数据挖掘·数据分析·spark·毕业设计
计算机源码社8 小时前
基于大数据的全球温室气体排放燃料结构与碳强度评估研究-基于Spark的全球温室气体排放多维度检测与评估分析
大数据·hadoop·python·数据挖掘·数据分析·spark·毕业设计
Q26433650231 天前
【有i源码】基于大数据的城市交通流量与出行特征可视化分析平台-基于Hadoop的城市交通拥堵关联规则与异常检测研究
大数据·hadoop·机器学习·数据挖掘·数据分析·spark·数据可视化
kaoa0001 天前
Linux入门攻坚——90、Hadoop-2-MapReduce计算框架及Hadoop生态系统概览
linux·hadoop·mapreduce
Gl�ria1 天前
Hadoop 集群高可用节点分布
hadoop
计算机源码社1 天前
基于Hadoop+Spark的商家优惠券营销效果数据分析与可视化-基于Python的商家优惠券营销效果检测与评估分析系统
大数据·hadoop·python·数据挖掘·spark·毕业设计·数据可视化
IT毕设梦工厂2 天前
计算机毕业设计选题推荐:基于大数据的草鱼价格分析与可视化|毕业设计选题|计算机毕设|选题推荐|毕设指导|项目定制|源码|高质量项目
大数据·hadoop·python·数据挖掘·数据分析·课程设计·大数据毕设项目
Gl�ria2 天前
Hive SQL 执行卡住完整排查 & 处理
hive·hadoop·sql
Q26433650233 天前
【有源码】基于文本挖掘的消费者金融投诉主题发现与风险预警研究,基于Python的CFPB消费者投诉数据可视化分析系统
大数据·hadoop·机器学习·数据挖掘·spark·毕业设计·课程设计