Linux安装并配置Hadoop

目录

  • 一、安装并配置JDK
  • 二、安装并配置Hadoop
  • 三、安装过程中遇到的问题总结

一、安装并配置JDK

Linux上一般会安装Open JDK,关于OpenJDK和JDK的区别:http://www.cnblogs.com/sxdcgaq8080/p/7487369.html

准备Open JDK 1.8

查询可安装的java版本

bash 复制代码
yum -y list java*

安装jdk1.8,由于我是M1 ARM系统,因此

bash 复制代码
yum install -y java-1.8.0-openjdk.aarch64

java -version查看已安装的jdk版本

java的安装目录为:/usr/lib/jvm

在/etc/profile下配置环境变量(这里已经配置了完整的环境变量,包括Hadoop)

bash 复制代码
# set java environment
export JAVA_HOME=/usr/lib/jvm/java-1.8.0-openjdk-1.8.0.312.b07-1.el8_4.aarch64
export JRE_HOME=$JAVA_HOME/jre
export CLASSPATH=.:$JAVA_HOME/lib/dt.jar:$JAVA_HOME/lib/tools.jar
export HADOOP_HOME=/opt/hadoop-1.2.1
export PATH=$PATH:$JAVA_HOME/bin:$JRE_HOME/bin:$HADOOP_HOME/bin:$HADOOP_HOME/sbin

二、安装并配置Hadoop

使用wget下载Hadoop压缩包

bash 复制代码
wget https://archive.apache.org/dist/hadoop/common/hadoop-1.2.1/hadoop-1.2.1.tar.gz

将hadoop压缩包移动至/opt目录下,并且解压

bash 复制代码
mv hadoop-1.2.1.tar.gz /opt/
cd /opt
tar -zxvf hadoop-1.2.1.tar.gz

可以在hadoop目录中配置conf目录下的文件

hadoop-env.sh

修改JAVA_HOME环境变量

bash 复制代码
# The java implementation to use.  Required.
export JAVA_HOME=/usr/lib/jvm/java-1.8.0-openjdk-1.8.0.312.b07-1.el8_4.aarch64

core-site.xml

xml 复制代码
<configuration>
    <!-- hadoop工作目录-->
    <property>
        <name>hadoop.tmp.dir</name>
        <value>/hadoop/tmp</value>
    </property>
    <!-- 元数据目录-->
    <property>
        <name>dfs.name.dir</name>
        <value>/hadoop/name</value>
    </property>
    <!--文件系统访问路径-->
    <property>
        <name>fs.default.name</name>
        <value>hdfs://imooc:900</value>
    </property>
</configuration>

hdfs-site.xml

xml 复制代码
<configuration>
    <!-- 文件系统数据存放目录-->
    <property>
        <name>dfs.data.dir</name>
        <value>/hadoop/data</value>
    </property>
</configuration>

mapred-site.xml

xml 复制代码
<configuration>
    <!-- 任务调度器访问路径-->
    <property>
        <name>mapred.job.tracker</name>
        <value>imooc:9001</value>
    </property>
</configuration>

在/etc/profile下,配置Hadoop环境变量

shell 复制代码
export HADOOP_HOME=/opt/hadoop-1.2.1

并且修改export PATH

shell 复制代码
export PATH=$PATH:$JAVA_HOME/bin:$JRE_HOME/bin:$HADOOP_HOME/bin:$HADOOP_HOME/sbin

在hadoop的bin目录下,对Hadoop的namenode进行格式化操作

shell 复制代码
hadoop namenode -format

并在bin目录启动hadoop,使用jps命令查看hadoop是否正常运行

使用其命令,查看hadoop下的文件

bash 复制代码
hadoop fs -ls /

可以看到有一个 Hadoop文件

三、安装过程中遇到的问题总结

1、ssh免密

运行staet-all.sh出现The authenticity of host 'localhost (::1)' can't be established,需要设置ssh免密

bash 复制代码
ssh -o StrictHostKeyChecking=no 192.168.2.100(本机IP)

2、hostname错误

运行staet-all.sh出现Exception in thread "main" java.net.UnknownHostException: unknown host: xxx
注意:hdfs://net:9000中的net是linux的主机名,可以通过echo $HOSTNAME查询主机

3、jps缺少

输入jps命令后,只有jps,那就说明配置有误,按照上文配置进行检查

4、warn信息

在输入一些hadoop命令时,可以看到如下的警告信息,但是不影响运行
Warning: $HADOOP_HOME is deprecated.

需在/etc/profile中添加

shell 复制代码
 export HADOOP_HOME_WARN_SUPPRESS=0
相关推荐
试试勇气6 分钟前
Linux学习笔记(十七)--线程概念
linux·笔记·学习
LXY_BUAA10 分钟前
《嵌入式操作系统》_高级字符设备驱动_20260316
linux·运维·服务器·驱动开发
顶妙WMS海外仓管理系统35 分钟前
Shopify卖家破910万,海外仓如何对接Shopify独立站?
运维·产品运营
优美的赫蒂1 小时前
香橙派5plus单独编译内核安装时的报错记录
linux·rk3588·orangepi
·醉挽清风·1 小时前
学习笔记—Linux—文件系统
linux·笔记·学习
IMPYLH1 小时前
Linux 的 chmod 命令
linux·运维·服务器
迷茫青年2 小时前
带你进入linux的世界,linux基础知识讲解
linux
北京智和信通2 小时前
面向超融合的全域监控与一体化运维方案
运维·网管软件·超融合监控·超融合运维
艾莉丝努力练剑2 小时前
【MYSQL】MYSQL学习的一大重点:数据库基础
linux·运维·服务器·数据库·c++·学习·mysql
会喷火才能叫火山2 小时前
本地搭建AI相关步骤
linux·运维·ai·centos