安装并运行hadoop程序

1.在虚拟机上安装javaJDK

(1)把javaJDK文件上传到服务器

在opt文件夹下新建一个software文件夹,将jdk拖入software

(2)解压文件

在opt文件夹下新建一个module文件夹,确认上传成功之后,在software(进入命令:cd /opt/software)目录下,运行如下命令:

tar -zxvf jdk-8u212-linux-x64.tar.gz -C /opt/module/

(3)配置环境变量

在如下路径新建文件写入代码并保存:

复制代码
#JAVA_HOME
export JAVA_HOME=/opt/module/jdk1.8.0_212
export PATH=$PATH:$JAVA_HOME/bin

source一下/etc/profile文件,让新的环境变量PATH生效:

source /etc/profile

在任意目录下输入java -version,看是否能出现jdk版本

2.在虚拟机上安装hadoop

(1)把hadoop文件上传到服务器

将hadoop拖入software

输入如下命令进入software:

cd /opt/software

(2)解压文件

在输入如下命令进行解压:
tar -zxvf hadoop-3.1.3.tar.gz -C /opt/module/

(3)配置环境变量

在my_env.sh输入如下代码并保存:

复制代码
#HADOOP_HOME
export HADOOP_HOME=/opt/module/hadoop-3.1.3
export PATH=$PATH:$HADOOP_HOME/bin
export PATH=$PATH:$HADOOP_HOME/sbin

输入如下代码查看hadoop是否安装成功

3.运行官方WordCount程序

在如下目录新建文件夹wcinput

在wcinput新建两个文件

写入如下内容:

输入命令进入:

cd /opt/module/hadoop-3.1.3/wcinput

输入命令运行:

hadoop jar share/hadoop/mapreduce/hadoop-mapreduce-examples-3.1.3.jar wordcount wcinput wcoutput

查看计数:

相关推荐
Coder个人博客1 天前
Linux6.19-ARM64 mm mmu子模块深入分析
大数据·linux·车载系统·系统架构·系统安全·鸿蒙系统
心态还需努力呀1 天前
CANN仓库通信库:分布式训练的梯度压缩技术
分布式·cann
财经三剑客1 天前
AI元年,春节出行安全有了更好的答案
大数据·人工智能·安全
岁岁种桃花儿1 天前
Flink CDC从入门到上天系列第一篇:Flink CDC简易应用
大数据·架构·flink
TOPGUS1 天前
谷歌SEO第三季度点击率趋势:榜首统治力的衰退与流量的去中心化趋势
大数据·人工智能·搜索引擎·去中心化·区块链·seo·数字营销
2501_933670791 天前
2026 高职大数据与会计专业零基础能考的证书有哪些?
大数据
WHD3061 天前
苏州数据库(SQL Oracle)文件损坏修复
hadoop·sql·sqlite·flume·memcached
ClouderaHadoop1 天前
CDH集群机房搬迁方案
大数据·hadoop·cloudera·cdh
TTBIGDATA1 天前
【Atlas】Ambari 中 开启 Kerberos + Ranger 后 Atlas Hook 无权限访问 Kafka Topic:ATLAS_HOOK
大数据·kafka·ambari·linq·ranger·knox·bigtop
程序员清洒1 天前
CANN模型部署:从云端到端侧的全场景推理优化实战
大数据·人工智能