安装并运行hadoop程序

1.在虚拟机上安装javaJDK

(1)把javaJDK文件上传到服务器

在opt文件夹下新建一个software文件夹,将jdk拖入software

(2)解压文件

在opt文件夹下新建一个module文件夹,确认上传成功之后,在software(进入命令:cd /opt/software)目录下,运行如下命令:

tar -zxvf jdk-8u212-linux-x64.tar.gz -C /opt/module/

(3)配置环境变量

在如下路径新建文件写入代码并保存:

复制代码
#JAVA_HOME
export JAVA_HOME=/opt/module/jdk1.8.0_212
export PATH=$PATH:$JAVA_HOME/bin

source一下/etc/profile文件,让新的环境变量PATH生效:

source /etc/profile

在任意目录下输入java -version,看是否能出现jdk版本

2.在虚拟机上安装hadoop

(1)把hadoop文件上传到服务器

将hadoop拖入software

输入如下命令进入software:

cd /opt/software

(2)解压文件

在输入如下命令进行解压:
tar -zxvf hadoop-3.1.3.tar.gz -C /opt/module/

(3)配置环境变量

在my_env.sh输入如下代码并保存:

复制代码
#HADOOP_HOME
export HADOOP_HOME=/opt/module/hadoop-3.1.3
export PATH=$PATH:$HADOOP_HOME/bin
export PATH=$PATH:$HADOOP_HOME/sbin

输入如下代码查看hadoop是否安装成功

3.运行官方WordCount程序

在如下目录新建文件夹wcinput

在wcinput新建两个文件

写入如下内容:

输入命令进入:

cd /opt/module/hadoop-3.1.3/wcinput

输入命令运行:

hadoop jar share/hadoop/mapreduce/hadoop-mapreduce-examples-3.1.3.jar wordcount wcinput wcoutput

查看计数:

相关推荐
龙山云仓10 分钟前
MES系统超融合架构
大数据·数据库·人工智能·sql·机器学习·架构·全文检索
会算数的⑨36 分钟前
Kafka知识点问题驱动式的回顾与复习——(一)
分布式·后端·中间件·kafka
张小凡vip40 分钟前
Kafka--使用 Kafka Connect 导入/导出数据
分布式·kafka
无忧智库1 小时前
某市“十五五“知识产权大数据监管平台与全链条保护系统建设方案深度解读(WORD)
大数据·人工智能
回忆是昨天里的海1 小时前
kafka概述
分布式·kafka
知识即是力量ol1 小时前
初识 Kafka(一):分布式流平台的定义、核心优势与架构全景
java·分布式·kafka·消息队列
综合热讯1 小时前
股票融资融券交易时间限制一览与制度说明
大数据·人工智能·区块链
华农DrLai1 小时前
Spark SQL Catalyst 优化器详解
大数据·hive·sql·flink·spark
Pluchon1 小时前
硅基计划4.0 算法 简单模拟实现位图&布隆过滤器
java·大数据·开发语言·数据结构·算法·哈希算法
nbsaas-boot1 小时前
Pipeline + Saga 分布式扩展规范
分布式