Ubuntu下部署Hadoop集群+Hive(二)

Hadoop集群搭建

准备环境

hadoop-3.3.6.tar.gz,jdk-8u421-linux-x64.tar.gz

根据自己的使用下载对的hadoop和jdk版本

hadoop下载地址:Apache Hadoop

JDK下载地址:Java Downloads | Oracle

在3台服务器上的/opt/目录下新建module和software文件夹,其中software文件夹用来存放软件包,module用来存放解压后的安装文件;

bash 复制代码
root@hadoopMaster:/opt# mkdir software
root@hadoopMaster:/opt# mkdir module

接下来就是Hadoop集群环境的部署:

参考尚硅谷大数据---搭建Hadoop集群---软件安装_尚硅谷hadoop集群配置-CSDN博客

这篇文章对应的课程是23_尚硅谷_Hadoop_入门_克隆三台虚拟机_哔哩哔哩_bilibili,其中的23节到34节教程,讲的比较详细,建议先快速过一下相关章节课程,然后对照来安装,基本没有问题;

其中,有几点注意:

1.课程中的三台主机,Hadoop102、Hadoop103、Hadoop104,对应的我的主机是HadoopMaster、HadoopSlave01和HadoopSlave02;

2.课程后面新建的为了方便查看各个服务器进程启动情况的jpsall.sh脚本,运行的时候可能会报:bash: jps: command not found;这种情况,需要加上jps的全路径,这样改写就可以: ssh $host "/opt/module/jdk1.8.0_421/bin/jps"。

相关推荐
极光代码工作室17 小时前
基于Spark的日志监控与分析平台
大数据·hadoop·python·spark·数据可视化
liuxiaowei32 天前
Winform+WPF双框架实战:喷涂工艺SCADA上位机从0到1搭建(附采集监控源码+车间踩坑实录)
大数据·hadoop·wpf
humbinal3 天前
同时支持 gui & cli 的 parquet 文件查看工具,高性能小清新!
hive·python·rust·spark·开源·github·parquet
hkNaruto5 天前
【大数据】《传统Hadoop大数据技术入门:补充与进阶——从数据格式到智能决策的问答实录》
大数据·hadoop·分布式
吾AI科技5 天前
基于Tez引擎的 Hive SQL 性能优化
大数据·hive·性能优化·tez
牛奶咖啡136 天前
大数据Hadoop运维应用实践——双NameNode高可用Hadoop集群架构(下)
大数据·hadoop·hadoop集群配置文件解析·hadoop高可用集群安装部署·配置指定多台服务器相互免密·配置hadoop服务开机自启·ansible部署hadoop
abcy0712136 天前
hive 执行器原理
hive
李昊哲小课6 天前
spark4 集群安装
大数据·hadoop·zookeeper·spark
buligbulig7 天前
Hadoop环境安装和集群创建
大数据·hadoop·分布式
香山上的麻雀10088 天前
Hive内部表(MANAGED_TABLE)的“批量删除分区”特性详解
数据仓库·hive·hadoop