大数据环境搭建

目录

一:虚拟机:VirtualBox

二:Shell工具:MobaXterm

三:安装脚本

四:JDK和Hadoop

4.1:安装

4.2:启动

4.3:Hadoop可视化访问

4.4:关机


一:虚拟机:VirtualBox

VirtualBox-6.0.24-139119-Win

1.1:默认配置

1.2:导入3个node

1.3:启动三个node

(有的电脑可能启动失败可以看看:VirtualBox 不能为虚拟电脑打开一个新任务(Failed to get device handle and/or partition ID for 0000000001c5fb30 )-CSDN博客

二:Shell工具:MobaXterm

下载地址:
MobaXterm Xserver with SSH, telnet, RDP, VNC and X11 - Home Edition

shell工具连接三个虚拟机

三台机器地址分别是192.168.56.151、192.168.56.152​​​、192.168.56.153

账号root 密码123456

三:安装脚本

复制代码
git clone https://gitee.com/several-boats/playground.git
cd playground/
chmod +x playground.sh
./playground.sh install
source /etc/profile
cd ~

四:JDK和Hadoop

4.1:安装

复制代码
先把两个安装包(hadoop-3.3.6.tar.gz\jdk-8u191-linux-x64.tar.gz)用shell工具拖拽到/root下
复制代码
playground add jdk-8u191-linux-x64.tar.gz
playground add hadoop-3.3.6.tar.gz
playground init
复制代码
以上信息是否正确---y
是否安装JDK--yes
是否修改jdk信息--n
复制代码
source /etc/profile
java -version
playground config hadoop
复制代码
是否要更新-- y
安装包序列号---1(选Hadoop)
需要安装到哪些节点---node01,node02,node03
主节点---node01
复制代码
playground update config
playground install hadoop
source /etc/profile
复制代码
是否修改Hadoop安装信息--n
复制代码
source /etc/profile
hadoop namenode -format --force
cd ~

4.2:启动

复制代码
cd ~
start-all.sh

安装完后再对另两个机器进行source /etc/profile命令

4.3:Hadoop可视化访问

HDFS:

192.168.56.151:9870----Hadoop3

192.168.56.151:50070----Hadoop2

里面有一些值得看的信息Live Nodes表示存活的节点

Yarn:

192.168.56.151:8088

4.4:关机

复制代码
cd ~
stop-all.sh

点击virtualBox三个node,点击停止-正常关机

平常最好备份下

相关推荐
ha_lydms1 天前
Hologres 简介
大数据·hadoop·阿里云·mapreduce·yarn·dataworks·hologres
Francek Chen4 天前
【大数据处理与分析】实验5:MapReduce初级编程实践
大数据·hadoop·分布式·mapreduce
Zhu7589 天前
在k8s集群环境部署高可用的Apache Hadoop3.1.1定制版集群
hadoop·kubernetes
还有你Y10 天前
软件工程架构
hadoop·架构·软件工程
曾阿伦14 天前
Windows 下运行 Hadoop 并部署到 AWS EMR 指南
hadoop·windows·aws
极光代码工作室15 天前
基于Spark的日志监控与分析平台
大数据·hadoop·python·spark·数据可视化
liuxiaowei316 天前
Winform+WPF双框架实战:喷涂工艺SCADA上位机从0到1搭建(附采集监控源码+车间踩坑实录)
大数据·hadoop·wpf
hkNaruto19 天前
【大数据】《传统Hadoop大数据技术入门:补充与进阶——从数据格式到智能决策的问答实录》
大数据·hadoop·分布式
牛奶咖啡1320 天前
大数据Hadoop运维应用实践——双NameNode高可用Hadoop集群架构(下)
大数据·hadoop·hadoop集群配置文件解析·hadoop高可用集群安装部署·配置指定多台服务器相互免密·配置hadoop服务开机自启·ansible部署hadoop
李昊哲小课21 天前
spark4 集群安装
大数据·hadoop·zookeeper·spark