大数据之Hadoop(一)

目录

一、准备三台服务器

二、虚拟机间配置免密登录

三、安装JDK

四、关闭防火墙

五、关闭安全模块SELinux

六、修改时区和自动时间同步


一、准备三台服务器

我们先准备三台服务器,可以通过虚拟机的方式创建,也可以选择云服务器。

关于如何创建虚拟机,我有写过相关文章。可以参考【编程环境安装】专题。

二、虚拟机间配置免密登录

配置的目的是方便分发资源。可以参考虚拟机之间配置免密登录_何苏三月的博客-CSDN博客

三、安装JDK

大数据的很多框架都依赖于JDK,所以,我们为每台服务器都安装好JDK。

Linux环境下安装JDK1.8_linux安装openjdk1.8_何苏三月的博客-CSDN博客

四、关闭防火墙

复制代码
systemctl stop firewalld
systemctl disable firewalld

五、关闭安全模块SELinux

Linux系统有一个安全模块SELinux,用以限制用户和程序的相关权限,来确保系统的安全稳定。

为了避免后面出现问题,我的建议是直接关掉。

需要在每台服务器执行如下命令:

复制代码
vim /etc/sysconfig/selinux

# 将第七行 SELINUX=enforcing 改为
SELINUX=disabled

然后保存退出后,重启虚拟机即可。

注意一定要写对,否则系统无法启动了。

六、修改时区和自动时间同步

俗称对表。

这需要我们下载一款ntp的软件来帮助我们完成"对表"工作。注意:依然是每台服务器都需要设置。

  1. 安装ntp软件

    yum install -y ntp

2.更新时区

复制代码
rm -f /etc/localtime
sudo ln -s /usr/share/zoneinfo/Asia/Shanghai /etc/localtime

3.同步时间

复制代码
ntpdate -u ntp.aliyun.com

4.开启ntp服务并设置开机自启

复制代码
systemctl start ntpd
systemctl enable ntpd

演示

以上前期准备工作就算是做完了。

我的建议是做好虚拟机快照,这样即使后面服务器崩溃出问题了,我们也可以回到当前这个状态。

ok,我们下个教程见~

相关推荐
大大大大晴天25 分钟前
每天认识一个组件:Apache DolphinScheduler
大数据
yumgpkpm36 分钟前
Acceldata ODP(Open Data Platform)3.3.6.4(RHEL9)保姆级完整安装手册
大数据·人工智能·hive·hadoop·kafka·hbase·cloudera
邓工说电1 小时前
智慧断路器安全吗?数据加密、离线保护与合规认证全解读
大数据·数据库·人工智能·智能断路器·炜晔科技
出海客1 小时前
跨境电商多语言客服知识库怎么建:资料结构、检索边界与人工升级
大数据·人工智能
liliangcsdn1 小时前
派息率指标的应用探索和分析
大数据·算法
sunxunyong1 小时前
hs2偶发连接失败问题处理
hadoop
adinnet20261 小时前
企业微调大模型(Fine-tuning):先吃透 RAG 还是先训自己的模型
大数据·数据库
GlobalInfo2 小时前
2026年推理算力超越训练算力,市场调研该关注什么
大数据·人工智能·ai·芯片
方方洛2 小时前
ray教程-00-前言与导读
人工智能·分布式·机器学习
方方洛2 小时前
ray教程-01-认识Ray
人工智能·分布式·机器学习