大数据之Hadoop(一)

目录

一、准备三台服务器

二、虚拟机间配置免密登录

三、安装JDK

四、关闭防火墙

五、关闭安全模块SELinux

六、修改时区和自动时间同步


一、准备三台服务器

我们先准备三台服务器,可以通过虚拟机的方式创建,也可以选择云服务器。

关于如何创建虚拟机,我有写过相关文章。可以参考【编程环境安装】专题。

二、虚拟机间配置免密登录

配置的目的是方便分发资源。可以参考虚拟机之间配置免密登录_何苏三月的博客-CSDN博客

三、安装JDK

大数据的很多框架都依赖于JDK,所以,我们为每台服务器都安装好JDK。

Linux环境下安装JDK1.8_linux安装openjdk1.8_何苏三月的博客-CSDN博客

四、关闭防火墙

复制代码
systemctl stop firewalld
systemctl disable firewalld

五、关闭安全模块SELinux

Linux系统有一个安全模块SELinux,用以限制用户和程序的相关权限,来确保系统的安全稳定。

为了避免后面出现问题,我的建议是直接关掉。

需要在每台服务器执行如下命令:

复制代码
vim /etc/sysconfig/selinux

# 将第七行 SELINUX=enforcing 改为
SELINUX=disabled

然后保存退出后,重启虚拟机即可。

注意一定要写对,否则系统无法启动了。

六、修改时区和自动时间同步

俗称对表。

这需要我们下载一款ntp的软件来帮助我们完成"对表"工作。注意:依然是每台服务器都需要设置。

  1. 安装ntp软件

    yum install -y ntp

2.更新时区

复制代码
rm -f /etc/localtime
sudo ln -s /usr/share/zoneinfo/Asia/Shanghai /etc/localtime

3.同步时间

复制代码
ntpdate -u ntp.aliyun.com

4.开启ntp服务并设置开机自启

复制代码
systemctl start ntpd
systemctl enable ntpd

演示

以上前期准备工作就算是做完了。

我的建议是做好虚拟机快照,这样即使后面服务器崩溃出问题了,我们也可以回到当前这个状态。

ok,我们下个教程见~

相关推荐
Elastic 中国社区官方博客10 小时前
Elasticsearch:快速近似 ES|QL - 第一部分
大数据·运维·数据库·elasticsearch·搜索引擎·全文检索
龙腾AI白云11 小时前
大模型在天文科研中的应用:天体数据分析
大数据·flask·逻辑回归·pygame
快乐非自愿12 小时前
抛弃传统AI:OpenClaw与Skill重构AI生产力,技术范式不可逆
大数据·人工智能
网络研究员12 小时前
Claude身份认证后还是被封?三条稳定防封策略
大数据·人工智能
TuCoder12 小时前
2026年了,景区制作智慧导地图有哪些选择?
大数据
2601_9499251813 小时前
基于 OpenClaw 打造货代行业 AI 智能体架构实战
大数据·人工智能·架构·ai智能体
zhengyquan13 小时前
7000mAh 电池 + 独立 AI 键,小米 18 Pro 是堆料还是突破?
大数据·人工智能
geneculture13 小时前
意识的多学科定义:从16个视域,到融智学统合——基于“意+识”框架且区分“意识≠心智”系统研究
大数据·人工智能·融智学的重要应用·哲学与科学统一性·融智时代(杂志)·意识=意+识·智=信息处理+选择用意
Ai1731639157914 小时前
GB200 NVL72超节点深度解析:架构、生态与产业格局
大数据·服务器·人工智能·神经网络·机器学习·计算机视觉·架构
观远数据14 小时前
跨部门BI推广权限治理指南:如何避免数据泄露与权责混乱
大数据·人工智能·数据分析