记录之Ubuntu22.4虚拟机及hadoop为分布式安装

1.安装Ubuntu虚拟机系统

参考教程:【图说】VMware & Ubuntu22.04 详细安装教程

Vmware:17.5

Ubuntu:22.04

2.远程连接

  1. 组合键"CTRL+ALT+T"新建一个终端
  2. 创建一个用户hadoop:
powershell 复制代码
sudo useradd -m hadoop -s /bin/bash  # 创建用户

sudo passwd hadoop  # 修改用户密码

sudo adduser hadoop # 添加权限

使用filezilla连接Ubuntu22.04虚拟机

jdk:https://www.oracle.com/java/technologies/downloads/#java8

eclipse:https://www.eclipse.org/downloads/

将jdk安装包和eclipse安装包通过filezilla远程连接传入虚拟机。

具体安装:ubuntu安装eclipse、jdk以及环境配置

3.安装hadoop(伪分布式)

Hadoop官网下载3.3.5:
https://archive.apache.org/dist/hadoop/common/hadoop-3.3.5/hadoop-3.3.5.tar.gz

或者阿里云镜像下载:
https://mirrors.aliyun.com/apache/hadoop/common/hadoop-3.3.5/hadoop-3.3.5.tar.gz?spm=a2c6h.25603864.0.0.1225a91eQScNgQ

3.1 配置ssh等
Hadoop伪分布式配置教程中的第二部分。

3.2 解压hadoop
ubuntu-22.04虚拟机环境下安装Hadoop3.3.5

3.3 修改配置文件

参考3.2中链接的博客的如下目录部分。

3.4 启动hadoop命令

powershell 复制代码
cd /usr/local/hadoop
./sbin/start-dfs.sh        #start-dfs.sh是个完整的可执行文件,中间没有空格

jps

成功启动后,可以访问 Web 界面 http://localhost:9870 查看 NameNode 和 Datanode 信息,还可以在线查看 HDFS 中的文件

相关推荐
小五传输14 小时前
消防总队信创改造实践:国产文件传输服务器解决文件传输难题
大数据·运维·安全
flyinsono14 小时前
连锁宠物医院怎么管?杏聆荟系统实现多店高效协同
大数据·宠物
jyOverQ14 小时前
RabbitMQ 消息积压怎么办?Prefetch、消费者并发与扩容
分布式·后端·rabbitmq
Sayai15 小时前
Elasticsearch 9 安装验证实战:start-local 一键部署 + Docker 手动安装踩坑指南
大数据·elasticsearch·docker
智恒百亿15 小时前
8 卡 RTX 5090 服务器深度实测:256GB 显存能否支撑 70B 模型微调?选型参考
大数据·运维·服务器·人工智能
TDengine (老段)20 小时前
TDengine 线程模型 — 网络、调度、执行
大数据·数据库·物联网·制造·时序数据库·tdengine·涛思数据
智购科技自动贩卖机1 天前
自动售货机嵌入式状态机设计实战:从45个事件源到层次型状态机的工程重构
大数据·人工智能·stm32·物联网·重构·硬件架构
乐迪信息1 天前
智慧港口船舶AI算法实现在线状态监测
大数据·人工智能·深度学习·算法·计算机视觉
Raas1001 天前
MAI Gateway(魔芋企业级AI网关)对比分析:AI网关和API网关区别?企业级能力差距一览
大数据·人工智能·数据挖掘·mai gateway·企业级产品
Neighbor_OldY1 天前
云上安全配置审计与误配置修复实战:从安全组、OSS、RAM到数据库的全栈排查复盘
大数据·运维·安全·云计算